Tencent заявила о технологическом прорыве в обучении ИИ, представив метод Training-Free GRPO

Tencent заявила о технологическом прорыве в обучении ИИ, представив метод Training-Free GRPO, который устраняет необходимость в fine-tuning и reinforcement learning. Новый подход позволяет модели обучаться на собственных выводах без изменения весов и достигать лучших результатов, используя всего 100 примеров и $18 вычислительных затрат. Эксперты называют это началом “эры обучения без обучения”, способной радикально изменить стоимость и скорость развития LLM

что произойдет с фондовым рынком, если станет понятно, что можно обучить ИИ без капзатрат в $1 трлн?

Поделиться
Telegram