Привет, Хабр! Результаты коллег по цеху и наши исследования позволяют сделать однозначный вывод: в 2026-м для рецепта отличной reasoning -модели уже недостаточно лишь текстовых рассуждений. Для качественных ответов на большинство вопросов пользователей нужна работа с инструментами, мультимодальные режимы рассуждений, и нередко даже такая экзотика, как рассуждения в латентных представлениях сети. Мы рады поделиться с сообществом фреймворком для обучения рекурсивных reasoning-моделей STARM , существенно опережающих по качеству предыдущие open source -аналоги. Читать далее
Привет, Хабр! Результаты коллег по цеху и наши исследования позволяют сделать однозначный вывод: в 2026-м для рецепта отличной reasoning-модели уже недостаточно лишь текстовых рассуждений. Для качественных ответов на большинство вопросов пользователей нужна работа с инструментами, мультимодальные режимы рассуждений, и нередко даже такая экзотика, как рассуждения в латентных представлениях сети.
Мы рады поделиться с сообществом фреймворком для обучения рекурсивных reasoning-моделей STARM, существенно опережающих по качеству предыдущие open source-аналоги.
О чём расскажем?
STARM (Single Task Algorithmic Reasoning Models) — это результат наших экспериментов с обучением рекурсивных reasoning-моделей, в ходе которых мы:
Похожие статьи
M24.ru
M24.ru
Польские военные испугались работающего в порту ВМС китайского робота
Пользователи соцсетей назвали устройство угрозой безопасности Польши
Wildberries сообщили, что их приложение в ближайшее время вернется в американский App Store
Wildberries сообщили, что их приложение в ближайшее время вернется в американский App Store Приложение Wildberries вновь станет доступно для скачивания и обновления в американском App Store «в ближайш...
Вслед за ChatGPT: Google отмечает миллиард пользователей ИИ Gemini
Компания Google сообщила, что приложение Gemini превысило 1 млрд активных пользователей в месяц. Речь идет о веб-версии, приложениях для Android и iOS, а также Gemini в Chrome. По словам компании, это...