FRIDA Decisions — открытая модель быстрого мышления для русского языка. Она выбирает вариант из списка, ставит оценку по шкале, отвечает «да» или «нет» и ранжирует кандидатов за один проход энкодера, без генерации текста и за десятки миллисекунд на RTX 5060 Ti. Её можно поставить везде, где сейчас LLM работает классификатором или судьёй: маршрутизация обращений, модерация, разметка данных, ранжирование для RAG. На нашем бенчмарке razvilka модель набирает 0,893 — наравне с коммерческим API TypeSafe Jev (0,897) и с LLM Qwen3.5-35B-A3B, которая в 40 раз больше.
Коротко, что внутри:
- Скорость. 28-34 мс на запрос на RTX 5060 Ti. Коммерческий API по независимым замерам отвечает примерно за 430 мс вместе с сетью.
- Цена. Почти в 20 раз дешевле коммерческого API в пересчёте на запрос на арендованной карте при полной загрузке.