«Агент тупит» — это диагноз инструкции, а не модели

#Агент #ИИ-агентом #Почти #Хочу #Замеров
«Агент тупит» — это диагноз инструкции, а не модели

Год работы с ИИ-агентом на потоке отучил меня от фразы «модель поглупела». Почти всё, что выглядит тупостью или галлюцинациями, раскладывается на три дефекта инструкции: правило написано прозой, правило написано в форме «как не надо», у правила нет проверки. Хочу поделиться приёмами как это лечится, и рассказать про контур, в котором агент дописывает инструкцию себе сам. Замеров не будет, вместо них список того, что перестало происходить. Всё, на что я ссылаюсь, лежит в публичном репозитории; ссылки по тексту. Читать далее

TL;DR. Год работы с ИИ-агентом на потоке отучил меня от фразы «модель поглупела». Почти всё, что выглядит тупостью или галлюцинациями, раскладывается на три дефекта инструкции: правило написано прозой, правило написано в форме «как не надо», у правила нет проверки. Хочу поделиться приёмами как это лечится, и рассказать про контур, в котором агент дописывает инструкцию себе сам. Замеров не будет, вместо них список того, что перестало происходить. Всё, на что я ссылаюсь, лежит в публичном репозитории; ссылки по тексту.

Как я с этим всем связан

Мы делаем low-code платформу Интеграм и на ней разные приложения заказчикам. Основной репозиторий разработки ideav/crm заведён 30 января 2026 года, в нём 6258 коммитов, 2310 тикетов и 2583 смерженных пулл-реквеста. Почти всё там написано ИИ-агентом, задачи ставятся тикетами, приёмка идёт по PR. Инструкции агенту живут там же и открыты: CLAUDE.md в корне, база знаний по платформе в docs/kb/, полный цикл разработки приложения в docs/integram-app-workflow.md.

Темп в пару десятков PR в день быстро выжигает иллюзии, и главная из них: если агент сделал глупость, значит, он глупый. При разборе, когда их стали доводить до конца, каждый раз оказывалось, что инструкция допускала сделанное, а иногда прямо к нему вела (sic!).