Когнитивные продления для двухобеспечивающих языковых агентов: память и самоотключение в интерактивной среде

#Когнитивные #Annuales #Type #Cross #Резюме

arXiv:2609.19128v1 Annuales Type: Cross Резюме: Языковые агенты остаются хрупкими в интерактивной среде, где успех требует отслеживания состояния долгого горзона, эффективного осуществления действий и восстановления после неудачных шагов. Мы продлим SwiftSage, двухпроцессивный агент, который сочетает быстрых предложений с более медленным планировщиком, используя два модульных когнитивных расширения: адаптивный модуль памяти (AMM) для эпизоидного хранения и поиска при помощи пускового сигнала, и модуль самоотвода (SRM), предназначенный для ограниченной проверки исполнения в течение времени и корректировочного вмешательства. Оба модуля используются в качестве бронежилетов с одним и тем же субстратом, позволяющих контролировать абляции на ScienceWorld. В рамках четырех конфигураций - исходного, базового+AMM, базового +SRM и полной системы - полная система достигает наилучших средних конечных результатов (64,62), коэффициента успеха (43,17%) и успешной эффективности на этапе (19,33 шага), в то время как SRM является самым крупным отдельным вкладчиком. Результаты говорят о том, что экзеку

Компьютерные науки > Искусственный интеллект [представлен 16 сентября 2026 года] Название: Когнитивные продления для двухдобычных языковых агентов: Память и самоотсылка в интерактивной среде Взгляд на HTML (экспериментальный) Резюме: Лангуажные агенты остаются хрупкими в интерактивных средах, где успех требует долгого отслеживания состояния, эффективного осуществления действий и восстановления после неудачных шагов. Мы продлим SwiftSage, двухпроцессивный агент, который сочетает быстрых предложений с более медленным планировщиком, используя два модульных когнитивных расширения: адаптивный модуль памяти (AMM) для эпизоидного хранения и поиска при помощи пускового сигнала, и модуль самоотвода (SRM), предназначенный для ограниченной проверки исполнения в течение времени и корректировочного вмешательства. Оба модуля используются в качестве бронежилетов с одним и тем же субстратом, позволяющих контролировать абляции на ScienceWorld. В рамках четырех конфигураций - исходного, базового+AMM, базового +SRM и полной системы - полная система достигает наилучших средних конечных результатов (64,62), коэффициента успеха (43,17%) и успешной эффективности на этапе (19,33 шага), в то время как SRM является самым крупным отдельным вкладчиком. Результаты говорят о том, что контроль времени исполнения является доминирующим узким местом в этой среде, тогда как эпизодическая память становится наиболее полезной после стабилизации цикла запуска. История представления: Joao Migel Menses Dos Santho…