Откат к миру, сохранение памяти: воспроизводимое нами мышление для длинно-горизонтных LLM агентов

#Откат #Annualce #Type #Humber #Abstract

arXiv: 2609.18304v1 Annualce Type: New Humber Abstract: Major Lange Model (LLM) Agers все чаще решают долгосрочные задачи посредством многоэтапного взаимодействия с окружающей средой, однако одно ошибочное действие может изменить последующие состояния и наблюдения, что приводит к возникновению ошибок во времени. Существующие методы либо корректируют контекст, не восстанавливая изменившиеся экологические состояния, либо возрождают ранее существовавшие государства и одновременно отказываясь от полезного опыта, что затрудняет как устранение условий отказа, так и недопущение повторения ошибок прошлого. Мы считаем, что надежное восстановление следует рассматривать как проблему пограничного контроля, которая совместно определяет время вмешательства, место возобновления и то, какая информация должна выжить после восстановления. Исходя из этой точки зрения, мы предлагаем создать унифицированную систему восстановления (RIR), которая восстанавливает исполнение до выбранного ранее состояния и одновременно обеспечивает передачу знаний о повторном использовании, отражаемых по заброшенной траектории, для того чтобы направлять последующие решения. Мы еще больше захаляем