Иерархия многих троиц в Агенствах ЛЛМ

#Иерархия #Агенствах #Когда #Доминирующая #Этого

arXiv: 2604.09443v4 Тип уведомления: заменить резюме: крупные языковые агенты получают инструкции от многих сообщений системы источников, пользовательских запросов, продуктов инструментов, других агентов и более каждого из них с различными уровнями доверия и полномочий. Когда эти инструкции противоречат друг другу, агенты должны неукоснительно следовать самым высоким привилегиям и сохранять безопасность и эффективность. Доминирующая парадигма - иерархия инструкций (МГ) предполагает фиксированный небольшой набор привилегий (как правило, менее пяти), определяемый жесткими знаками роли (например, система > пользователь). Этого недостаточно для реальных агентских условий, где конфликты могут возникать в гораздо большем числе источников и контекстов. В рамках этой работы мы предлагаем иерархию обучения по принципу " многоуровневого обучения > (МНОГОГ) в качестве парадигмы для разрешения конфликтов между инструкциями, имеющими произвольно многие привилегии. Мы представляем MangeIH-Bench, первый контрольный показатель для Мэнгич. Множеству МГЧ-Бенч требуются модели, позволяющие вести до 12 уровней противоречивых инструкций с разной привилегией.