Реклама

SafeInferCom: Безопасная вычисления в момент наступления результата с помощью проверочного управления по середине процесса планирования робототехники

#SafeInferCom #Безопасная #MLRM #Основываясь #Эксперименты

arXiv:2610.11223v1 Вид уведомления: перекрестное резюме: модели большого разумного языка (MLRM) позволяют многоэтапное обоснование для планирования роботизированных задач, но продолжение рассуждения может переписать обоснованные промежуточные планы или оставить неурегулированными нарушения ограничений, понизив надежность планирования и запустая расчет времени. Мы разрабатываем контрольное время, которое разоблачает и проверяет промежуточные планы без нарушения первоначальной траектории декодирования. Основываясь на этом мониторе, мы предлагаем SafeInferCom - официальную систему с контролем, которая сохраняет действительные промежуточные планы и направляет коррекцию ошибок в течение поколения. Эксперименты в различных областях ЛЛРМ и планирования свидетельствуют о непоследовательности аргументации-реакции и ограниченной самокорректировке при одноразовом выводе. SafeInferCom повышает успех планирования и ускоряет погрешность в отношении одноразового вывода. В сочетании с итеративной доработкой это еще больше повышает успех при сокращении использования символов по сравнению с более совершенным.