Байесовская разведка с внешней стороны
arXiv: 2609.14724v1 Annuales Type: новый резюме: Подведение интеллекта от наблюдаемого поведения является фундаментальной проблемой в искусственном интеллекте. Мы разрабатываем теорию байесовского интеллекта для таких агентов, как языковые модели. Каждый из них вызывает возможно несовершенный внутренний эксперимент; агент обновляет полную поддержку до введения правила Байеса и добросовестно сообщает о своих задних ответах на вопрос. Повторные состязания приносят свежие, независимые результаты одного и того же ненаблюдаемого эксперимента в одном фиксированном состоянии. Мы показываем, что поведение агента допускает это объяснение только в том случае и если его отчеты не полностью противоречивы, т.е. Частота представления докладов и размеры позитивных вероятностей не налагают никаких дополнительных ограничений. Мы также предлагаем и охарактеризуем поведенческие последствия приказа разведки, который делает поведение двух агентов совместимым с одним агентом, имеющим доступ к более информативной экспозиции