Почему агенты LLM радуются своей группе: очки, наблюдаемые нормы и репутация
arXiv: 261 010.1008v 1 Annuales Type: кросс-бюллетень. Сам по себе групповой лейбл мало что делает, когда решение имеет стоимость; то, что стимулирует фаворитизм, является наблюдаемым поведением и собственный послужной список индивида может его отменить. Мы проверяем это в небольших обществах с произвольными групповыми ярлыками, десять раундов обмена точками и совпадают одноразовые решения по 15 моделям OpenAI и трем моделям Клода, примерно 4400 обществ и 3,3 миллиона проверенных моделей. Во-первых, большой эффект от голой групповой этикетки, о которой сообщалось в предыдущих работах, появляется только тогда, когда другие баллы ничего не стоят для агента; как только агент может сохранить свои очки самостоятельно, этот эффект рушится на каждой модели, которая показывает это. Во-вторых, под колом история взаимодействия становится основным источником фаворитизма: эффект истории статистически положительный на 13 из 15 моделей, достигает 3,5-8 очков из 10 11, растет с числом раундов