Группы, работающие с использованием языковых моделей, преувеличивают консенсус при повторном обсуждении человеком задачи обоснования
arXiv: 2609.20543v1 Сообщение типа: новое резюме. Ставки полного согласия часто рассматриваются в качестве показателей коллективного понимания, но при этом зависит от того, каким образом осуществляется участие и окончательные штаты. Мы переиграли 100 хватавшихся человеческих васоновых групп с аналогичными крупными языковыми группами агентов (LLM), создавая один репутационный агент на ответ участника до обсуждения и оценивая агентов и людей с тем же кодом. По всем определениям человеческих баллов, оценки варьировались от 24% до 57,0%; около одной пятой участников так и не были размещены в сети, тогда как агенты почти всегда это делали. В двух анализах чувствительности, проведенных после отказа от участия в обследовании, по-прежнему налажен более консенсус между группами представителей: сопоставление данных (n = 98) позволило выявить пробелы в 34,0 и 43,9 процентных пунктов для способов общения и рассуждений, а сравнение с участием (n=45), позволившее получить представление, -- 34,1 и 44,4 пункта. Эти дополнительные маршруты позволили уменьшить различные асимметрии в измерениях, но сблизились на 0,5 процентных пункта. Этот разрыв не возник в ближайшее время