Человек или машина? Предварительный тест на стрижку для взаимодействия между словами и сигналами
arXiv: 2602,24080v3 Annuales Type: заменить резюме: преследование подобных людям агентов для разговора уже давно осуществляется на основе теста Turing. Для современных систем речи-пика (S2S) критический, но неохваченный вопрос заключается в том, могут ли они говорить как люди. Для решения этой проблемы мы проводим первый тест Turing для систем S2S, собирая 2968 человеческих суждений о диалогах между девятью современными системами S-2S и 28 участниками из числа людей. Наши результаты позволяют сделать четкий вывод: ни одна существующая система оценки S2S не проходит испытание, что свидетельствует о значительном разрыве в отношении человека. Для того чтобы диагностировать этот провал, мы развиваем тонкий таксономию с 18 измерениями человеческой идентичности и соответствующим образом подключаем внимание к собранным диалогам. Наш анализ показывает, что узкий уголок — это не семантическое понимание, а результат паралингуистических особенностей, эмоциональной экспрессивности и разговорной личности. Кроме того, мы находим, что модели АИ неубедительны в качестве тестовых судей Тьюринга. В ответ мы предлагаем следующее: