Оценка " Биайс > в системах автоматического распознавания речи на основе телефона: анализ моделей транскрипции АПИ

#Оценка #Биайс #Annualcue #Type #WhisperIPA

arXiv:2606.11639v2 Annualcue Type: заменить резюме: поскольку системы автоматического распознавания речи (АСР) переходят на многоязычную поддержку и низкоресурсную языковую модель, уровни на основе телефонных разговоров служат критическим агностическим основанием. Однако большинство оценок демографических предрассудков АСР касаются расы, возраста, пола и акцентирования внимания на стандартных системах АСР на основе графема с относительно небольшим упором на системы на основе топонимов. В этом исследовании мы оцениваем эффективность WhisperIPA и ZIPO, двух современных систем с открытым исходным кодом, которые генерируют транскрипцию международного мобильного алфавита (МПА). Наша оценка включает существующую многоязычную речь-корпору и демографически аннотированную англоязычную корпорацию, сравнивая составленные модели транскрипции АПИ с системами графема-фоном (G2P), используя как стандартный коэффициент погрешности по телефону (PER), так и предлагаемый показатель Soft PER, который допускает лингвистические сходства по подмосткам. Наш анализ показывает, как показатели меняются.

Компьютерная наука > Расчет и язык [представлен 10 июня 2026 (v1), последний пересмотренный вариант 17 сентября 2026 года (эта версия, v2)) Заголовок: Оценка Биаса в системах автоматического распознавания речи на основе Phoneme: Анализ моделей транскриптов IPA View PDF HTML (экспериментальный) резюме: Системы автоматического распознания речей (АСР) переходят к многоязычной поддержке и малоресурсной языковой модели, уровни на основе телефонных линий служат критическим агностическим фундаментом. Однако большинство оценок демографических предрассудков АСР касаются расы, возраста, пола и акцентирования внимания на стандартных системах АСР на основе графема с относительно небольшим упором на системы на основе топонимов. В этом исследовании мы оцениваем эффективность WhisperIPA и ZIPO, двух современных систем с открытым исходным кодом, которые генерируют транскрипцию международного мобильного алфавита (МПА). Наша оценка включает существующую многоязычную речь-корпору и демографически аннотированную англоязычную корпорацию, сравнивая составленные модели транскрипции АПИ с системами графема-фоном (G2P), используя как стандартный коэффициент погрешности по телефону (PER), так и предлагаемый показатель Soft PER, который допускает лингвистические сходства по подмосткам. В нашем анализе рассматривается вопрос о том, насколько различны результаты работы в зависимости от языка, пола, акцента, этнической принадлежности и возраста, что свидетельствует об сохраняющихся различиях даже после…