T-SANDHI: Адаптивная сеть, вещающая тон Сандхи с разукрупненным гибридным инжектором для низкоресурсного тайваньского признания речи Hokkien

#T-SANDHI #Адаптивная #Сандхи #Hokkien #Annualce

arXiv:2609.18194v1 Annualce Type: New Humber Brieflook: In Taйваньский хоккиен, автоматические распознавания речи (ASR), в предыдущих исследованиях тон Сандхи часто рассматривается как серьезная проблема при том предположении, что модели не могут обработать имплицитные фонологические колебания. Однако наши эксперименты на тайваньском Хоккиен показывают, что модели речевого фундамента действительно эффективно справляются с тоном вариаций песчаников и реальные недостатки в работе возникают из-за локальной путаницы между этими колебаниями и сохраненными цитатами. Для решения этой проблемы мы предлагаем T-SANDHI четко отделить поверхностную акустику от лексического умысла на вершине замороженного позвоночника Шёпот. Используя многозадачную структуру обучения на основе lexicon, построенную с помощью текстовых псевдометеорий, наш модуль легковесных гибридных впрысков соединяет независимые реквизиты и телефонные потоки песчаников через динамические глянцевые потоки. Обширная оценка комплекта TAT-MOE и двух слепых наборов тестов показывает, что это явное смещение действительно позволяет

Компьютерная наука > Расчет и язык [представлен 16 сентября 2026 года] Название: T-SANDHI: Tne Sandhi-ware Aдаптационная сеть с разукрупненным гибридным впрыском для низкосырьевого тайваньского выражения мнения Hokkien View PDF HTML (экспериментальное) Резюме: В Тайване автоматическое распознавание речи (ASR), предыдущие исследования часто рассматривают тон Сандхи как серьезную проблему при том предположении, что модели не могут обработать имплицитные фонологические колебания. Однако наши эксперименты на тайваньском Хоккиен показывают, что модели речевого фундамента действительно эффективно справляются с тоном вариаций песчаников и реальные недостатки в работе возникают из-за локальной путаницы между этими колебаниями и сохраненными цитатами. Для решения этой проблемы мы предлагаем T-SANDHI четко отделить поверхностную акустику от лексического умысла на вершине замороженного позвоночника Шёпот. Используя многозадачную структуру обучения на основе lexicon, построенную с помощью текстовых псевдометеорий, наш модуль легковесных гибридных впрысков соединяет независимые реквизиты и телефонные потоки песчаников через динамические глянцевые потоки. Обширная оценка композиции TAT-MOE и двух слепых наборов тестов показывает, что это явное смещение эффективно устраняет путаницу в тональном картировании, превосходя исходное значение при строгом обеспечении эффективности параметров. Загрузка ссылок и цитат... Библиографический и цитационно-инструментальный библиолог (Что является…