Компьютерная наука > Расчет и язык [представлен 8 октября 2026 года] Название: Фонологически осознанная токенизация для признания немецкой речи: кросс-сферное исследование HTML PDF (экспериментальное) резюме: немецкий язык является морфологическим языком, слогическая структура которого исключительно хорошо предопределена алгоритмом гифетации кнута - Ляна. Мы задаемся вопросом, может ли фонологически обоснованное символизация служить конкурентоспособной целью для распознавания речи от конца до конца. Мы сравниваем три семейства символизаторов на омниязычной линии ASR вав2vec 2.0, адаптированной к ЦТИК: заранее подготовленный многоязычный список знаков, кодирование байт-пари (BYte-Pair) по сравнению с орфографией и фонологически информированные единицы из Pyphen Sillabification и преобразования графема в телефон. Из 40 тонких снимков мы оцениваем три германских тестовых набора, охватывающих ортогональные смены: бездомная читающая речь, диалектическая спонтанная речь и стандартно-немецкая спонтационная речь. Внутреннее руководство, все фонологически обоснованные символы соответствуют BPE и многоязычному исходному значению как WER, так и ССВ. В рамках домена картинка делится по размерам словаря, а не на языковую ось вариации: при небольших словарей слогабельная символизация улучшается на диалектальной речи, где телефонные формы поверхности различаются, но слоговая структура сохраняется и остается впереди спонтанной речи, когда новые слова нарушают закрытие словарного текста.…
Фонологически осознанная токенизация для признания немецкой речи: перекрестное исследование
arXiv: 2610.11646v1 Annuate Type: New Humber Abstract: немецкий язык является морфологически богатым языком, слогационная структура которого исключительно хорошо предопределена алгоритмом гифетации Knut-Liang. Мы задаемся вопросом, может ли фонологически обоснованное символизация служить конкурентоспособной целью для распознавания речи от конца до конца. Мы сравниваем три семейства символизаторов на омниязычной линии ASR вав2vec 2.0, адаптированной к ЦТИК: заранее подготовленный многоязычный список знаков, кодирование байт-пари (BYte-Pair) по сравнению с орфографией и фонологически информированные единицы из Pyphen Sillabification и преобразования графема в телефон. Из 40 тонких снимков мы оцениваем три германских тестовых набора, охватывающих ортогональные смены: бездомная читающая речь, диалектическая спонтанная речь и стандартно-немецкая спонтационная речь. Внутреннее руководство, все фонологически обоснованные символы соответствуют BPE и многоязычному исходному значению как WER, так и ССВ. В домене сдвинуть картинку вдоль размера словаря, а не лингвия