TAD: Токен-адаптивное противоположное разложение кода с помощью уверенно настроенных галлюцинаций для смягчения галлюцинации в крупных аудиовизуальных моделях
arXiv:2609.0727286v1 Annuate Type: кросс-бюллетень: Большие аудиоязычные модели (LALMs) могут галлюцинировать звуковые объекты, отвечая "да" на отсутствие звуковых событий, что подрывает надежность ответов на вопросы. Мы предлагаем Token-Adapative Decoding (TAD) - стратегию бесплатного обучения для…