Компьютерная наука > Расчет и язык [представлен 23 мая 2026 года] Название: Few-Shot Disarmament — это не то, что он кажется: Поведенческое доказательство, анализ представленности и Random-Text Control в 12 моделях, 2 задачах и 2 Architecture View PDF HTML (экспериментальное) резюме: Feu-shot вызывает иногда деградацию языковых моделей вместо того, чтобы помочь им, но почему такое случается неизвестно. Мы оцениваем 12 моделей с открытым весом на двух украинских задачах - классификация новостей и прогнозирование исхода юридических дел, и обнаруживаем, что эффект в значительной степени зависит от задач: те же модели, которые получают +24 pp в новостях показывают только +3,4 pp по правовому тексту с двумя моделями унижающим достоинство. Чтобы понять почему, мы заглянем внутрь моделей. Предварительная работа измеряет, сколько скрытых состояний сдвигается между нулевым и малоразрядным режимами, но немногозвуковые импульсы гораздо дольше, а разница в длительности сама по себе двигает представления. Мы предлагаем простое решение: заменить демонстрацию на сравниваемый по длине случайный текст для измерения смещения, вызванного быстрой длиной, а затем вычитать его. В результате метрическое содержание дельты изолирует то, насколько изменяют представления модели в силу того, что говорят демонстрации, а не как долго они находятся. Это полностью меняет картину: сырая смена не предсказывает, поможет ли или повредит малокачественное число (r = 0,20), но содержание дельты - это (roh = +…
Незначительное ухудшение состояния — это не то, что кажется: поведенческое доказательство, анализ представительства и случайный контроль в рамках 12 моделей, 2 задач и 2 архитектуры
arXiv: 2609.15990v1 Annuales Type: кросс-бюллетень: Незначительное число выстрелов иногда приводит к деградации языковых моделей вместо того, чтобы помогать им, но почему это происходит неизвестно. Мы оцениваем 12 моделей с открытым весом на двух украинских задачах - классификация новостей и прогнозирование исхода юридических дел, и обнаруживаем, что эффект в значительной степени зависит от задач: те же модели, которые получают +24 pp в новостях показывают только +3,4 pp по правовому тексту с двумя моделями унижающим достоинство. Чтобы понять почему, мы заглянем внутрь моделей. Предварительная работа измеряет, сколько скрытых состояний сдвигается между нулевым и малоразрядным режимами, но немногозвуковые импульсы гораздо дольше, а разница в длительности сама по себе двигает представления. Мы предлагаем простое решение: заменить демонстрацию на сравниваемый по длине случайный текст для измерения смещения, вызванного быстрой длиной, а затем вычитать его. В результате метрическое содержание дельты изолирует то, насколько изменяют представления модели в силу того, что говорят демонстрации, а не как долго они находятся. Это полностью меняет картину: сырая смена происходит n