Ребека: Разоблачение интерпретируемой иерорхии в поддержку итеративного самоотключения языковых моделей с помощью анализа причин

#Ребека #Разоблачение #Annuales #Type #Хотя

arXiv:2602.06373v2 Annuales Type: заменить резюме: Хотя самоотражение может повысить надежность языковой модели, ее основополагающие механизмы остаются непрозрачными, а существующие анализы часто дают представление о корреляционной основе, которая не позволяет сделать общий вывод. Для решения этой…