FailSAE: На пути к интерпретируемому прогнозу неисправности для моделей визуализации-лингвиса с помощью Sparse Autoencoders
arXiv: 26009,04276v1 Annualce Type: New Humber: Vision-Language Models (VLM), например CLIP, добились высоких результатов в различных мультимодальных задачах за счет согласования визуальных и текстовых представлений в общем пространстве. По мере того, как ОЖО все чаще используются в областях с…