arXiv NLP
О интерпретируемости кодировок Шепота с использованием Sparse Autoencoders
arXiv:2605.12225v3 Annualce Type: заменить резюме: Хотя модели на основе глубоких трансформаторов быстро развиваются, их внутренние механизмы остаются в основном загадкой. В последнее время приоритетн...
arXiv NLP