Компьютерные науки > Компютерное видение и распознавание шаблонов [представлено 17 сентября 2026 года] Название: A Mеньший трансформатор в вашем Трансформенном виде HTML (экспериментальном) резюме: последние выводы указывают на то, что Vision Transformers пополняются местными сходными стадиями вычисления, а это предполагает уровень глубины вычислительной избыточности. Вместе с тем существующие методы использования этого избыточного потенциала либо не позволяют сократить объем вычислений, либо серьезно ухудшают экспрессивность модели. В этой работе мы формализуем единый подход к избыточности блоков, который отделяет геометрию от конкретных суррогатных мер вмешательства. Затем мы введем Трансформатор-Без трансформатора (ТВТ), постспециальный метод, который смешивает смежные группы из лишних слоев в один обучаемый суррогатный слой. ВВТ сокращает число параметров и вывод вычисляют при сохранении конкурентоспособности с оригинальными моделями, использующими половину глубины на естественных изображениях, а в нескольких гистопатологических параметрах вниз по течению ВВТ соответствует или даже улучшается на первоначальной исходной основе. Загрузка ссылок и цитат... Библиографический и цитационно-инструментальный библиолог (Что является Исследовательом?) Подключённые документы (что такое подсоединенные бумаги?) Litmaps (Литмпапс?) Skite Smart Citations (Каков умный цитаты?) Код, данные и средства массовой информации, связанные с этой статьей альфаXiv (какая буквенная клавиатура?)…
Меньший трансформатор в вашем Трансформере
arXiv:2609.20100v1 Annualce Type: New Brieflook: Последние выводы показывают, что Vision Transformers облекаются в местные схожие вычислительные фазы, подразумевая уровень глубинной вычислительной избыточности. Вместе с тем существующие методы использования этого избыточного потенциала либо не позволяют сократить объем вычислений, либо серьезно ухудшают экспрессивность модели. В этой работе мы формализуем единый подход к избыточности блоков, который отделяет геометрию от конкретных суррогатных мер вмешательства. Затем мы введем Трансформатор-Без трансформатора (ТВТ), постспециальный метод, который смешивает смежные группы из лишних слоев в один обучаемый суррогатный слой. ВВТ сокращает число параметров и вывод вычисляют при сохранении конкурентоспособности с оригинальными моделями, использующими половину глубины на естественных изображениях, а в нескольких гистопатологических параметрах вниз по течению ВВТ соответствует или даже улучшается на первоначальной исходной основе.