Результаты фильтрации

517 статей
arXiv Computer Vision
arXiv Computer Vision

Один и тот же ответ, различные представления: скрытая нестабильность в НДЖ

arXiv: 2602.06522 Annuales Type: заменить кросс-бюллетень: надежность моделей языка зрения (VLM) обычно оценивается с помощью переменной уровня выпуска, косвенно исходя из предположения о том, что ста...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

CFGPNet: Система многоспектрального обнаружения объектов с помощью программы " зеленый поток &qt; на основе перекрестного наблюдения

arXiv: 2608.06205v2 Тип уведомления: заменить резюме: многоспектральное обнаружение объектов сочетает видимые и тепловые изображения в целях улучшения восприятия при сложной освещенности и экологическ...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Чрезвычайно жесткие цели обучения стимулируют появление у людей неприсоединившихся представлений в моделях зрения МА

arXiv: 2605.05556v2 Annuales Type: заменить резюме: Искусственные нейронные сети, обученные визуальному обслуживанию, разрабатывают внутренние представления, аналогичные тем, которые были созданы в си...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Прок-Функ: Предполагаемое резюме процедурного 3D поколения в Питоне

arXiv:2604.26943v2 Annuse Type: заменить резюме: Мы представляем ProcFunc, библиотеку для процедурного 3D поколения Blender в Python. ProcFunc предоставляет библиотеку легкодоступных функций Python, к...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

RefGlitch-Bench: Контрольный параметр для геймплей-обнаружения с моделями зрения и языка

arXiv: 2604.11082v2 Annulates Type: заменить резюме: Визуальные сбои в видео играх ухудшают опыт игроков и их воспринимаемое качество, однако обеспечение качества вручную не может идти по темпам роста...

arXiv Computer Vision
1
Читать
arXiv Computer Vision
arXiv Computer Vision

ГРАДЕ: Контроль за дисциплиной с указанием причин при редактировании изображений

arXiv: 2603.12264v2 Annuales Type: заменить резюме: Единые мультимодальные модели нацелены на совместное понимание, обоснование и генерацию, однако нынешние контрольные показатели редактирования изобр...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

БЦПИЛ: Двунаправленная и последовательная обработка языковых изображений для сегментации жесткой медицинской фотографии

arXiv:2603.00156v2 Annuales Type: заменить резюме: Сегментация медицинских изображений является основой планирования диагностики и лечения с помощью компьютеров. Хотя последние модели мультимодального...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Изучение вопроса о временной последовательности в отношении слабой и последующей адаптации к условиям временнóго действия

arXiv: 2602.05718v2 Annualce Type: заменить резюме: Временная локализация действий (PTAL) с помощью точечных опорных элементов использует легкоатомную парадигму (\текстит {т.е.}, обозначающую только о...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Расширение представительства изображений с низким разрешением посредством нормализации потоков

arXiv: 2601.06834v2 Тип уведомления: заменить резюме: представление изображений с низким разрешением может рассматриваться как особая форма незначительного представления, которая сохраняет лишь низкоч...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Модели фонда " Мультивидуум &qt;

arXiv: 2512.15708v2 Annualce Type: заменить резюме: модели фонда являются жизненно важными инструментами в различных компьютерных программах. Они используют в качестве ввода одно изображение RGB и выв...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Разблокировать нулевой потенциал полуценного изображения, совпадающего через гауссианскую плазму

arXiv:2511.21265v2 Annuales Type: заменить резюме: сопоставление изображений на основе обучения в решающей степени зависит от крупномасштабных, разнообразных и геометрических данных об обучении. 3D Go...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Exo2Egosyn: Разблокированные модели Video Generation Foundation для экзоцентрического и эгоцентричного видеокомпьютера

arXiv:2511.20186v2 Annualce Type: заменить резюме: модели генерации видео из фонда, такие как WAN 2.2, имеют сильные возможности для синтеза при условии наличия текстов и изображений, но по-прежнему о...

arXiv Computer Vision
1
Читать
arXiv Computer Vision
arXiv Computer Vision

T2T-VICL: Межцелевое визуальное обучение in-context через имплицитные текстовые видеозаписи

arXiv:2511.161007v5 Тип уведомления: заменить резюме: Визуальное обучение in-context (VICL) решает визуальные задачи, выстраивая несколько входных и выходных демонстраций без какой бы то ни было модел...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Крыша: сеть трансформатора, на которой покрываются кромки и которая предназначена для сегментации конечной части крыши

arXiv:2508.19003v2 Annuales Type: заменить резюме: Сегментация плоскости крыши является одной из ключевых процедур восстановления трехмерных (3D) строительных моделей на уровнях детализации (LoD) 2 и ...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

EvMLP: Эффективная архитектура видения MLP

arXiv: 25007.01927v3 Annualce Type: заменить резюме: в то время как CNN и Vits доминируют в архитектурах зрения, все-MLP модели предлагают более простую в структурном отношении альтернативу, чей пятни...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

От пикселей к изображениям: структурное обследование глубоко усвоенных парадигмов в области семантического сегмента изображений дистанционного зондирования

arXiv:2505.15147v3 Тип уведомления: заменить резюме: снимки дистанционного зондирования (ДДЗ) отражают как естественные, так и антропогенные изменения на поверхности Земли. Семантическая сегментация (...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

HuMemSLAM: эффективное семантическое распознавание мест в искусственной системе наблюдения

arXiv:2609.17168v1 Вид уведомления: перекрестное резюме: Автономные системы требуют надежного распознавания мест для эффективной и действенной одновременной локализации и картирования (SLAM). Традицио...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Дифференцируемая оценка состояния Меха с помощью графического фактора для деформируемой реконструкции объекта

arXiv: 2609.16686v1 Annuales Type: кросс-бюллетень: Оценка деформируемых объектов в государствах остается фундаментальной задачей в робототехнике и имитации. Мы предлагаем новую основу на основе графа...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Волосы: восстановление волос на основе краски из карт волос

arXiv: 2609.16465v1 Annuates Type: Cross Brieft: Мы представляем автоматизированный трубопровод, который преобразует модели для парикмахерских в высококачественные причёски на основе нитей. С учетом н...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Геометрия по отношению к структуре: графическая диагностика для моделирования в точке LIDAR

arXiv: 2609.16378v1 Тип уведомления: перекрестное резюме: цифровые близнецы обеспечивают масштабное и экономически эффективное дополнение к реальному испытанию для проверки систем автономного вождения...

arXiv Computer Vision
Читать