Результаты фильтрации

406 статей
arXiv Computer Vision
arXiv Computer Vision

АМАЛИЯ-ВЛ: Модель перспектив и языков коренных европейских португалоязычных стран с открытым исходным источником

arXiv:2606.19100v4 Видеотип: заменить резюме: крупные модели зрения и языка (LLMVS) быстро развиваются, однако европейские португальские (pt-PT) попрежнему систематически не пользуются существующими м...

arXiv Computer Vision
1
Читать
arXiv Computer Vision
arXiv Computer Vision

Подготовка отчетов или повторных шаблонов? Измерение и смягчение шаблона в 3D CT Generation

arXiv:2605,30984v2 Annualce Type: заменить резюме: современные 3D-образные модели на медицинских языках зрения (VLM) могут генерировать свободно стильный текст радиологии, демонстрируя при этом критич...

arXiv Computer Vision
1
Читать
arXiv Computer Vision
arXiv Computer Vision

На пути к моделям фонда для 3D понимания: самообучение с учетом конкретных случаев для точечных облаков

arXiv:2603.25165v3 Вид уведомления: заменить резюме: последние достижения в самоконтроле за обучением (SSL) для точечных облаков существенно улучшили понимание 3D сцен без человеческих аннотаций. В ра...

arXiv Computer Vision
1
Читать
arXiv Computer Vision
arXiv Computer Vision

Проект ИЦООНОРН: единый контрольный показатель для воображения в вычислительной патологии, радиологии и естественном языке

arXiv: 2603.02790v2 Annuales Type: заменить резюме: модели фонда меняют способ развития медицинского искусственного интеллекта. Благодаря широкому ознакомлению с общими особенностями различных форм да...

arXiv Computer Vision
1
Читать
arXiv Computer Vision
arXiv Computer Vision

Стерео4DWalker: Обучение 4D-сознательному здоровому городскому судоходству с помощью Интернет-видеосъемки

arXiv:2512199656v2 Annualce Type: заменить резюме: Несмотря на быстрый прогресс, транспортировка в динамичной и неструктурированной городской среде остается хрупкой. Большинство существующих подходов ...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Понимание воздействия дистрибьюторов на разработку моделей перспективного видения и языка

arXiv: 2511.21397v3 Тип уведомления: заменить резюме: Как неотносительная информация (т.е. отвлекающие устройства) влияет на масштабирование времени испытаний в моделях языка зрения (VLM)? Предыдущая ...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

MedSAM3: Распределение в сегменте все, что связано с медицинскими концепциями

arXiv: 2511.19046v2 Аннонс Тип: заменить резюме: Сегментация медицинских изображений имеет фундаментальное значение для биомедицинского открытия. Существующие методы не являются общеизменяемыми и треб...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

SAR-FAH: гибридная сеть частотных и адаптивных измерений, опирающаяся на нейронные УОУ для целей консервации ПС

arXiv: 2511.05890v2 Annuales Type: заменить резюме: изображения синтетического апертурного радиолокатора (SAR) по своей сути деградируют в результате шума, производимого спекулирующими устройствами, ч...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

CapGeo-Bench: Отмежевание визуального восприятия от разума и оценки геометрического понимания

arXiv: 2510,09302v2 Annuate Type: заменить резюме: в то время как мультимодальные модели большого языка (MLMs) добились замечательных успехов при выполнении сложных чисто текстовых математических зада...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

TOPO-Bench: Открытая система топологической оценки картирования с поддающейся количественной оценке перцепцией

arXiv: 2510,04100v3 Annualce Type: заменить резюме: топологическое картирование обеспечивает компактное и надежное представление для навигации, однако прогресс в этой области сдерживается отсутствием ...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Мероприятие VL: понимать события с помощью мультимодальной модели Большого языка

arXiv: 2501.13707v3 Видение типа: заменить резюме: модель зрения-лангаж (VLM) на основе событий недавно добилась значительного прогресса в решении практических задач. Однако большинство этих работ про...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Адаптация к ПУЗМ для медицинского VQA с учетом возможных вариантов

arXiv:2609.15530v1 Annuairet Type: recver Brief: Мы описываем наше представление вызову MedReason 2026, которое охватывает множественный выбор (MCQ) и открытый медицинский визуальный ответ на вопрос (...

arXiv Computer Vision
1
Читать
arXiv Computer Vision
arXiv Computer Vision

ЭСУ: создание физически последовательных динамических 3D-образных сцен из текстовых описаний

arXiv: 2609.15392v1 Annualce Type: кросс-бюллетень: Последние достижения в создании изображения и 3D сцены позволили создать все более реалистичные статические среды, однако большинство методов попреж...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

СОНАР: Нейронный оператор конструкционной структуры для реконструкции спаржевого вида с помощью Null-Space-Aware

arXiv:2609.13688v1 Аннот: перекрестное резюме: Sparse-view рассчитанная томография (CT) сокращает дозу радиации и время приобретения, но остается крайне ненадежным изза того, что неполными прогнозами ...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Уникальный отправитель: Смягчение утечки данных в эталонных наборах данных классификации акустических судов

arXiv: 2609.13659v1 Annuales Type: Cross Brieft: URTR (подводный акустический знак) судов хорошо подходит для машинного обучения, однако его прогресс сдерживается отсутствием больших, разнообразных и ...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

От видения к урожаю: определение базовых моделей перспективного и лингвистического анализа для многоармейского роботоводства

arXiv: 2609.13606v1 Annuales Type: Cross Brieft: Multi-Robonic Working предлагает многообещающий путь к повышению эффективности сбора урожая и уменьшению зависимости от ручного труда. Однако практичес...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

Линн Реаль-Омни: местное многовидовое видео поколения для агентских визуальных рабочих потоков

arXiv: 2609.15863v1 Annualce Type: New Humber: Video Displacement Models stochastic and cложно контролировать: точное содержание часто требует повторного отбора образцов без гарантированного успеха, а...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

VideoScout: Учёба агентского активного исследования с адаптивным расчетом на долгое видеопонимание

arXiv:2609.15606v1 Annuate Type: New Habstractive: Multildom Bigh Language Models (MLMs) добились замечательных успехов в плане краткого видеопонимания, но по-прежнему ограничены длинными видеозаписям...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

ViCO-SAM3: Согласование в целях определения видения и обеспечения устойчивости для сегментации объектов

arXiv:2609.15418v1 Аннонс Тип: новое резюме: Сегментация объектов с открытым вокзалом (ОВКОС) направлена на сегментирование невидимых замаскированных предметов под руководством текста. Мы наблюдаем, ч...

arXiv Computer Vision
Читать
arXiv Computer Vision
arXiv Computer Vision

AlignUS: Ультразвуковое обучение УЗИ для классификации БАС на основе изображений языка

arXiv:2609.15285v1 Annualce Type: New Humbrie: Amiotrophic боковой склероз (ALS) - это прогрессивное нейродегенеративное заболевание, в котором ранняя оценка остается сложной, особенно в условиях низк...

arXiv Computer Vision
Читать