MATE4D: Матрично-руководимое 4D поколения из единого изображения
arXiv:2610.11181v1 Annualce Type: New Habrial: Generationive Models быстро подтолкнули процесс создания контента к динамическому синтезу 3D и 4D. Однако создание реалистичного и временно стабильного 4D-контента с помощью одного изображения попрежнему трудно, поскольку один взгляд дает ограниченные структурные сигналы и слабые доказательства движения. Мы введем систему MATE4D, которая преобразует одно входное изображение в отредактируемое динамическое 4D содержание. Наш метод создает фрапио-временную матрицу многовидового изображения с текстовой модификацией фона, обеспечивая последовательный контроль за точкой зрения, видимость и движение. Эти синтезированные наблюдения используются для оптимизации примитивов 3D, которые затем анимируются с помощью модуля легкой деформации и образуют 4D-образное представление. Полученные сцены сохраняют геометрию более точно, поддерживают более плавное временное поведение и обеспечивают большую согласованность фоновых редактирования, уменьшая неопределенность контекста и движения артефактов. Эксперименты на Обратно-XL и