Масштаб объектов меняется правильно при приближении и удалении камеры
Модели видеогенерации начали корректно обрабатывать изменение масштаба объектов в зависимости от расстояния камеры. Ранее нейросети нарушали пропорции предметов при приближении или удалении, что создавало визуальный диссонанс и ломало восприятие трёхмерного пространства.
Улучшение касается как простых геометрических форм, так и сложных органических объектов. Система теперь учитывает перспективные искажения и правильно вычисляет угловой размер предметов относительно виртуальной камеры.
Применение в производстве контента
Это позволяет создавать видеоматериалы с плавными приближениями и удалениями без характерных артефактов, которые ломали иллюзию реальности. Режиссёры и видеографы получают инструмент для более сложных камерных движений.
Консистентность масштабирования критична для длинных кадров и динамичных сцен. Решение проблемы открывает возможности для создания полнометражного контента нейросетями.
Технический прогресс указывает на улучшение внутренних моделей пространственного понимания в генеративных сетях.