Движение камеры научились задавать отдельно от содержания сцены

В интерфейсах видеогенерации закрепилось разделение: что происходит в кадре и как движется камера — это два разных поля ввода. Разработчики вынесли траекторию камеры в отдельный параметр, потому что в общем текстовом описании она регулярно терялась.

Причина сбоя понятна: слово «наезд» в потоке описания сцены модель могла трактовать и как движение камеры, и как приближение самого объекта. Явное разделение убирает неоднозначность.

Ограниченный, но предсказуемый набор

Набор траекторий пока небольшой — панорама, наклон, наезд, отъезд, облёт, следование за объектом. Зато внутри этого набора поведение воспроизводимо, что для монтажа важнее богатства выбора.

Предсказуемость дала неожиданный результат: авторы стали снимать одну сцену несколькими траекториями подряд, получая набор планов вместо единственного кадра. Это ближе к обычной съёмочной практике, чем к перебору случайных вариантов.

Что это значит

Подробности и первичное описание опубликованы на странице разбор генерации по референсу, там же собраны условия доступа и ограничения, о которых заявили разработчики.

Похожие материалы и обновления по теме мы собираем в разделе «Нейросети для текста и перевода» — он пополняется по мере выхода новых сообщений.