Предел длительности обходят склейками, а не более длинной генерацией
Ограничение длительности видеогенерации перестали воспринимать как временное неудобство, которое исчезнет с новой версией модели. Вместо этого в сообществе оформился монтажный обход: длинную сцену собирают из нескольких коротких фрагментов, где последний кадр предыдущего становится входным изображением для следующего.
Приём работает потому, что видеомодели куда лучше продолжают конкретный кадр, чем удерживают абстрактное описание на протяжении долгого отрезка. Передача кадра по цепочке заменяет модели память о том, как выглядела сцена секунду назад.
Где цепочка обрывается
Слабое место метода — накопление ошибки. С каждым звеном цвет чуть уходит, детали упрощаются, и к четвёртому-пятому фрагменту персонаж заметно отличается от исходного, поэтому длинные цепочки перебивают возвратом к оригинальному изображению.
Отдельная хитрость касается точек склейки: их ставят на быстром движении или на смене плана, где глаз всё равно не успевает сверить детали. Резкий монтаж здесь оказывается не приёмом стиля, а способом спрятать техническое ограничение.
Что это значит
Подробности и первичное описание опубликованы на странице разбор рисованных стилей генерации, там же собраны условия доступа и ограничения, о которых заявили разработчики.
Похожие материалы и обновления по теме мы собираем в разделе Нейросети для текста и перевода — он пополняется по мере выхода новых сообщений.