Вертикальный формат заставил переучивать сценарную логику роликов

Основной потребитель короткого сгенерированного видео — вертикальные ленты, и это меняет требования к самой генерации. Кадр, задуманный горизонтальным, при обрезке теряет половину композиции, а вместе с ней и смысл.

Поэтому вертикальную рамку задают с самого начала, включая в описание сцены расположение объекта по вертикали. Модели реагируют на это лучше, чем на попытку кадрировать готовый результат.

Композиция без горизонтали

Вертикальный кадр плохо принимает панораму вбок и почти не оставляет места для второго плана рядом с героем. Взамен работают наезд, движение вверх-вниз и построение сцены слоями по глубине.

Дополнительно приходится учитывать интерфейс: верх и низ кадра перекрыты подписями и кнопками. Значимое действие держат в средней трети, а края отдают под фон, который не жалко потерять.

Что это значит

Подробности и первичное описание опубликованы на странице «разбор влияния длины запроса на результат», там же собраны условия доступа и ограничения, о которых заявили разработчики.

Похожие материалы и обновления по теме мы собираем в разделе Генерация видео нейросетями — он пополняется по мере выхода новых сообщений.