Вертикальный формат заставил переучивать сценарную логику роликов
Основной потребитель короткого сгенерированного видео — вертикальные ленты, и это меняет требования к самой генерации. Кадр, задуманный горизонтальным, при обрезке теряет половину композиции, а вместе с ней и смысл.
Поэтому вертикальную рамку задают с самого начала, включая в описание сцены расположение объекта по вертикали. Модели реагируют на это лучше, чем на попытку кадрировать готовый результат.
Композиция без горизонтали
Вертикальный кадр плохо принимает панораму вбок и почти не оставляет места для второго плана рядом с героем. Взамен работают наезд, движение вверх-вниз и построение сцены слоями по глубине.
Дополнительно приходится учитывать интерфейс: верх и низ кадра перекрыты подписями и кнопками. Значимое действие держат в средней трети, а края отдают под фон, который не жалко потерять.
Что это значит
Подробности и первичное описание опубликованы на странице «разбор влияния длины запроса на результат», там же собраны условия доступа и ограничения, о которых заявили разработчики.
Похожие материалы и обновления по теме мы собираем в разделе Генерация видео нейросетями — он пополняется по мере выхода новых сообщений.