Google Gemini научился редактировать картины пошаговыми инструкциями

Google добавила в Gemini функцию интерактивного редактирования изображений на основе текстовых команд. Пользователь может указать серию изменений — например, изменить фон, переместить объект, добавить новый элемент — и система применяет каждое изменение последовательно.

Система использует маскирование и условное поколение для сохранения целостности изображения при локальных правках. Это позволяет пользователям уточнять детали без полной регенерации картины, ускоряя итеративный процесс творчества.

Удобство в дизайне и создании контента

Пошаговое редактирование удобнее чем перезапуск, так как позволяет сохранять успешные части изображения. Функция подходит для дизайнеров, иллюстраторов и создателей контента, которые работают с несколькими вариантами композиции.

Gemini обрабатывает инструкции естественного языка, преобразуя их в специфичные для региона маски и параметры редактирования. Система адаптируется к стилю пользователя по мере накопления истории правок.

Обновление расширяет возможности Gemini как инструмента для итеративного дизайна, конкурируя с узкоспециализированными редакторами на основе ИИ.