Google Gemini научился редактировать картины пошаговыми инструкциями
Google добавила в Gemini функцию интерактивного редактирования изображений на основе текстовых команд. Пользователь может указать серию изменений — например, изменить фон, переместить объект, добавить новый элемент — и система применяет каждое изменение последовательно.
Система использует маскирование и условное поколение для сохранения целостности изображения при локальных правках. Это позволяет пользователям уточнять детали без полной регенерации картины, ускоряя итеративный процесс творчества.
Удобство в дизайне и создании контента
Пошаговое редактирование удобнее чем перезапуск, так как позволяет сохранять успешные части изображения. Функция подходит для дизайнеров, иллюстраторов и создателей контента, которые работают с несколькими вариантами композиции.
Gemini обрабатывает инструкции естественного языка, преобразуя их в специфичные для региона маски и параметры редактирования. Система адаптируется к стилю пользователя по мере накопления истории правок.
Обновление расширяет возможности Gemini как инструмента для итеративного дизайна, конкурируя с узкоспециализированными редакторами на основе ИИ.