Борьба с водяными знаками: как нейросети учат распознавать заливку фона

Проблема: генераторы обучались на датасетах, где были скриншоты с чужого контента, включая водяные знаки. Когда сеть видит в запросе описание похожей сцены, она может воспроизвести композицию с фоновой заливкой или логотипом. Авторы исходных работ остаются без защиты.

Новый подход учит модели распознавать водяные знаки как элементы дизайна, которые нельзя копировать. Сеть анализирует повторяющиеся паттерны, прозрачные наложения и текстовые сигнатуры на изображениях из обучающего набора и помечает их как защищённые.

Техника и применение

Алгоритм работает на этапе подготовки датасета и на этапе генерации. Сначала обучающие данные очищаются от явных маркеров, потом модель учится избегать паттернов, которые она видела в защищённом контенте.

Эта работа критична для соглашения между разработчиками нейросетей и авторами контента. Без такой защиты художники и фотографы неохотно лицензируют свои работы для обучения моделей, что замедляет развитие генераторов.

Пока это область активных исследований, а не встроенная функция коммерческих генераторов. Но интерес к ней растет вместе с давлением от правообладателей и регуляторов.