Сравнение точности текста на кириллице в пяти популярных генераторах

Исследование охватило пять ведущих генераторов изображений и оценило их производительность на задачах введения русского текста в сцену. Тестирование включало простые слова, фразы, числовые последовательности и сложные конструкции вроде составных слов.

Лидерами по точности оказались модели, специально обученные на многоязычных наборах данных с явным усилением русскоязычного контента. Остальные генераторы продемонстрировали тенденцию к латинизации текста или его частичному пропуску.

Результаты по категориям

При отображении простого текста без украшений точность лучших моделей достигла 87 процентов, в то время как средний результат находился на уровне 62 процентов. Сложность возрастает при добавлении стилизации, теней или перспективных искажений.

Авторы исследования рекомендуют выбирать генератор в зависимости от требований конкретной задачи и считают необходимым усиление обучения моделей на кириллических текстах. Проблема остаётся актуальной для русскоязычных пользователей, работающих с локализацией контента.