Сравнение точности текста на кириллице в пяти популярных генераторах
Исследование охватило пять ведущих генераторов изображений и оценило их производительность на задачах введения русского текста в сцену. Тестирование включало простые слова, фразы, числовые последовательности и сложные конструкции вроде составных слов.
Лидерами по точности оказались модели, специально обученные на многоязычных наборах данных с явным усилением русскоязычного контента. Остальные генераторы продемонстрировали тенденцию к латинизации текста или его частичному пропуску.
Результаты по категориям
При отображении простого текста без украшений точность лучших моделей достигла 87 процентов, в то время как средний результат находился на уровне 62 процентов. Сложность возрастает при добавлении стилизации, теней или перспективных искажений.
Авторы исследования рекомендуют выбирать генератор в зависимости от требований конкретной задачи и считают необходимым усиление обучения моделей на кириллических текстах. Проблема остаётся актуальной для русскоязычных пользователей, работающих с локализацией контента.