Синтезированный голос воспроизводит региональные диалекты точнее
ChatGPT-5 расширил набор голосовых моделей за счёт анализа полевых записей региональных диалектов со всей России и стран СНГ. Система способна синтезировать речь с характерными чертами белорусского, украинского, казахского и среднеазиатских русскоязычных акцентов.
Для редких диалектов модель использовала архивные записи этнографических экспедиций, где удалось выделить фонетические и просодические особенности. Это позволило сохранить языковое разнообразие и культурные отличия в синтезированной речи.
Сохранение языкового наследия
Функция работает в двух режимах: пользователь может выбрать конкретный диалект или позволить системе автоматически определить его на основе контекста текста. Это особенно полезно при озвучивании художественной литературы и диалогов персонажей с разными региональными корнями.
Качество воспроизведения диалектных особенностей достигнуто за счёт увеличения размера обучающего набора данных и прецизионного фонетического разбора каждого варианта речи. Ударения, вокализм и консонантизм регионов воспроизводятся с высокой точностью.
Проект получил поддержку образовательных учреждений и этнографических организаций, заинтересованных в документировании и сохранении диалектного наследия для следующих поколений.