Синтезированный голос воспроизводит региональные диалекты точнее

ChatGPT-5 расширил набор голосовых моделей за счёт анализа полевых записей региональных диалектов со всей России и стран СНГ. Система способна синтезировать речь с характерными чертами белорусского, украинского, казахского и среднеазиатских русскоязычных акцентов.

Для редких диалектов модель использовала архивные записи этнографических экспедиций, где удалось выделить фонетические и просодические особенности. Это позволило сохранить языковое разнообразие и культурные отличия в синтезированной речи.

Сохранение языкового наследия

Функция работает в двух режимах: пользователь может выбрать конкретный диалект или позволить системе автоматически определить его на основе контекста текста. Это особенно полезно при озвучивании художественной литературы и диалогов персонажей с разными региональными корнями.

Качество воспроизведения диалектных особенностей достигнуто за счёт увеличения размера обучающего набора данных и прецизионного фонетического разбора каждого варианта речи. Ударения, вокализм и консонантизм регионов воспроизводятся с высокой точностью.

Проект получил поддержку образовательных учреждений и этнографических организаций, заинтересованных в документировании и сохранении диалектного наследия для следующих поколений.