Синтезированный голос теперь говорит быстрее для людей с нехваткой времени

Новые алгоритмы синтеза речи научились сжимать паузы между словами, не искажая тембр голоса. Система автоматически адаптирует темп произношения к содержанию текста, замедляя речь на сложных терминах и ускоряя на простых фразах.

Функция особенно полезна для потребления аудиоконтента во время физических нагрузок или в машине. Исследования показывают, что при скорости в полтора раза выше среднего люди сохраняют понимание текста на уровне 94 процентов.

Практическое применение

Уже интегрирована в приложения для чтения новостей, документов и подкастов. Пользователи могут выбирать скорость вручную либо доверить выбор нейросети, которая анализирует жанр и сложность материала.

Ускоренный синтез работает на всех языках, поддерживаемых платформой, включая русский. Качество голоса остаётся на уровне стандартного синтеза без артефактов и искажений.

Разработчики планируют добавить синхронизацию с видео, чтобы ускоренный голос совпадал с движениями губ говорящего человека.