Синтезированный голос теперь говорит быстрее для людей с нехваткой времени
Новые алгоритмы синтеза речи научились сжимать паузы между словами, не искажая тембр голоса. Система автоматически адаптирует темп произношения к содержанию текста, замедляя речь на сложных терминах и ускоряя на простых фразах.
Функция особенно полезна для потребления аудиоконтента во время физических нагрузок или в машине. Исследования показывают, что при скорости в полтора раза выше среднего люди сохраняют понимание текста на уровне 94 процентов.
Практическое применение
Уже интегрирована в приложения для чтения новостей, документов и подкастов. Пользователи могут выбирать скорость вручную либо доверить выбор нейросети, которая анализирует жанр и сложность материала.
Ускоренный синтез работает на всех языках, поддерживаемых платформой, включая русский. Качество голоса остаётся на уровне стандартного синтеза без артефактов и искажений.
Разработчики планируют добавить синхронизацию с видео, чтобы ускоренный голос совпадал с движениями губ говорящего человека.