Озвучка подкастов выходит в трёх вариантах интонации одновременно

Сервисы автоматической озвучки теперь генерируют три вариант одного и того же текста подкаста одновременно: нейтральный, заинтересованный и драматичный. Слушатель может выбрать тональность прямо в приложении, не дожидаясь отдельной обработки.

Архитектура ускорения позволяет обрабатывать все три потока в рамках одного прогона через нейросеть с разными параметрами интонации. На выходе создаются три аудиофайла из одной очереди обработки, что экономит вычислительные ресурсы.

Применение в подкастинге

Издатели подкастов используют эту функцию для расширения аудитории: кто-то предпочитает слушать новости спокойно, другие ценят интенсивную подачу материала. Три варианта озвучки позволяют охватить разные предпочтения.

Загрузка на платформу теперь требует выбора базового тона озвучки, но слушатель может переключаться между вариантами в реальном времени без перезагрузки. Аналитика показывает, что драматичная озвучка набирает больше прослушиваний на первых минутах, а нейтральная — лучше удерживает аудиторию на длинных эпизодах.

Функция постепенно расширяется на другие языки и содействует локализации подкастов без привлечения дополнительных дикторов.