Издатели озвучивают аудиокниги синтезом вместо актёров
Растущий спрос на аудиокниги упирается в нехватку голосовых актёров. Найти квалифицированного диктора с нужным тембром для длинного произведения — задача дорогая и долгая, особенно для независимых издателей.
Синтез голоса решает масштабирование: текст загружается, выбирается подходящий голос, и за часы готова озвучка на целый роман. Качество современных синтезаторов выросло настолько, что слушатель замечает искусственность, только прислушиваясь специально.
Где спотыкается качество
Проблема не в четкости слов, а в интерпретации. Актер понимает, где нужна пауза, как произнести диалог в зависимости от контекста, какой эмоцией окрасить фразу. Синтез подчиняется правилам расстановки ударений и интонационных контуров, но не улавливает авторский замысел.
Попытки решить это через разметку текста — указать тон, эмоцию, паузу для каждого фрагмента — разрастаются в проект размером с исходный текст. Поэтому пока синтез занимает нишу оплаты труда актёра, но не мастерства.
На практике издатели используют синтез для быстрого выпуска переизданий и малотиражной литературы, где затраты на актёра несоразмерны прибыли, но предоставить слушателю именно читаемый текст важно.