Многошаговое обучение удерживает согласованность голоса актёра
Актёр озвучивает персонажа в одном проекте, и его голос становится узнаваемым стилем. Если позже нужна озвучка того же персонажа в другом проекте или дополнительных сцен, нужно пригласить того же актёра. Иногда это невозможно: актер недоступен, забыл точный тон голоса или условия записи изменились.
Синтез может сохранить голос через многошаговое обучение. На основе записей актёра строится личная модель его речи, которая затем применяется к новым текстам. Результат звучит от того же актёра, но произнесён тексты, которые он никогда не читал.
Граница копирования
Качество зависит от количества исходных записей. Чем больше образцов голоса, тем точнее модель улавливает индивидуальность. Но тут возникает закономерность: модель начинает копировать не только голос, но и манеры, типичные для этого актёра при озвучке реальных проектов, что может быть нежелательно.
Кроме того, появляется вопрос прав. Если синтез воспроизводит голос актёра, это может расцениваться как использование его труда без согласия. Поэтому практика требует явного разрешения актёра на создание его синтезированного двойника.
На практике студии применяют эту технику только для второстепенных линий персонажей и доп-озвучки, где важна согласованность, но новые сцены не критичны для основного сюжета.