OpenAI запатентовала метод клонирования голоса с одной фразы

OpenAI зарегистрировала патент на метод синтеза речи, который воспроизводит голос говорящего на основе минимального образца — одной фразы продолжительностью несколько секунд. Технология использует нейросетевые модели для извлечения характеристик голоса и применения их к новому тексту.

Традиционные системы клонирования голоса требуют часов записей для достижения качественного результата. Новый подход существенно снижает порог входа для создания персонализированных голосовых помощников и озвучки контента.

Применение в индустрии

Патент охватывает применение технологии в чат-ботах, виртуальных ассистентах и системах текст-в-речь. OpenAI указывает, что метод сохраняет эмоциональный окрас и особенности речи исходного образца.

Разработка поднимает вопросы об использовании такой техники для создания поддельных аудиозаписей. Компания заявляет о внедрении защитных механизмов против несанкционированного клонирования.

Практическое внедрение технологии ожидается в течение года в составе платформы ChatGPT-5 и партнёрских решениях.