Ассистент стал слышать разницу между похожими звуками в речи

Обновленная модель распознавания работает на уровне фонем, а не слогов, и может различить такие пары как русские Ж и Ш или английские TH и T. Точность различения близких звуков достигла 98% на чистой речи и 92% в шумной среде.

Это улучшение важно для языков с богатой фонетической системой и для обучения иностранцев правильному произношению. Система теперь дает точную обратную связь при тренировке речи, указывая на конкретные звуки, которые произносятся неправильно.

Применение в образовании

Функция встроена в режим языкового обучения, где ассистент слышит ошибки произношения студента и предлагает корректировку в реальном времени. Эффективность обучения возросла на основании тестов с группами изучающих английский и русский языки.

Фонетический анализ также используется при трансляции кода-переводов для проверки качества работы. Сложные согласные кластеры и сочетания гласных обрабатываются с учетом фонотактических правил языка.

Функция доступна для всех языков в голосовом режиме и постепенно расширяется на дополнительные диалекты.