Ассистент стал слышать разницу между похожими звуками в речи
Обновленная модель распознавания работает на уровне фонем, а не слогов, и может различить такие пары как русские Ж и Ш или английские TH и T. Точность различения близких звуков достигла 98% на чистой речи и 92% в шумной среде.
Это улучшение важно для языков с богатой фонетической системой и для обучения иностранцев правильному произношению. Система теперь дает точную обратную связь при тренировке речи, указывая на конкретные звуки, которые произносятся неправильно.
Применение в образовании
Функция встроена в режим языкового обучения, где ассистент слышит ошибки произношения студента и предлагает корректировку в реальном времени. Эффективность обучения возросла на основании тестов с группами изучающих английский и русский языки.
Фонетический анализ также используется при трансляции кода-переводов для проверки качества работы. Сложные согласные кластеры и сочетания гласных обрабатываются с учетом фонотактических правил языка.
Функция доступна для всех языков в голосовом режиме и постепенно расширяется на дополнительные диалекты.