Голос ассистента адаптируется к окружающему шуму в реальном времени

Голосовой ассистент теперь анализирует характер фонового шума и автоматически переполняет модель распознавания, чтобы фокусироваться на голосе пользователя. Адаптация происходит в течение двух-трёх секунд разговора, повышая точность распознавания в шумных местах на 25 процентов.

Технология использует фильтрацию спектральных компонент шума и компенсацию Lombard-эффекта, при котором люди инстинктивно говорят громче при посторонних звуках. Ассистент учитывает это изменение и адаптирует ожидаемый уровень голоса.

Использование в мобильных устройствах

Адаптивная система работает полностью локально на телефоне, не требуя отправки данных на сервер. Снижение задержки обработки позволяет ассистенту реагировать на команды в реальном времени даже в условиях очень сложной акустической среды.

Тестирование в кафе, аэропортах и на улице показало, что ассистент теперь корректно распознаёт речь в условиях с уровнем фонового шума до 85 децибел, что ранее было недостижимо. Пользователи больше не должны повышать голос при разговоре с устройством в публичных местах.

Разработчики готовят расширение функции для определения и минимизации эхо от собственного динамика ассистента, что актуально для устройств, используемых на конференциях и в больших помещениях.