Голос ассистента адаптируется к окружающему шуму в реальном времени
Голосовой ассистент теперь анализирует характер фонового шума и автоматически переполняет модель распознавания, чтобы фокусироваться на голосе пользователя. Адаптация происходит в течение двух-трёх секунд разговора, повышая точность распознавания в шумных местах на 25 процентов.
Технология использует фильтрацию спектральных компонент шума и компенсацию Lombard-эффекта, при котором люди инстинктивно говорят громче при посторонних звуках. Ассистент учитывает это изменение и адаптирует ожидаемый уровень голоса.
Использование в мобильных устройствах
Адаптивная система работает полностью локально на телефоне, не требуя отправки данных на сервер. Снижение задержки обработки позволяет ассистенту реагировать на команды в реальном времени даже в условиях очень сложной акустической среды.
Тестирование в кафе, аэропортах и на улице показало, что ассистент теперь корректно распознаёт речь в условиях с уровнем фонового шума до 85 децибел, что ранее было недостижимо. Пользователи больше не должны повышать голос при разговоре с устройством в публичных местах.
Разработчики готовят расширение функции для определения и минимизации эхо от собственного динамика ассистента, что актуально для устройств, используемых на конференциях и в больших помещениях.