Озвучка ответа или текст: пользователь выбирает на ходу
Раньше выбор делался один раз при загрузке: либо голосовой режим, либо чат. Переключение требовало перезагрузки сессии или запуска другого приложения.
Сейчас один и тот же диалог может вестись в разных модусах. Пользователь начинает говорить, ассистент отвечает голосом, а потом он может попросить показать ответ текстом и скопировать кусок.
Когда это полезно
Сценарий типичен для длинных ответов: услышал суть голосом, но нужны детали, и проще прочитать их. Или наоборот: текстовый ответ длинный, а нужно быстро понять его на слух, пока за рулём.
Такое переключение требует, чтобы ассистент вёл единый контекст разговора, а не два параллельных диалога. Это усложняет архитектуру, но для пользователя становится незаметным удобством.
Интерфейс постепенно становится более гибким, и вместо жёстких режимов появляется один инструмент, который подстраивается под то, как сейчас удобнее.