Голосовой ввод в мобильных ИИ-приложениях вытесняет клавиатуру

Набирать длинный запрос на экранной клавиатуре неудобно, и это ограничивало мобильные ИИ-приложения с самого начала: люди писали коротко, получали поверхностные ответы и делали вывод, что модель слабая.

Голосовой ввод снял ограничение. Продиктовать три предложения быстрее, чем набрать одно, а современные модели распознавания уверенно работают даже в шумной обстановке и без интернета.

Диктовка меняет форму запроса

Интересно, что меняется не только скорость, но и содержание. Наговорённый запрос длиннее, содержит больше контекста и звучит как разговор, а не как поисковая строка — и ответы получаются точнее.

Приложения подстраиваются: убирают жёсткие поля ввода, добавляют режим непрерывной диктовки, учатся корректно обрабатывать оговорки и самоисправления вроде «нет, лучше по-другому».

Ограничение у голоса одно и очевидное — публичные места. Поэтому переключение между голосом и текстом должно быть мгновенным, без ухода в настройки.

Что это значит

Подробности и первичное описание опубликованы на странице «руководство по работе с Nano Banana Pro», там же собраны условия доступа и ограничения, о которых заявили разработчики.

Похожие материалы и обновления по теме мы собираем в разделе Генерация видео нейросетями — он пополняется по мере выхода новых сообщений.