Голосовой ввод в мобильных ИИ-приложениях вытесняет клавиатуру
Набирать длинный запрос на экранной клавиатуре неудобно, и это ограничивало мобильные ИИ-приложения с самого начала: люди писали коротко, получали поверхностные ответы и делали вывод, что модель слабая.
Голосовой ввод снял ограничение. Продиктовать три предложения быстрее, чем набрать одно, а современные модели распознавания уверенно работают даже в шумной обстановке и без интернета.
Диктовка меняет форму запроса
Интересно, что меняется не только скорость, но и содержание. Наговорённый запрос длиннее, содержит больше контекста и звучит как разговор, а не как поисковая строка — и ответы получаются точнее.
Приложения подстраиваются: убирают жёсткие поля ввода, добавляют режим непрерывной диктовки, учатся корректно обрабатывать оговорки и самоисправления вроде «нет, лучше по-другому».
Ограничение у голоса одно и очевидное — публичные места. Поэтому переключение между голосом и текстом должно быть мгновенным, без ухода в настройки.
Что это значит
Подробности и первичное описание опубликованы на странице «руководство по работе с Nano Banana Pro», там же собраны условия доступа и ограничения, о которых заявили разработчики.
Похожие материалы и обновления по теме мы собираем в разделе Генерация видео нейросетями — он пополняется по мере выхода новых сообщений.