Распознавание речи обходится теперь дешевле текстового ввода
Поставщики облачных сервисов сократили цену на услугу распознавания речи на 35 процентов за счёт сжатия нейросетевых моделей и оптимизации вычислительного графа. Стоимость обработки одной минуты аудио теперь составляет доли цента, что дешевле символьного анализа текста при сопоставимом объёме данных.
Причина снижения стоимости — улучшение аппаратной поддержки специализированных операций и перенос части обработки на устройство пользователя. Локальное распознавание речи, работающее без отправки данных на сервер, требует меньше пропускной способности сети.
Влияние на рынок
Изменение экономики привлекает стартапы к разработке голосовых приложений, которые ранее считались убыточными в масштабе. Мобильные приложения начинают вытеснять текстовые интерфейсы как основной канал взаимодействия.
Конкуренты снижают тарифы в ответ на ценовой прессинг лидеров рынка, что ещё больше расширяет доступность технологии для индивидуальных разработчиков и малых компаний.
Эксперты предполагают, что речь станет стандартным входом для умных устройств, вытеснив физические кнопки и сенсорные экраны в ближайшие два-три года.