Голос ассистента научился смеяться в нужное время
Новое поколение голосовых моделей получило способность генерировать смех и звуки, которые естественно вписываются в разговор. Это достигается добавлением специальных токенов в сценарий диалога, которые модель интерпретирует как сигнал к вставке соответствующего звука.
Система анализирует содержание собственного высказывания и сообщение пользователя, чтобы определить, уместен ли смех. Алгоритм учитывает тон, эмоциональный контекст и тип юмора, позволяя избежать несуразных или оскорбительных реакций.
Применение в практике
Функция уже тестируется в персональных ассистентах и чатботах для повышения человекоподобности коммуникации. Пользователи отмечают, что искусственный смех, используемый органично, делает взаимодействие менее формальным и более доверительным.
Разработчики расширяют спектр паралингвистических звуков: вздохи, заминки, звуки размышления. Каждый элемент требует отдельного обучения и тестирования на репрезентативных диалогах.
Сложность заключается в том, чтобы такие звуки не звучали автоматически или неестественно, поскольку пользователи чувствительны к фальши в голосе.