Голос ассистента научился смеяться в нужное время

Новое поколение голосовых моделей получило способность генерировать смех и звуки, которые естественно вписываются в разговор. Это достигается добавлением специальных токенов в сценарий диалога, которые модель интерпретирует как сигнал к вставке соответствующего звука.

Система анализирует содержание собственного высказывания и сообщение пользователя, чтобы определить, уместен ли смех. Алгоритм учитывает тон, эмоциональный контекст и тип юмора, позволяя избежать несуразных или оскорбительных реакций.

Применение в практике

Функция уже тестируется в персональных ассистентах и чатботах для повышения человекоподобности коммуникации. Пользователи отмечают, что искусственный смех, используемый органично, делает взаимодействие менее формальным и более доверительным.

Разработчики расширяют спектр паралингвистических звуков: вздохи, заминки, звуки размышления. Каждый элемент требует отдельного обучения и тестирования на репрезентативных диалогах.

Сложность заключается в том, чтобы такие звуки не звучали автоматически или неестественно, поскольку пользователи чувствительны к фальши в голосе.