Сбербанк выпустил открытую модель русского языка мощнее предыдущей версии

Финансовый холдинг Сбербанк выпустил новую версию своей открытой языковой модели, обученной на расширенной выборке текстов на русском языке. Модель показывает значительное улучшение качества при обработке сложных лингвистических конструкций и специализированного контента.

Новая версия содержит 70 миллиардов параметров против 35 миллиардов в предыдущей итерации. Обучение проводилось на корпусе текстов размером в 4 триллиона токенов с использованием улучшенной методологии.

Доступность и применение

Модель распространяется на условиях открытой лицензии через репозиторий Hugging Face и доступна для скачивания и локального запуска. Сбербанк предоставляет документацию и примеры интеграции для разработчиков.

Компания тестирует внедрение модели в собственные сервисы автоматизации обработки текстов и поддержки клиентов. Открытая лицензия позволит другим организациям использовать разработку без ограничений.

Эксперты отмечают, что выход обновленной версии укрепляет позицию отечественных разработок в области обработки русского языка и снижает зависимость от иностранных решений.