OpenAI повысила точность перевода на редкие языки на 30 процентов
OpenAI опубликовала результаты переиндексации модели на языках с ограниченным корпусом текстов. Средняя точность возросла на 30 процентов для языков группы C, включая болгарский, словацкий, литовский, латвийский и эстонский.
Улучшение достигнуто за счёт применения техники трансфера из близкородственных языков и переиспользования структур для языков с сходной морфологией. Модель теперь лучше справляется с падежными системами, спряжениями и предлогами, специфичными для каждого языка.
Расширение языковой поддержки
В пилотном испытании участвовали переводчики и лингвисты, оценившие качество фраз в контексте оригинального текста. Ошибки на уровне терминологии и устойчивых выражений сократились на 35 процентов.
Обновление затронуло 23 редких языка, включая языки меньшинств и коренных народов. Функция остаётся доступной через стандартный API перевода без дополнительных вызовов.
OpenAI планирует применить аналогичный подход к другим низкоресурсным языкам в следующих квартальных обновлениях.