Конкурент ChatGPT-5 от Alibaba показал лучший результат в англоязычных тестах
Alibaba опубликовала результаты тестирования своей языковой модели Qwen-VL на стандартных англоязычных бенчмарках. Согласно данным компании, её разработка показала более высокие баллы, чем текущая версия ChatGPT-5, в ряде категорий оценки.
Тесты включали задачи на понимание контекста, логический вывод и работу с многомодальными данными. Особенно высокие результаты Alibaba продемонстрировала в задачах анализа изображений и текста в совокупности.
Конкуренция моделей
Результаты подчёркивают интенсификацию соревнования на рынке крупных языковых моделей, где помимо OpenAI активно конкурируют китайские разработчики. Qwen-VL позиционируется как универсальная модель для англоязычного и китайского рынков.
OpenAI не спешит комментировать опубликованные тесты, ссылаясь на разницу в методологии оценки различных организаций. Независимые проверки результатов Alibaba всё ещё находятся в процессе.
Гонка за лидерство в производительности моделей продолжает ускоряться с участием новых игроков из Азии и Европы.