Palladium от DeepSeek обогнал Flux по скорости инференса
DeepSeek представила оптимизированную версию своей генеративной модели под названием Palladium, которая демонстрирует значительное ускорение по сравнению с Flux и другими текущими лидерами рынка. На GPU среднего уровня время инференса составляет около 2,3 секунды для квадратного изображения разрешением 1024 пикселей.
Ускорение достигнуто за счёт оптимизации токенизатора и переписания критичных по производительности слоёв нейросети. При этом качество изображений остаётся на уровне предыдущих версий или немного улучшается благодаря новой схеме обучения.
Последствия для рынка
Результат усиливает позицию DeepSeek в сегменте генерации изображений и создаёт давление на других разработчиков ускорить свои модели. Более быстрые итерации открывают возможности для интерактивных приложений и снижают операционные расходы на API-сервисы.
Palladium уже доступна для локального использования под открытой лицензией, что позволяет интеграторам внедрять её в собственные системы без посредничества облачных платформ.
Конкурренты, включая Stability AI и Meta, начинают демонстрировать собственные оптимизации, однако Palladium на текущий момент держит лидерство по скорости.