Новая версия быстрее обрабатывает длинные документы

Обновление ChatGPT-5 включает оптимизацию обработки контекста, которая позволяет моделям работать с документами объёмом до миллиона токенов без заметного снижения скорости. Архитектурные изменения затронули механизм кеширования и распределение вычислений на этапе инференса.

Практические тесты показывают, что время ответа на запросы с документами длиной 100 килобайт сократилось на 40–60 процентов в зависимости от сложности задачи. Это особенно важно для сценариев, где требуется анализ больших кодовых базисов, архивов документов и исторических данных.

Применение в исследованиях и разработке

Улучшение скорости обработки открывает новые возможности для работы с юридическими контрактами, научными публикациями и техническими спецификациями, где объём исходного материала критичен для качества ответа.

OpenAI планирует дальнейшую оптимизацию для работы с контекстом в несколько миллионов токенов к концу года, сохраняя при этом точность логического анализа и цитирования источников.

Изменения обратно совместимы — разработчики могут использовать обновлённую версию без правок в коде приложений.