Длинный контекст не отменил отбора: середина запроса читается хуже

Рост контекстного окна разработчики встретили как избавление от retrieval: раз помещается весь модуль, зачем искать нужный кусок. Практика оказалась сложнее — модель уверенно использует то, что стоит в начале и в конце, и заметно хуже держит середину.

Поэтому порядок материалов в запросе снова стал инженерным решением. Наиболее важное принято ставить ближе к концу, непосредственно перед задачей, а справочное — в начало, где оно к тому же попадает в кэш.

Цена лишнего контекста

Вторая причина не заполнять окно до краёв — деньги и время. Оплачивается каждый входной токен, а задержка растёт вместе с длиной, и агент, делающий десяток шагов с раздутым контекстом, становится ощутимо дороже и медленнее продуманного.

Третья — конфликты. Когда в запрос попадают и текущая версия файла, и устаревший фрагмент из истории, модель вынуждена выбирать между противоречащими источниками и иногда выбирает неверно. Отбор материала снимает эту неоднозначность лучше любого уточнения в промпте.

Что это значит

Подробности и первичное описание опубликованы на странице разбор того, что стоит исключать из кадра, там же собраны условия доступа и ограничения, о которых заявили разработчики.

Похожие материалы и обновления по теме мы собираем в разделе ИИ-агенты и автоматизация — он пополняется по мере выхода новых сообщений.