Длинный контекст не отменил отбора: середина запроса читается хуже
Рост контекстного окна разработчики встретили как избавление от retrieval: раз помещается весь модуль, зачем искать нужный кусок. Практика оказалась сложнее — модель уверенно использует то, что стоит в начале и в конце, и заметно хуже держит середину.
Поэтому порядок материалов в запросе снова стал инженерным решением. Наиболее важное принято ставить ближе к концу, непосредственно перед задачей, а справочное — в начало, где оно к тому же попадает в кэш.
Цена лишнего контекста
Вторая причина не заполнять окно до краёв — деньги и время. Оплачивается каждый входной токен, а задержка растёт вместе с длиной, и агент, делающий десяток шагов с раздутым контекстом, становится ощутимо дороже и медленнее продуманного.
Третья — конфликты. Когда в запрос попадают и текущая версия файла, и устаревший фрагмент из истории, модель вынуждена выбирать между противоречащими источниками и иногда выбирает неверно. Отбор материала снимает эту неоднозначность лучше любого уточнения в промпте.
Что это значит
Подробности и первичное описание опубликованы на странице разбор того, что стоит исключать из кадра, там же собраны условия доступа и ограничения, о которых заявили разработчики.
Похожие материалы и обновления по теме мы собираем в разделе ИИ-агенты и автоматизация — он пополняется по мере выхода новых сообщений.