Контекст

Info

Контекст — это все, что агент видит в момент ответа: инструкции репозитория, ваши сообщения, прочитанные файлы, вывод команд и результаты работы инструментов. Он ограничен по размеру, и от того, что в нем лежит, напрямую зависит качество ответа.

Контекстное окно

Объем контекста измеряется в токенах и ограничен возможностями модели. Когда место заканчивается, агент не получает сообщение об ошибке — он просто перестает видеть часть работы и начинает действовать по неполной картине.

Больше всего места занимают, от самого расточительного к самому скромному:

  1. Вывод команд и результаты работы инструментов — особенно логи сборки и тестов.
  2. Прочитанные файлы целиком.
  3. История диалога.
  4. Постоянные инструкции: AGENTS.md и подключенные навыки.

В сессиях текущая заполненность контекста видна прямо в интерфейсе.

Сжатие диалога

Когда контекст близок к пределу, диалог сжимается автоматически: агент составляет краткое изложение предыдущей переписки и продолжает работу с ним вместо полной истории. В ленте появляются служебные события Контекст сжимается для продолжения диалога и Контекст сжат для продолжения диалога.

Сжатие можно запустить и вручную — в сессиях это команда /summarize. Это полезно перед крупным новым этапом работы в том же диалоге.

Что важно понимать: после сжатия агент помнит выводы, но не дословную переписку. Договоренность, упомянутая один раз и мимоходом, может не пережить сжатие. Если решение важно — зафиксируйте его в файле: в AGENTS.md, в описании задачи или в документе плана.

Признаки переполненного контекста

  • агент повторно читает файлы, которые уже читал;
  • он возвращается к решениям, которые вы уже отклонили;
  • ответы становятся общими, теряется специфика проекта;
  • он «забывает» ограничение, названное в начале диалога.

Это не повод переформулировать запрос — это повод разгрузить контекст.

Приемы работы

  1. Новая задача — новый диалог. Не продолжайте в старой сессии работу, не связанную с предыдущей: вся ее история продолжит расходовать контекст.
  2. Объемный поиск — субагенту. Пусть исследование репозитория идет в отдельном контексте и возвращает вывод, а не содержимое файлов. См. Агенты и субагенты.
  3. Важное — в файл, а не в переписку. План, критерии приемки и принятые решения переживут сжатие только в виде файла.
  4. Инструкции — короткие. AGENTS.md попадает в контекст всегда, поэтому в нем должно быть только то, о чем агент ошибется без подсказки. Процедуры выносите в навыки: их текст подключается лишь тогда, когда навык нужен.
  5. Не просите прочитать все. Формулировка «изучи весь репозиторий» тратит контекст и почти никогда не улучшает результат. Назовите область.
  6. Ограничивайте вывод команд. Просите фильтровать логи и показывать только значимые строки: полный вывод сборки вытесняет из контекста саму задачу.

Что дальше

  1. Посмотрите, какими инструментами агент пользуется и как это подтверждается, — Инструменты и MCP.
  2. Вернитесь к циклу работы с агентом: большинство проблем с контекстом снимается тем, что задача правильно ограничена на шаге плана.