Skip to main content
Контекстное окно Claude Code содержит всё, что Claude знает о вашем сеансе: ваши инструкции, файлы, которые он читает, его собственные ответы и содержимое, которое никогда не появляется в вашем терминале. Временная шкала ниже показывает полный сеанс от запуска до компактирования: что загружается перед тем, как вы что-либо введёте, что добавляет каждое чтение файла, правило и hook по мере работы Claude, и как subagent держит большие чтения вне вашего контекста. Смотрите письменное описание для того же содержимого в виде списка.

Что показывает временная шкала

Сеанс проходит через реалистичный поток с репрезентативными подсчётами токенов:
  • Перед тем, как вы что-либо введёте: CLAUDE.md, автоматическая память, имена инструментов MCP и описания skills загружаются в контекст. Файлы AGENTS.md также могут загружаться, самостоятельно или вместе с CLAUDE.md. Ваша собственная настройка может добавить больше здесь, например стиль вывода или текст из --append-system-prompt.
  • Во время работы Claude: каждое чтение файла добавляется в контекст, правила с областью действия пути загружаются автоматически вместе с соответствующими файлами, и hook PostToolUse срабатывает после каждого редактирования.
  • Последующий prompt: subagent обрабатывает исследование в своём собственном отдельном контекстном окне, поэтому большие чтения файлов остаются вне вашего. Только резюме и небольшой трейлер метаданных возвращаются.
  • В конце прохождения: вы запускаете /compact, который заменяет историю разговора структурированным резюме. Большая часть содержимого при запуске перезагружается автоматически; таблица ниже показывает, что происходит с каждым механизмом.

Что сохраняется при компактировании

Когда длительный сеанс компактируется, Claude Code суммирует историю разговора, чтобы она поместилась в контекстное окно. Начиная с версии 2.1.198, запрос суммирования наследует конфигурацию extended thinking вашего сеанса, поэтому он рассуждает с включённым thinking, когда в вашем сеансе он включён, и остаётся отключённым в противном случае. Thinking влияет только на то, как создаётся сводка; параметры вашего сеанса остаются неизменными после этого. Что происходит с каждым видом контента, зависит от того, как он был загружен: Правила с областью действия пути и вложенные файлы CLAUDE.md загружаются в историю сообщений при чтении их триггерного файла, поэтому компактирование суммирует их вместе со всем остальным. Если правило должно сохраняться при компактировании, удалите frontmatter paths: или переместите его в CLAUDE.md в корне проекта. Сразу после компактирования Claude Code повторно читает до пяти файлов, которые Claude прочитал или отредактировал в сеансе, выбирая те, которые были изменены совсем недавно. Файл размером более 5000 токенов возвращается как ссылка на путь без его содержимого, отображаемая как Referenced file вместо Read. Тела skills переинжектируются после компактирования, но большие skills усекаются, чтобы соответствовать лимиту на skill, и самые старые вызванные skills удаляются после превышения общего бюджета. Усечение сохраняет начало файла, поэтому поместите наиболее важные инструкции в начало SKILL.md.

Когда ваш контекст заполняется

Claude Code автоматически компактирует по мере приближения к лимиту, поэтому полное контекстное окно не завершает ваш сеанс. Автоматический проход работает так же, как шаг /compact на временной шкале. Смотрите Когда контекст заполняется для того, что он сохраняет. Вы также можете действовать перед автоматическим проходом:
  • Компактируйте с фокусом: запустите /compact с инструкциями, например /compact focus on the auth bug fix, перед началом длительной новой задачи. Резюме сохраняет то, что вы выбираете, вместо того, что автоматический проход предполагает как важное.
  • Компактируйте часть разговора: запустите /rewind, выберите сообщение и выберите Summarize from here или Summarize up to here. Смотрите Rewind and summarize для того, что каждый вариант сохраняет и как направить резюме.
  • Компактируйте раньше: запустите /autocompact с количеством токенов, например /autocompact 500k, чтобы установить, насколько полным становится контекстное окно перед автоматическим проходом. Смотрите Set the auto-compact window для принятых значений и переопределений.
  • Очищайте между задачами: запустите /clear при переходе на несвязанную работу. Старый разговор вытесняет файлы, которые вам нужны дальше, и стоит токены на каждом сообщении.
  • Делегируйте большие чтения: отправьте исследование subagent, чтобы содержимое файла оставалось в его контекстном окне, а не в вашем.
Если вам нужно большее окно, а не меньший разговор, модели Fable, Sonnet 5 и более поздние версии, Opus 4.6 и более поздние версии, а также Sonnet 4.6 поддерживают контекстное окно в 1 миллион токенов. Смотрите Extended context для доступности по плану и как выбрать вариант модели [1m]. Компактирование работает так же при большем лимите. Sonnet 5.5 и Sonnet 5 работают с контекстным окном 1M и не имеют варианта [1m] для выбора. Смотрите Sonnet 5.5 and Sonnet 5 context window для их пороговых значений автокомпактирования и исключения шлюза LLM. Точка, в которой запускается автоматическое компактирование, зависит от вашей модели и конфигурации. Смотрите Default auto-compact thresholds для границ по модели и Correct the window for a gateway or custom model ID, если Claude Code предполагает неправильное окно для вашего ID модели, например LLM gateway псевдоним.

Проверьте свой собственный сеанс

Визуализация использует репрезентативные числа. Чтобы увидеть фактическое использование контекста в любой момент, запустите /context для живого разбора по категориям с предложениями по оптимизации, включая информацию о том, какие файлы CLAUDE.md и файлы автоматической памяти загружены. Запустите /memory для открытия и редактирования этих файлов. Для более глубокого охвата функций, показанных на временной шкале, смотрите эти страницы: