O que a linha do tempo mostra
A sessão percorre um fluxo realista com contagens de tokens representativas:- Antes de você digitar qualquer coisa: CLAUDE.md, memória automática, nomes de ferramentas MCP e descrições de skills são todos carregados no contexto. Arquivos AGENTS.md também podem ser carregados, por conta própria ou junto com CLAUDE.md. Sua própria configuração pode adicionar mais aqui, como um estilo de saída ou texto de
--append-system-prompt. - Conforme Claude trabalha: cada leitura de arquivo adiciona ao contexto, regras com escopo de caminho são carregadas automaticamente junto com arquivos correspondentes, e um hook PostToolUse é acionado após cada edição.
- O prompt de acompanhamento: um subagent lida com a pesquisa em sua própria janela de contexto separada, então as leituras de arquivo grandes ficam fora da sua. Apenas o resumo e um pequeno trailer de metadados voltam.
- No final da apresentação: você executa
/compact, que substitui a conversa por um resumo estruturado. A maioria do conteúdo de inicialização é recarregada automaticamente; a tabela abaixo mostra o que acontece com cada mecanismo.
O que sobrevive à compactação
Quando uma sessão longa é compactada, Claude Code resume o histórico de conversa para caber na janela de contexto. A partir da v2.1.198, a solicitação de resumo herda a configuração de extended thinking da sua sessão, portanto ela raciocina com o thinking habilitado quando sua sessão o tem habilitado e permanece desativado caso contrário. O thinking afeta apenas como o resumo é produzido; suas configurações de sessão permanecem inalteradas depois. O que acontece com cada tipo de conteúdo depende de como foi carregado:
Logo após a compactação, Claude Code relê até cinco dos arquivos que Claude leu ou editou na sessão, escolhendo os modificados mais recentemente. Um arquivo com mais de 5.000 tokens volta como uma referência de caminho sem seu conteúdo, mostrado como
Referenced file em vez de Read.
Regras com escopo de caminho e arquivos CLAUDE.md aninhados são carregados no histórico de mensagens quando seu arquivo de gatilho é lido, portanto a compactação os resume junto com tudo mais. Se uma regra deve persistir através da compactação, remova o frontmatter paths: ou mova-o para o CLAUDE.md na raiz do projeto.
Corpos de skills são re-injetados após compactação, mas skills grandes são truncados para caber no limite por skill, e os skills invocados mais antigos são descartados uma vez que o orçamento total é excedido. O truncamento mantém o início do arquivo, então coloque as instruções mais importantes perto do topo de SKILL.md.
Quando sua janela de contexto se preenche
Claude Code faz compactação automática conforme você se aproxima do limite, então uma janela de contexto cheia não encerra sua sessão. A passagem automática funciona da mesma forma que a etapa/compact na linha do tempo. Veja Quando o contexto se preenche para o que ela preserva.
Você também pode agir antes da passagem automática ser executada:
- Compacte com um foco: execute
/compactcom instruções, como/compact focus on the auth bug fix, antes de iniciar uma tarefa longa nova. O resumo mantém o que você escolhe em vez do que a passagem automática acha que é importante. - Compacte parte da conversa: execute
/rewind, selecione uma mensagem e escolha Summarize from here ou Summarize up to here. Veja Rewind and summarize para o que cada opção mantém e como orientar o resumo. - Compacte mais cedo: execute
/autocompactcom uma contagem de tokens, como/autocompact 500k, para definir o quão cheio a janela de contexto fica antes da passagem automática ser executada. Veja Set the auto-compact window para valores aceitos e substituições. - Limpe entre tarefas: execute
/clearao mudar para trabalho não relacionado. Conversa antiga ocupa espaço dos arquivos que você precisa em seguida e custa tokens em cada mensagem. - Delegue leituras grandes: envie pesquisa para um subagent para que o conteúdo do arquivo fique em sua janela de contexto, não na sua.
[1m]. A compactação funciona da mesma forma no limite maior.
Sonnet 5.5 e Sonnet 5 são executados com a janela de contexto de 1M e não têm variante [1m] para selecionar. Veja Sonnet 5.5 and Sonnet 5 context window para seus limites de auto-compactação e a exceção do gateway LLM.
O ponto em que a compactação automática é executada depende do seu modelo e configuração. Veja Default auto-compact thresholds para os limites por modelo, e Correct the window for a gateway or custom model ID se Claude Code assumir a janela errada para seu ID de modelo, como um alias de LLM gateway.
Verifique sua própria sessão
A visualização usa números representativos. Para ver seu uso real de contexto em qualquer ponto, execute/context para um detalhamento ao vivo por categoria com sugestões de otimização, incluindo quais arquivos CLAUDE.md e memória automática foram carregados. Execute /memory para abrir e editar esses arquivos.
Recursos relacionados
Para cobertura mais profunda dos recursos mostrados na linha do tempo, veja estas páginas:- Estenda Claude Code: quando usar CLAUDE.md vs skills vs regras vs hooks vs MCP
- Armazene instruções e memórias: hierarquia CLAUDE.md e memória automática
- Subagents: delegue pesquisa a uma janela de contexto separada
- Melhores práticas: gerenciando contexto como sua restrição principal
- Prompt caching: quais ações invalidam o prefixo em cache
- Reduza o uso de tokens: estratégias para manter o uso de contexto baixo