Skip to main content
A janela de contexto do Claude Code contém tudo o que Claude sabe sobre sua sessão: suas instruções, os arquivos que lê, suas próprias respostas e conteúdo que nunca aparece em seu terminal. A linha do tempo abaixo mostra uma sessão completa do início até a compactação: o que é carregado antes de você digitar, o que cada leitura de arquivo, regra e hook adiciona conforme Claude trabalha, e como um subagent mantém leituras grandes fora de seu contexto. Veja o detalhamento escrito para o mesmo conteúdo como uma lista.

O que a linha do tempo mostra

A sessão percorre um fluxo realista com contagens de tokens representativas:
  • Antes de você digitar qualquer coisa: CLAUDE.md, memória automática, nomes de ferramentas MCP e descrições de skills são todos carregados no contexto. Arquivos AGENTS.md também podem ser carregados, por conta própria ou junto com CLAUDE.md. Sua própria configuração pode adicionar mais aqui, como um estilo de saída ou texto de --append-system-prompt.
  • Conforme Claude trabalha: cada leitura de arquivo adiciona ao contexto, regras com escopo de caminho são carregadas automaticamente junto com arquivos correspondentes, e um hook PostToolUse é acionado após cada edição.
  • O prompt de acompanhamento: um subagent lida com a pesquisa em sua própria janela de contexto separada, então as leituras de arquivo grandes ficam fora da sua. Apenas o resumo e um pequeno trailer de metadados voltam.
  • No final da apresentação: você executa /compact, que substitui a conversa por um resumo estruturado. A maioria do conteúdo de inicialização é recarregada automaticamente; a tabela abaixo mostra o que acontece com cada mecanismo.

O que sobrevive à compactação

Quando uma sessão longa é compactada, Claude Code resume o histórico de conversa para caber na janela de contexto. A partir da v2.1.198, a solicitação de resumo herda a configuração de extended thinking da sua sessão, portanto ela raciocina com o thinking habilitado quando sua sessão o tem habilitado e permanece desativado caso contrário. O thinking afeta apenas como o resumo é produzido; suas configurações de sessão permanecem inalteradas depois. O que acontece com cada tipo de conteúdo depende de como foi carregado: Logo após a compactação, Claude Code relê até cinco dos arquivos que Claude leu ou editou na sessão, escolhendo os modificados mais recentemente. Um arquivo com mais de 5.000 tokens volta como uma referência de caminho sem seu conteúdo, mostrado como Referenced file em vez de Read. Regras com escopo de caminho e arquivos CLAUDE.md aninhados são carregados no histórico de mensagens quando seu arquivo de gatilho é lido, portanto a compactação os resume junto com tudo mais. Se uma regra deve persistir através da compactação, remova o frontmatter paths: ou mova-o para o CLAUDE.md na raiz do projeto. Corpos de skills são re-injetados após compactação, mas skills grandes são truncados para caber no limite por skill, e os skills invocados mais antigos são descartados uma vez que o orçamento total é excedido. O truncamento mantém o início do arquivo, então coloque as instruções mais importantes perto do topo de SKILL.md.

Quando sua janela de contexto se preenche

Claude Code faz compactação automática conforme você se aproxima do limite, então uma janela de contexto cheia não encerra sua sessão. A passagem automática funciona da mesma forma que a etapa /compact na linha do tempo. Veja Quando o contexto se preenche para o que ela preserva. Você também pode agir antes da passagem automática ser executada:
  • Compacte com um foco: execute /compact com instruções, como /compact focus on the auth bug fix, antes de iniciar uma tarefa longa nova. O resumo mantém o que você escolhe em vez do que a passagem automática acha que é importante.
  • Compacte parte da conversa: execute /rewind, selecione uma mensagem e escolha Summarize from here ou Summarize up to here. Veja Rewind and summarize para o que cada opção mantém e como orientar o resumo.
  • Compacte mais cedo: execute /autocompact com uma contagem de tokens, como /autocompact 500k, para definir o quão cheio a janela de contexto fica antes da passagem automática ser executada. Veja Set the auto-compact window para valores aceitos e substituições.
  • Limpe entre tarefas: execute /clear ao mudar para trabalho não relacionado. Conversa antiga ocupa espaço dos arquivos que você precisa em seguida e custa tokens em cada mensagem.
  • Delegue leituras grandes: envie pesquisa para um subagent para que o conteúdo do arquivo fique em sua janela de contexto, não na sua.
Se você precisar de uma janela maior em vez de uma conversa menor, modelos Fable, Sonnet 5 e posteriores, Opus 4.6 e posteriores, e Sonnet 4.6 suportam uma janela de contexto de 1 milhão de tokens. Veja Extended context para disponibilidade por plano e como selecionar uma variante de modelo [1m]. A compactação funciona da mesma forma no limite maior. Sonnet 5.5 e Sonnet 5 são executados com a janela de contexto de 1M e não têm variante [1m] para selecionar. Veja Sonnet 5.5 and Sonnet 5 context window para seus limites de auto-compactação e a exceção do gateway LLM. O ponto em que a compactação automática é executada depende do seu modelo e configuração. Veja Default auto-compact thresholds para os limites por modelo, e Correct the window for a gateway or custom model ID se Claude Code assumir a janela errada para seu ID de modelo, como um alias de LLM gateway.

Verifique sua própria sessão

A visualização usa números representativos. Para ver seu uso real de contexto em qualquer ponto, execute /context para um detalhamento ao vivo por categoria com sugestões de otimização, incluindo quais arquivos CLAUDE.md e memória automática foram carregados. Execute /memory para abrir e editar esses arquivos. Para cobertura mais profunda dos recursos mostrados na linha do tempo, veja estas páginas: