Ce que la chronologie montre
La session parcourt un flux réaliste avec des comptages de jetons représentatifs :- Avant que vous ne tapiez quoi que ce soit : CLAUDE.md, la mémoire automatique, les noms d’outils MCP, et les descriptions de compétences se chargent tous dans le contexte. Les fichiers AGENTS.md peuvent également se charger, seuls ou aux côtés de CLAUDE.md. Votre propre configuration peut ajouter plus ici, comme un style de sortie ou du texte provenant de
--append-system-prompt. - Pendant que Claude travaille : chaque lecture de fichier s’ajoute au contexte, les règles délimitées par chemin se chargent automatiquement aux côtés des fichiers correspondants, et un hook PostToolUse s’exécute après chaque modification.
- L’invite de suivi : un sous-agent gère la recherche dans sa propre fenêtre de contexte séparée, de sorte que les lectures de fichiers volumineux restent en dehors de la vôtre. Seul le résumé et une petite remorque de métadonnées reviennent.
- À la fin de la présentation : vous exécutez
/compact, qui remplace la conversation par un résumé structuré. La plupart du contenu de démarrage se recharge automatiquement ; le tableau ci-dessous montre ce qui se passe pour chaque mécanisme.
Ce qui survit à la compaction
Quand une longue session se compacte, Claude Code résume l’historique de la conversation pour l’adapter à la fenêtre de contexte. À partir de la v2.1.198, la demande de résumé hérite de la configuration de réflexion étendue de votre session, de sorte qu’elle raisonne avec la réflexion activée quand votre session l’a activée et reste désactivée sinon. La réflexion affecte uniquement la façon dont le résumé est produit ; vos paramètres de session restent inchangés après. Ce qui arrive à chaque type de contenu dépend de la façon dont il a été chargé :
Immédiatement après la compaction, Claude Code relit jusqu’à cinq des fichiers que Claude a lus ou modifiés dans la session, en choisissant ceux modifiés les plus récemment. Un fichier de plus de 5 000 jetons revient comme une référence de chemin sans son contenu, affiché comme
Referenced file au lieu de Read.
Les règles délimitées par chemin et les fichiers CLAUDE.md imbriqués se chargent dans l’historique des messages quand leur fichier déclencheur est lu, de sorte que la compaction les résume avec tout le reste. Si une règle doit persister à travers la compaction, supprimez le frontmatter paths: ou déplacez-le vers le CLAUDE.md à la racine du projet.
Les corps de compétences sont réinjectés après compaction, mais les grandes compétences sont tronquées pour s’adapter au plafond par compétence, et les compétences invoquées les plus anciennes sont supprimées une fois le budget total dépassé. La troncature conserve le début du fichier, donc mettez les instructions les plus importantes près du haut de SKILL.md.
Quand votre contexte se remplit
Claude Code se compacte automatiquement à mesure que vous approchez de la limite, de sorte qu’une fenêtre de contexte complète ne termine pas votre session. La passe automatique fonctionne de la même manière que l’étape/compact dans la chronologie. Consultez Quand le contexte se remplit pour voir ce qu’elle préserve.
Vous pouvez également agir avant que la passe automatique ne s’exécute :
- Compacter avec un focus : exécutez
/compactavec des instructions, comme/compact focus on the auth bug fix, avant de commencer une longue nouvelle tâche. Le résumé conserve ce que vous choisissez au lieu de ce que la passe automatique devine être important. - Compacter une partie de la conversation : exécutez
/rewind, sélectionnez un message, et choisissez Summarize from here ou Summarize up to here. Consultez Rewind and summarize pour voir ce que chaque option conserve et comment guider le résumé. - Compacter plus tôt : exécutez
/autocompactavec un nombre de jetons, comme/autocompact 500k, pour définir le degré de remplissage de la fenêtre de contexte avant que la passe automatique ne s’exécute. Consultez Set the auto-compact window pour les valeurs acceptées et les remplacements. - Effacer entre les tâches : exécutez
/clearquand vous passez à un travail non lié. L’ancienne conversation encombre les fichiers dont vous avez besoin ensuite et coûte des jetons à chaque message. - Déléguer les lectures volumineuses : envoyez la recherche à un sous-agent de sorte que le contenu du fichier reste dans sa fenêtre de contexte, pas dans la vôtre.
[1m]. La compaction fonctionne de la même manière à la limite plus grande.
Sonnet 5.5 et Sonnet 5 s’exécutent avec la fenêtre de contexte 1M et n’ont pas de variante [1m] à sélectionner. Consultez Fenêtre de contexte Sonnet 5.5 et Sonnet 5 pour leurs seuils de compaction automatique et l’exception de la passerelle LLM.
Le point où la compaction automatique s’exécute dépend de votre modèle et de votre configuration. Consultez Default auto-compact thresholds pour les limites par modèle, et Correct the window for a gateway or custom model ID si Claude Code suppose la mauvaise fenêtre pour votre ID de modèle, comme un alias de passerelle LLM.
Vérifiez votre propre session
La visualisation utilise des nombres représentatifs. Pour voir votre utilisation réelle du contexte à tout moment, exécutez/context pour une ventilation en direct par catégorie avec des suggestions d’optimisation, y compris les fichiers CLAUDE.md et de mémoire automatique chargés. Exécutez /memory pour ouvrir et modifier ces fichiers.
Ressources connexes
Pour une couverture plus approfondie des fonctionnalités présentées dans la chronologie, consultez ces pages :- Étendre Claude Code : quand utiliser CLAUDE.md par rapport aux compétences par rapport aux règles par rapport aux hooks par rapport à MCP
- Stocker les instructions et les mémoires : hiérarchie CLAUDE.md et mémoire automatique
- Sous-agents : déléguer la recherche à une fenêtre de contexte séparée
- Meilleures pratiques : gérer le contexte comme votre contrainte principale
- Mise en cache des invites : quelles actions invalident le préfixe mis en cache
- Réduire l’utilisation des jetons : stratégies pour maintenir l’utilisation du contexte faible