Was die Zeitleiste zeigt
Die Sitzung durchläuft einen realistischen Ablauf mit repräsentativen Token-Zählungen:- Bevor Sie etwas eingeben: CLAUDE.md, automatisches Gedächtnis, MCP-Tool-Namen und Skill-Beschreibungen werden alle in den Kontext geladen. AGENTS.md-Dateien können auch geladen werden, eigenständig oder zusammen mit CLAUDE.md. Ihr eigenes Setup kann hier mehr hinzufügen, wie ein Ausgabestil oder Text aus
--append-system-prompt. - Während Claude arbeitet: Jeder Dateilesevorgang fügt zum Kontext hinzu, pfadgebundene Regeln werden automatisch zusammen mit übereinstimmenden Dateien geladen, und ein PostToolUse Hook wird nach jeder Bearbeitung ausgelöst.
- Die Folgeeingabeaufforderung: Ein Subagent verarbeitet die Recherche in seinem eigenen separaten Kontextfenster, sodass die großen Dateilesevorgang außerhalb des Ihren bleiben. Nur die Zusammenfassung und ein kleiner Metadaten-Trailer kommen zurück.
- Am Ende der Anleitung: Sie führen
/compactaus, das die Konversation durch eine strukturierte Zusammenfassung ersetzt. Der meiste Startinhalt wird automatisch neu geladen; die folgende Tabelle zeigt, was mit jedem Mechanismus geschieht.
Was die Komprimierung übersteht
Wenn eine lange Sitzung komprimiert wird, fasst Claude Code die Konversationshistorie zusammen, um in das Kontextfenster zu passen. Ab v2.1.198 erbt die Zusammenfassungsanfrage die erweiterte Überlegung Konfiguration Ihrer Sitzung, sodass sie mit aktiviertem Denken argumentiert, wenn Ihre Sitzung dies aktiviert hat, und ansonsten deaktiviert bleibt. Das Denken beeinflusst nur, wie die Zusammenfassung erstellt wird; Ihre Sitzungseinstellungen bleiben danach unverändert. Was mit den einzelnen Inhaltstypen geschieht, hängt davon ab, wie sie geladen wurden:
Unmittelbar nach der Komprimierung liest Claude Code bis zu fünf der Dateien neu, die Claude in der Sitzung gelesen oder bearbeitet hat, und wählt die zuletzt geänderten aus. Eine Datei über 5.000 Token kommt als Pfadreferenz ohne ihren Inhalt zurück, angezeigt als
Referenced file statt Read.
Pfadgebundene Regeln und verschachtelte CLAUDE.md-Dateien werden in die Nachrichtenhistorie geladen, wenn ihre Trigger-Datei gelesen wird, sodass die Komprimierung sie zusammen mit allem anderen zusammenfasst. Wenn eine Regel über die Komprimierung hinweg bestehen bleiben muss, entfernen Sie das paths: Frontmatter oder verschieben Sie es in die Projekt-Root CLAUDE.md.
Skill-Texte werden nach der Komprimierung neu eingefügt, aber große Skills werden auf die Pro-Skill-Grenze gekürzt, und die ältesten aufgerufenen Skills werden gelöscht, sobald das Gesamtbudget überschritten wird. Die Kürzung behält den Anfang der Datei bei, daher sollten Sie die wichtigsten Anweisungen oben in SKILL.md platzieren.
Wenn sich Ihr Kontext füllt
Claude Code komprimiert automatisch, wenn Sie sich dem Limit nähern, sodass ein volles Kontextfenster Ihre Sitzung nicht beendet. Der automatische Durchgang funktioniert genauso wie der/compact-Schritt in der Zeitleiste. Siehe Wenn sich der Kontext füllt für das, was er bewahrt.
Sie können auch handeln, bevor der automatische Durchgang ausgeführt wird:
- Mit Fokus komprimieren: Führen Sie
/compactmit Anweisungen aus, wie/compact focus on the auth bug fix, bevor Sie eine lange neue Aufgabe starten. Die Zusammenfassung behält das, was Sie wählen, anstelle dessen, was der automatische Durchgang als wichtig erachtet. - Teil der Konversation komprimieren: Führen Sie
/rewindaus, wählen Sie eine Nachricht aus, und wählen Sie Von hier aus zusammenfassen oder Bis hier zusammenfassen. Siehe Rewind und Zusammenfassung für das, was jede Option behält und wie Sie die Zusammenfassung lenken. - Früher komprimieren: Führen Sie
/autocompactmit einer Token-Anzahl aus, wie/autocompact 500k, um festzulegen, wie voll das Kontextfenster wird, bevor der automatische Durchgang ausgeführt wird. Siehe Automatisches Kompressionsfenster einstellen für akzeptierte Werte und Überschreibungen. - Zwischen Aufgaben löschen: Führen Sie
/clearaus, wenn Sie zu nicht verwandter Arbeit wechseln. Alte Konversationen verdrängen die Dateien, die Sie als nächstes benötigen, und kosten Token bei jeder Nachricht. - Große Lesevorgänge delegieren: Senden Sie Recherche an einen Subagent, sodass die Dateiinhalte in seinem Kontextfenster bleiben, nicht in Ihrem.
[1m] Modellvariante auswählen. Die Komprimierung funktioniert auf die gleiche Weise bei der größeren Grenze.
Sonnet 5.5 und Sonnet 5 laufen mit dem 1M-Kontextfenster und haben keine [1m]-Variante zur Auswahl. Siehe Sonnet 5.5 und Sonnet 5 Kontextfenster für ihre automatischen Kompressionsschwellen und die LLM-Gateway-Ausnahme.
Der Punkt, an dem die automatische Komprimierung ausgeführt wird, hängt von Ihrem Modell und Ihrer Konfiguration ab. Siehe Standardschwellen für automatische Komprimierung für die Grenzen pro Modell, und Fenster für ein Gateway oder benutzerdefinierte Modell-ID korrigieren, wenn Claude Code das falsche Fenster für Ihre Modell-ID annimmt, wie z. B. einen LLM-Gateway-Alias.
Überprüfen Sie Ihre eigene Sitzung
Die Visualisierung verwendet repräsentative Zahlen. Um Ihre tatsächliche Kontextnutzung zu einem beliebigen Zeitpunkt zu sehen, führen Sie/context aus, um eine Live-Aufschlüsselung nach Kategorie mit Optimierungsvorschlägen zu erhalten, einschließlich welche CLAUDE.md- und automatische Speicherdateien geladen wurden. Führen Sie /memory aus, um diese Dateien zu öffnen und zu bearbeiten.
Verwandte Ressourcen
Für eine tiefere Abdeckung der in der Zeitleiste gezeigten Funktionen siehe diese Seiten:- Claude Code erweitern: wann CLAUDE.md vs Skills vs Regeln vs Hooks vs MCP verwendet werden
- Anweisungen und Erinnerungen speichern: CLAUDE.md-Hierarchie und automatisches Gedächtnis
- Subagents: Recherche an ein separates Kontextfenster delegieren
- Best Practices: Verwaltung des Kontexts als Ihre primäre Einschränkung
- Prompt Caching: welche Aktionen den zwischengespeicherten Präfix ungültig machen
- Token-Nutzung reduzieren: Strategien zur Senkung der Kontextnutzung