Claude Code: /compact oder /clear und ihre Kosten

/clear beginnt mit leerem Kontext und kostet nichts. /compact behält eine Zusammenfassung des Gesprächs; dafür muss Claude den bisherigen Verlauf noch einmal verarbeiten.

/clear startet eine neue Konversation mit einem leeren Kontext. /compact behält die aktuelle Konversation bei, ersetzt jedoch deren Verlauf durch eine Zusammenfassung. Daraus folgt die Regel: /clear, wenn die nächste Aufgabe nichts mit der vorherigen zu tun hat, /compact, wenn Sie sich mitten in einer Aufgabe befinden und der Verlauf immer noch wichtig ist.

Beides existiert, weil eine Claude-Code-Sitzung mit zunehmender Konversation teurer und weniger zuverlässig wird. Sie sind gegensätzliche Antworten auf dieses Problem und kosten nicht das Gleiche.

Was jeder Befehl mit dem Kontext macht

/clear beendet die Konversation und eröffnet eine neue mit leerem Verlauf. Der Projektspeicher befindet sich außerhalb dieses Verlaufs und bleibt daher erhalten: CLAUDE.md und der automatische Speicher werden zu Beginn des neuen Gesprächs wieder geladen.

Es wird auch nichts gelöscht. Die alte Konversation wird gespeichert, /resume bringt sie zurück und durch die Übergabe eines Namens, wie in /clear release-prep, wird sie für die Auswahl beim Fortsetzen gekennzeichnet. /reset und /new sind Aliase.

/clear

Ein neues Gespräch mit einem leeren Kontext; das alte bleibt über /resume verfügbar.

/compact ersetzt den Nachrichtenverlauf durch eine strukturierte Zusammenfassung und fährt in derselben Sitzung fort. Gemäß der Claude-Code-Dokumentation enthält die Zusammenfassung Ihre Anfragen, wichtige technische Konzepte, die untersuchten oder geänderten Dateien mit ihren wichtigen Auszügen, Fehler und deren Behebung sowie ausstehende Arbeiten. Der wörtliche Verlauf fällt weg, darunter vollständige Tool-Ausgaben und Zwischenschritte der Überlegung. Anweisungen, die Sie nur im Gespräch gegeben haben, können dabei verloren gehen.

Einige Dinge werden neu erstellt und nicht zusammengefasst: Die CLAUDE.md im Projektstamm und der automatische Speicher werden erneut von der Festplatte gelesen, bis zu fünf der von Claude gelesenen oder bearbeiteten Dateien kommen zurück, die zuletzt geänderten Dateien zuerst, und aufgerufene Skills werden bis zu einer Größenbeschränkung erneut eingefügt. Pfadbezogene Regeln und CLAUDE.md-Dateien in Unterverzeichnissen werden zusammengefasst, bis Claude das nächste Mal eine Datei liest, auf die sie angewendet werden.

/compact focus on the auth bug fix

Fokusanweisungen sagen der Zusammenfassung, was sie behalten soll, anstatt sie dem Erraten zu überlassen.

Um einen Fokus dauerhaft zu machen, fügen Sie dem Projekt CLAUDE.md einen Abschnitt # Compact instructions hinzu und bitten Sie ihn beispielsweise, die Liste der geänderten Dateien und die Testbefehle immer beizubehalten.

Warum eine lange Sitzung mit jeder Runde mehr kostet

Das Modell merkt sich nichts zwischen den Anfragen. Jedes Mal, wenn Sie eine Nachricht senden, stellt Claude Code eine neue API-Anfrage und sendet den vollständigen Kontext erneut: den System-Prompt, Ihren Projektkontext, alle früheren Nachrichten und Toolergebnisse und dann Ihre neue Nachricht. Jedes Mal, wenn Claude ein Tool verwendet, wird eine weitere Anfrage gesendet, die das gesamte Gespräch erneut fortführt. Eine einzeilige Frage am Ende einer langen Sitzung ist eine einzeilige Frage plus alles davor.

Prompt Caching mildert dies, ohne es zu entfernen. Der unveränderte Teil jeder Anfrage wird aus einem Cache gelesen und zu einem Bruchteil des normalen Eingabepreises abgerechnet (ein Zehntel oder weniger bei aktuellen Claude-Modellen, Stand September 2026). Ein Bruchteil einer großen Anzahl, die bei jeder Anfrage bezahlt wird, wächst immer noch mit der Konversation, und bei einem Abonnement werden immer noch Ihre Nutzungsgrenzen beansprucht.

Auch der Cache läuft ab. Ab September 2026 gibt die Dokumentation die Lebensdauer eines Abonnements auf eine Stunde und für einen API-Schlüssel standardmäßig auf fünf Minuten an, und die erste Anfrage nach einer längeren Pause verarbeitet den gesamten Verlauf von Grund auf neu.

Die Kosten sind nicht das Einzige, was sich verschlechtert. Im Best-Practices-Leitfaden für Claude Code heißt es, dass die Leistung sinkt, wenn das Kontextfenster gefüllt wird: Claude beginnt möglicherweise, frühere Anweisungen zu vergessen oder mehr Fehler zu machen. Das ist Kontextverschlechterung, und eine Geschichte voller gescheiterter Versuche macht es noch schlimmer.

Was /compact und /clear eigentlich kosten

/clear ist kostenlos. Die Kostendokumentation von Claude Code bringt es auf den Punkt: Wenn Sie einen Neuanfang statt Kontinuität wünschen, kostet /clear nichts. Die erste Nachricht danach enthält den festen Teil des Kontexts (System-Prompt, Tooldefinitionen, CLAUDE.md und Speicher) sowie Ihre Eingabe.

/compact ist eine Modellanforderung und bei einer langen Sitzung eine große. Um die Zusammenfassung zu verfassen, sendet Claude Code eine separate Anfrage mit derselben System-Prompt, denselben Tools und demselben vollständigen Verlauf wie Ihre Konversation, wobei am Ende eine Zusammenfassungsanweisung angehängt ist. Sein Input ist alles, was die Sitzung gesammelt hat. Seine Ausgabe ist die Zusammenfassung, und die Ausgabe ist die teuerste Art von Token.

Der Zeitpunkt der Verdichtung bestimmt ihre Kosten. In der Mitte der Sitzung ist der Cache warm, sodass der Verlauf mit der zwischengespeicherten Rate gelesen wird: In den Worten der Dokumentation kostet ein /compact in der Mitte der Sitzung einen Bruchteil dessen, was die Kontextgröße vermuten lässt. Nach einer Pause, die länger als die Cache-Lebensdauer ist, wird der gesamte Verlauf als nicht zwischengespeicherte Eingabe erneut verarbeitet, was das Komprimieren einer Sitzung, die Sie gerade wieder aufgenommen haben, zum teuersten Fall macht.

Was Sie kaufen, ist bei späteren Anfragen günstiger: Jede spätere Anfrage enthält die Zusammenfassung anstelle der Historie. Die Verdichtung zahlt sich aus, wenn die Sitzung lange genug dauert und nicht mehr benötigtes Material verworfen wird. Um einen falschen Weg ganz zurückzunehmen, ist /rewind noch günstiger: Es verkürzt die Konversation auf ein bereits zwischengespeichertes Präfix, anstatt ein neues zu erstellen.

Automatische Komprimierung und wann sie ausgeführt wird

Die automatische Komprimierung ist standardmäßig aktiviert. Wenn sich die Konversation dem Limit nähert, löscht Claude Code zunächst die Ausgaben älterer Tools und fasst dann die Konversation zusammen, wenn dies nicht ausreicht, genau wie /compact. Es hält eine Sitzung am Leben, wenn das Fenster gefüllt ist. Sie hält die Sitzung nicht automatisch günstig.

Standardmäßig greift sie spät. Mit Stand vom September 2026 heißt es in der Dokumentation, dass eine Sitzung komprimiert wird, wenn die Konversation das Kontextlimit des Modells erreicht, oder bei etwa 967.000 Token bei Modellen, die mit einem Fenster von einer Million Token auf der Anthropic API laufen (wie Sonnet 5, die Fable-Modelle und Opus 4.7 und höher). Der genaue Punkt hängt vom Modell, dem Anbieter und Ihren Einstellungen ab. Bis dahin hat jede frühere Anfrage die wachsenden Verlauf mitgesendet, und die Komprimierung selbst liest ein fast volles Fenster, oft mitten in einer Aufgabe.

Sie können den Schwellenwert verschieben: /autocompact 500k legt fest, wie voll das Fenster wird, bevor der automatische Durchgang ausgeführt wird, und /autocompact auto stellt die Standardeinstellung Ihres Modells wieder her (der Befehl benötigt Claude Code v2.1.221 oder höher). Die Einstellung „Auto-Compact“ in /config schaltet den automatischen Pass aus; /compact funktioniert immer noch manuell.

So sehen Sie, wie voll das Kontextfenster ist

/context zeigt die aktuelle Nutzung als farbiges Raster an, aufgeschlüsselt nach Kategorien und einschließlich der geladenen CLAUDE.md- und Speicherdateien, mit Vorschlägen, wenn etwas mehr Platz beansprucht, als es sollte. Führen Sie es aus, bevor Sie eine Entscheidung treffen.

/context

Was ist gerade im Fenster und was nimmt den Platz ein?

Für eine laufende Anzeige können Sie den Prozentsatz in die Statuszeile aufnehmen: /statusline richtet eine solche Anzeige anhand einer Beschreibung ein, und ein Skript kann das Feld context_window.used_percentage direkt lesen. /usage beantwortet eine andere Frage: Was hat die Sitzung ausgegeben und wo stehen Sie gegenüber den Grenzen Ihres Plans?

Welchen Befehl Sie wann verwenden

  • Die nächste Aufgabe hat nichts damit zu tun: /clear. Alte Konversationen verdrängen die Dateien, die die neue Aufgabe benötigt, und dafür wird bei jeder Nachricht bezahlt.
  • Dieselbe Aufgabe, langer Verlauf, und der Thread ist immer noch wichtig: /compact mit Fokusanweisungen, bei einer natürlichen Pause, z. B. einer abgeschlossenen Unteraufgabe, nicht mitten in einem Schritt.
  • Ein Teil der Sitzung ist unnötiger Ballast: /rewind. Wählen Sie eine Nachricht vor einer falschen Abzweigung aus und wählen Sie „Restore conversation“, um sie zu löschen und dabei Ihren Code beizubehalten, oder wählen Sie „Summarize up to here“, um alles Ältere zu komprimieren und die letzten Nachrichten intakt zu halten.
  • Zwei fehlgeschlagene Korrekturen zum gleichen Problem: /clear und wiederholen Sie die Aufgabe mit dem, was Sie gelernt haben. Anthropic rät, dass eine saubere Sitzung mit einer besseren Eingabeaufforderung fast immer eine lange Sitzung voller Korrekturen übertrifft.
  • Eine Nebenfrage: /btw, deren Antwort nie in den Gesprächsverlauf eingeht.
  • Unsicher: /clear ist der billigere Fehler. Es kostet nichts und /resume bringt die alte Konversation zurück.

Die Gewohnheit, die beides übertrifft: eine Sitzung pro Aufgabe

Beide Befehle helfen, einen zu langen Verlauf zu verkürzen. Die günstigere Angewohnheit besteht darin, sie nicht zu benötigen: ein Gespräch pro Aufgabe, begonnen, wenn die Aufgabe beginnt, und beendet, wenn sie endet.

Was auch immer das Gespräch überdauern muss, gehört in eine Datei, nicht in den Verlauf: Regeln in CLAUDE.md, die nach jedem /clear und jeder Komprimierung neu geladen werden, und der Status einer langen Arbeit in einer Notizdatei, die Sie Claude schreiben lassen, bevor Sie sie löschen. Das Schreiben kostet wie eine Komprimierung eine Runde, aber Sie entscheiden, was es behält, und es überlebt die Sitzung.

Wenn Sie diese Arbeitsweise nicht jedes Mal selbst durchsetzen möchten, steuert capsul die Claude-Code-CLI, bei der Sie bereits angemeldet sind. Jeder Aufruf von capsul ask ist eine eigene Aufgabe unter einem Tokenbudget, das Sie festlegen. Es sendet, was die Aufgabe braucht, und meldet, was wegen des Budgets weggelassen wurde.

capsul ask 'fix the flaky checkout test' --budget 3000

Eine Aufgabe pro Befehl, unter einer von Ihnen festgelegten Obergrenze.

Fragen

Sollte ich /compact oder /clear in Claude Code verwenden?

Verwenden Sie /clear, wenn die nächste Aufgabe bisher nichts mit der Konversation zu tun hat: Sie kostet nichts, gibt Claude einen sauberen Kontext und die alte Konversation bleibt über /resume verfügbar. Verwenden Sie /compact, wenn Sie mitten in einer Aufgabe sind und der Verlauf immer noch wichtig ist, idealerweise in einer natürlichen Pause und mit Fokusanweisungen wie /compact focus on the auth bug fix. Im Zweifelsfall ist /clear der günstigere Fehler.

Verwendet /compact Token?

Ja. Um die Zusammenfassung zu schreiben, sendet Claude Code eine separate Anfrage, die die gesamte Konversation sowie eine Zusammenfassungsanweisung enthält, und die Zusammenfassung kommt als Ausgabetoken zurück. Während der Sitzung werden die meisten dieser Eingaben mit reduzierter Rate aus dem Prompt-Cache gelesen, aber nach einer Pause, die länger als die Cache-Lebensdauer ist, wird der gesamte Verlauf erneut verarbeitet, sodass das Komprimieren einer frisch wiederaufgenommenen Sitzung am meisten kostet. Spätere Anfragen sind günstiger, da sie die Zusammenfassung anstelle der Historie enthalten.

Wann komprimiert Claude Code automatisch?

Die automatische Komprimierung ist standardmäßig aktiviert und wird ausgeführt, wenn sich die Konversation dem automatischen Komprimierungsfenster nähert, das sich standardmäßig in der Nähe des vollständigen Kontextfensters des Modells befindet. Mit Stand September 2026 gibt die Dokumentation etwa 967.000 Token für Modelle an, die mit einem Fenster von einer Million Token auf der Anthropic API laufen. /autocompact legt eine andere Größe fest und die Einstellung „Auto-Compact“ in /config schaltet den automatischen Durchgang aus, während /compact verfügbar bleibt.

Löscht /clear CLAUDE.md oder meine vorherige Konversation?

Nein. /clear leert die Konversation, nicht das Projekt: CLAUDE.md und lädt den Speicher erneut automatisch zu Beginn der neuen Konversation. Die vorherige Konversation wird lokal gespeichert und von /resume erneut geöffnet. Durch die Übergabe eines Namens wie in /clear release-prep wird sie zuerst in der Auswahl beim Fortsetzen gekennzeichnet.

Wie kann ich sehen, wie voll das Claude Code-Kontextfenster ist?

Führen Sie /context aus, das die aktuelle Nutzung als farbiges Raster nach Kategorie anzeigt und Vorschläge macht, wenn etwas zu viel Platz beansprucht. Für eine kontinuierliche Lesung richten Sie eine Statuszeile ein, die context_window.used_percentage anzeigt; /statusline kann eines für Sie konfigurieren. /usage zeigt, was die Sitzung ausgegeben hat und wo Sie im Vergleich zu Ihren Plangrenzen stehen, was eine andere Messung darstellt.

$ npm i -g @penra/capsul

← Alle Ratgeber