Claude Code : choisir entre /compact et /clear
`/clear` repart d'un contexte vide sans coût. `/compact` conserve un résumé de la conversation, mais sa rédaction exige une requête portant sur tout l'historique accumulé.
/clear ouvre une nouvelle conversation au contexte vide. /compact garde la conversation en cours, mais remplace son historique par un résumé. La règle en découle : /clear pour une autre tâche, /compact quand vous poursuivez la même et que son historique compte encore.
Ces deux commandes répondent au même problème : une session Claude Code qui s'allonge coûte davantage et devient moins fiable. Elles prennent des chemins opposés et n'ont pas le même prix.
Ce que chaque commande fait au contexte
/clear termine la conversation et en ouvre une nouvelle sans historique. La mémoire du projet vit en dehors de ce fil : CLAUDE.md et la mémoire automatique se chargent de nouveau au début de la conversation.
Rien n'est supprimé. L'ancien fil est enregistré, /resume le rouvre, et un nom comme /clear release-prep l'étiquette dans le sélecteur de reprise. /reset et /new sont des alias.
/clearUn nouveau fil au contexte vide ; l'ancien reste accessible par /resume.
/compact remplace l'historique des messages par un résumé structuré et poursuit la session. Selon la documentation de Claude Code, ce résumé retient vos demandes, les notions techniques importantes, les fichiers examinés ou modifiés avec leurs extraits utiles, les erreurs et leurs corrections, ainsi que le travail restant. Les sorties complètes des outils et les raisonnements intermédiaires disparaissent. Des consignes données seulement dans la conversation peuvent disparaître aussi.
Certains éléments sont reconstruits plutôt que résumés : CLAUDE.md à la racine et la mémoire automatique sont relus sur disque ; jusqu'à cinq fichiers lus ou modifiés reviennent, les plus récemment changés d'abord ; les skills invoqués sont réinjectés sous un plafond de taille. Les règles liées à des chemins et les CLAUDE.md de sous-répertoires sont résumés jusqu'à la prochaine lecture d'un fichier concerné.
/compact focus on the auth bug fixLa consigne précise ce que le résumé doit conserver.
Pour garder cette consigne, ajoutez une section # Compact instructions au CLAUDE.md du projet, par exemple pour préserver systématiquement la liste des fichiers modifiés et les commandes de test.
Pourquoi une longue session coûte plus cher à chaque tour
Le modèle ne conserve rien entre deux requêtes. À chaque message, Claude Code crée un nouvel appel API et renvoie tout le contexte : prompt système, contexte du projet, messages et résultats d'outils antérieurs, puis votre nouveau message. Chaque usage d'outil provoque un autre appel portant à nouveau toute la conversation. Une question d'une ligne tard dans la session transporte donc toutes les lignes précédentes.
Le cache des prompts atténue le prix sans le supprimer. La partie inchangée est relue à une fraction du tarif normal de l'entrée, un dixième ou moins sur les modèles Claude actuels en septembre 2026. Une fraction d'un grand total, payée à chaque requête, continue pourtant de croître. Sur un abonnement, elle pèse aussi sur les limites d'usage.
Le cache expire. En septembre 2026, sa durée est d'une heure sur un abonnement et de cinq minutes par défaut avec une clé API. Après une pause plus longue, la première requête retraite tout l'historique.
Le coût n'est pas la seule dégradation. Le guide de bonnes pratiques de Claude Code indique que les performances baissent quand la fenêtre se remplit : Claude peut oublier des consignes anciennes ou faire plus d'erreurs. Un historique chargé de tentatives ratées accentue cette dégradation du contexte.
Ce que coûtent réellement /compact et /clear
/clear ne coûte rien. La documentation des coûts de Claude Code le dit explicitement : si vous voulez repartir plutôt que conserver le fil, cette commande est gratuite. Le premier message suivant transporte seulement la part fixe du contexte, dont le prompt système, les outils, CLAUDE.md et la mémoire, plus votre nouvelle demande.
/compact est une requête au modèle, parfois grosse. Pour écrire le résumé, Claude Code envoie le même prompt système, les mêmes outils et tout l'historique, puis une consigne de synthèse. L'entrée contient donc tout ce que la session a accumulé. La sortie est le résumé, et les tokens de sortie sont les plus chers.
Le moment compte. Pendant une session active, le cache relit l'historique à tarif réduit : selon la documentation, le coût est alors une fraction de ce que laisse penser sa taille. Après une pause au-delà de la durée du cache, tout l'historique est retraité sans remise. Compacter juste après avoir repris une longue session est le cas le plus coûteux.
En échange, les requêtes suivantes ne portent plus que le résumé. Le compactage devient rentable si la session continue assez longtemps et si le détail écarté n'est plus utile. Pour abandonner entièrement une fausse piste, /rewind coûte encore moins : il revient à un préfixe de conversation déjà en cache.
Quand le compactage automatique se déclenche
Il est actif par défaut. Quand la conversation approche de la limite, Claude Code efface d'abord d'anciennes sorties d'outils, puis résume le fil si cela ne suffit pas, comme le ferait /compact. Il empêche la session de s'arrêter lorsque la fenêtre est pleine, sans rendre les tours précédents bon marché.
Par défaut, il intervient tard. En septembre 2026, la documentation indique une intervention près de la limite du modèle, autour de 967 000 tokens pour les modèles à fenêtre d'un million de tokens sur l'API Anthropic, notamment Sonnet 5, Fable et Opus 4.7 et suivants. Le seuil exact dépend du modèle, du fournisseur et des réglages. À ce stade, chaque requête antérieure a déjà porté l'historique croissant, et le résumé lui-même lit une fenêtre presque pleine, parfois au milieu d'une tâche.
Vous pouvez changer ce seuil : /autocompact 500k fixe la taille visée et /autocompact auto rétablit le réglage du modèle. Il faut Claude Code v2.1.221 ou plus récent. L'option Auto-compact de /config désactive le passage automatique ; /compact reste disponible manuellement.
Voir le remplissage du contexte
/context affiche l'usage actuel par catégorie dans une grille colorée, avec les fichiers CLAUDE.md et de mémoire chargés, ainsi que des suggestions quand un élément occupe trop de place. Consultez-le avant de choisir.
/contextMontre ce que contient la fenêtre et ce qui prend de la place.
Pour suivre un pourcentage en continu, ajoutez-le à votre barre d'état : /statusline peut la configurer à partir d'une description et un script peut lire directement context_window.used_percentage. /usage répond à une autre question : ce que la session a dépensé et votre position par rapport aux limites du plan.
Quelle commande choisir
- La prochaine tâche est sans rapport :
/clear. L'ancien fil écarterait les fichiers nécessaires à la nouvelle et serait repayer à chaque message. - Même tâche, long historique toujours utile :
/compactavec une consigne ciblée, à la fin d'une étape plutôt qu'au milieu. - Une partie de la session est inutile :
/rewind. Choisissez un message avant la fausse piste puis Restore conversation pour retirer le fil sans toucher au code, ou Summarize up to here pour condenser l'ancien et garder les messages récents. - Deux corrections ratées sur le même problème :
/clear, puis reformulez la tâche avec ce que vous avez appris. Anthropic recommande une session neuve et une meilleure demande plutôt qu'un long fil de corrections. - Une question annexe :
/btw. Sa réponse n'entre pas dans l'historique. - Un doute :
/clearest l'erreur la moins chère. La commande est gratuite et/resumeretrouve l'ancien fil.
Une habitude plus simple : une session par tâche
Ces deux commandes réparent une session devenue longue. Le réflexe le moins coûteux reste une conversation par tâche, ouverte quand le travail commence et refermée lorsqu'il se termine.
Ce qui doit survivre à la conversation appartient à un fichier : les règles dans CLAUDE.md, rechargé après /clear et chaque compactage, et l'état d'un long travail dans des notes que vous demandez à Claude d'écrire avant de repartir. Cela coûte un tour, comme un compactage, mais vous décidez ce qui reste et les notes survivent à la session.
Si vous voulez appliquer ce découpage sans devoir y penser, capsul pilote le Claude Code auquel vous êtes déjà connecté et traite chaque capsul ask comme une tâche sous le budget de tokens que vous fixez. Il envoie ce que demande la tâche et s'arrête au plafond en indiquant ce qui a été laissé de côté.
capsul ask 'fix the flaky checkout test' --budget 3000Une tâche par commande, sous un plafond choisi.
Questions
Faut-il utiliser /compact ou /clear dans Claude Code ?
Utilisez /clear si la tâche suivante n'a pas de lien avec la conversation : c'est gratuit et l'ancien fil reste récupérable avec /resume. Utilisez /compact si vous poursuivez la même tâche et avez besoin de son historique, de préférence à une étape naturelle avec une consigne ciblée. En cas de doute, /clear est le choix le moins coûteux.
La commande /compact consomme-t-elle des tokens ?
Oui. Claude Code envoie une requête distincte contenant toute la conversation et une consigne de synthèse, puis reçoit le résumé comme sortie. Au cours d'une session active, le cache réduit le prix de l'entrée. Après une pause assez longue pour l'expirer, tout l'historique est retraité, ce qui rend le compactage d'une session fraîchement reprise plus cher.
Quand Claude Code compacte-t-il automatiquement ?
Le compactage automatique est activé par défaut et intervient lorsque la conversation approche de la limite de contexte. En septembre 2026, la documentation indique environ 967 000 tokens pour les modèles dotés d'une fenêtre d'un million sur l'API Anthropic. /autocompact change le seuil ; l'option Auto-compact de /config désactive l'automatisme tout en conservant /compact.
La commande /clear supprime-t-elle CLAUDE.md ou l'ancien fil ?
Non. Elle vide la conversation, pas le projet : CLAUDE.md et la mémoire automatique sont chargés à nouveau. L'ancien fil est enregistré localement et /resume le rouvre. Un nom comme /clear release-prep l'étiquette dans le sélecteur de reprise.
Comment voir si le contexte de Claude Code est plein ?
Lancez /context pour voir l'usage par catégorie et les éléments qui prennent trop de place. Pour un suivi permanent, affichez context_window.used_percentage dans une barre d'état configurée avec /statusline. /usage montre les dépenses et les limites du plan, une autre mesure.
$ npm i -g @penra/capsul