Fait partie du pilier réduire l'usage des tokens dans Claude Code. Cette page oppose les deux installations les plus légères d'ici.
À lire aussi :
caveman ou tokensave : lequel choisir ?
tokensave, pour du travail de code agentique — parce qu'il est du côté entrant, et que c'est là que sont les tokens. caveman compresse la parole du modèle. tokensave donne à l'agent un index de symboles pour qu'il cesse d'ouvrir des fichiers afin de trouver quelque chose. Le trafic entrant domine typiquement le sortant d'environ un ordre de grandeur en agentique : les deux ne jouent donc pas la même mise. Cela dit, caveman embarque un composant qui tombe exactement sur les frais fixes de tokensave, et c'est la chose la plus intéressante de cette page. Voir plus bas. Je maintiens un benchmark ouvert de sessions longues et je vends un outil concurrent. caveman n'y montre aucune économie de coût de session mesurable ; tokensave n'a pas été mesuré et ne publie aucun benchmark.Que fait tokensave exactement ?
Il construit un index de symboles et le sert en MCP. Un serveur Rust avec un graphe de connaissances sémantique en libSQL et FTS5, bâti par extraction tree-sitter sur 34 langages, exposant 48 outils MCP. Ce qui le distingue :- Compilé. Démarrage rapide, mémoire faible, aucun runtime à installer. Homebrew sur macOS, Scoop sur Windows, binaires précompilés ailleurs.
- Indexation multi-branches. Comparer et chercher entre branches sans changer de checkout — rien d'autre dans la catégorie ne le fait, et cela supprime une classe d'allers-retours
git checkoutcoûteux en contexte. - Isolation par sous-processus. Un parseur qui plante sur un fichier malformé n'emporte pas le service, ce qui compte avec 34 grammaires en jeu.
- Primitives d'édition atomiques avec réécriture AST. L'agent renomme un symbole via l'arbre plutôt que via une regex, ce qui évite les pièges d'échappement shell et de correspondance partielle qui font échouer les éditions agentiques en silence.
Que fait caveman exactement ?
Il bascule le modèle en parole télégraphique. Un skill ou plugin JavaScript pour plus de 30 agents, à quatre niveaux —lite, full, ultra, wenyan — déclenchés par /caveman. Détection automatique sur Claude Code, Codex, Gemini, Cursor, Windsurf, Cline et Copilot ; installation en un curl ou irm de 30 secondes ; badge de statusline affichant les économies cumulées.
Son benchmark est honnête d'une façon rare dans la catégorie : 65 % de réduction de sortie en moyenne, fourchette 22–87 %, mesuré sur les reçus bruts de l'API Claude contre une base déjà concise.
Et il embarque deux outils côté entrée :
caveman-shrink, un middleware MCP qui enveloppe n'importe quel serveur MCP et compresse ses descriptions d'outils.caveman-compress, qui réécritCLAUDE.mdet les fichiers de mémoire en forme télégraphique — environ 46 % d'économie d'entrée sur un fichier renvoyé à chaque tour.
Où se rejoignent-ils réellement ?
caveman-shrink peut envelopper tokensave, et tokensave est l'outil de la catégorie qui en a le plus besoin.
tokensave expose 48 outils MCP. Leurs définitions sont envoyées en tokens d'entrée avant votre premier message, à chaque tour, que l'agent interroge l'index une seule fois ou pas du tout. C'est le plus gros coût de manifeste permanent de tous les outils de cet ensemble, et le reporting de tokensave n'en dit rien.
caveman-shrink existe précisément pour compresser ces descriptions. L'association n'est donc pas « un outil de sortie plus un outil d'entrée » — c'est un outil qui rembourse une partie des frais fixes de l'autre. Si vous utilisez tokensave, caveman-shrink vaut l'installation même si vous n'activez jamais le style de parole caveman.
C'est la raison concrète et vérifiable de lire au-delà du titre des deux projets.
De quel côté de la facture êtes-vous ?
Mesurez-le ; ne le supposez pas. Une semaine avecnpx ccusage@latest vous donne un ratio entrée/sortie, et ce ratio décide de l'essentiel de cette page :
- L'entrée domine d'un facteur 10 — le cas habituel en code agentique. tokensave est du bon côté ; le style de caveman est une erreur d'arrondi, même si
caveman-shrinks'applique toujours. - La sortie est une vraie part — travail de type chat, longues explications générées, code écrit de zéro. Les 65 % de caveman deviennent un chiffre qui vaut la peine, et la sortie est facturée plus cher au token.
Que ne fait ni l'un ni l'autre ?
- Les sorties de commandes en limite d'outil. tokensave ne les voit jamais ; caveman régit la parole du modèle, pas les résultats d'outils.
- Les lectures de fichiers entiers pour éditer. Un index dit quel fichier ; rien ici ne réduit le fichier que l'agent ouvre ensuite.
- Les relectures. Même fichier, quatre fois, quatre facturations. Un index en réduit la probabilité ; aucun ne déduplique.
- L'historique de conversation. Aucun ne compresse la fenêtre, qui sur une session longue est la plus grosse accumulation.
Lequel choisir ?
Prenez tokensave si vous travaillez sur de nombreux langages, relisez souvent des branches, ou voulez le chemin d'édition plus sûr qu'offre la réécriture AST. C'est aussi celui des deux qui change ce que l'agent lit plutôt que ce qu'il dit. Prenez caveman si votre travail est riche en sortie, ou spécifiquement pourcaveman-shrink — qui vaut la peine en toutes circonstances, et doublement à côté d'un serveur MCP à 48 outils.
Prenez les deux si vous utilisez tokensave et voulez faire baisser son coût de manifeste. C'est l'argument le plus fort de cette page.
Comment appliquer ça aujourd'hui
- Obtenez d'abord votre ratio entrée/sortie. Une commande, et la question du style est réglée.
- Si vous installez tokensave, comptez les appels d'outils avant et après — c'est la métrique qu'un index déplace.
- Installez
caveman-shrinkà côté. Un manifeste de 48 outils est facturé à chaque tour et rien dans tokensave ne s'en occupe. - Déconnectez l'index sur les sessions purement terminal. Vous payez le manifeste pour rien.
Ce qui tourne mal (anti-patterns)
Installer le style de caveman sur une charge agentique parce que 65 % paraît gros. Gros pourcentage, petit canal. Laisser un manifeste de 48 outils connecté par habitude. Il est facturé à chaque tour, y compris ceux qui n'interrogent jamais l'index. Prendre « non benchmarké » pour « ne marche pas ». tokensave ne publie aucun chiffre ; c'est une preuve manquante, pas la preuve d'un échec. Passer enultra sur du travail que vous devez comprendre. Le readme prévient de la dégradation du raisonnement nuancé.
À lire aussi :
- Réduire l'usage des tokens dans Claude Code — le pilier, indépendant de l'outil
- tokensave vs codegraph — tokensave face à l'autre index de code
- rtk vs caveman — caveman face à un filtre de sorties shell
- codegraph vs caveman — la même question avec l'autre index
- Benchmark des optimiseurs de tokens — la mesure ouverte derrière le résultat de caveman
Classé n°1 au Token-Harness Optimizer Leaderboard.
Tokenade est classé n°1 au Token-Harness Optimizer Leaderboard — un benchmark de bout en bout des optimiseurs de tokens, mesuré sur de vraies sessions de code. Installez-le une fois, il agit sur chaque prompt. Compatible avec Claude Code, Cursor, Codex, Copilot et plus.























