Ce qui change
Depuis le 12-06-2026, deux projets open source non affiliés que la communauté assemble sous le nom “RTK + Caveman” ont publié des versions le même jour. RTK (Rust Token Killer, rtk-ai/rtk, v0.42.4, Apache 2.0) est un proxy CLI en Rust qui intercepte et comprime les sorties de commandes shell (tests, git, grep, ls) avant qu’elles n’entrent dans le contexte de l’agent - il annonce 60-90 % de réduction côté entrée. Caveman (JuliusBrussee/caveman, v1.9.0, MIT) est un skill/plugin Claude Code qui force le modèle à répondre en fragments télégraphiques côté sortie. Ce sont des outils locaux, pas des modèles ni des services hébergés ; ils se branchent sur Claude Code, Cursor, Gemini CLI et d’autres.
Le schéma
# RTK - côté ENTRÉE : réécrit les sorties d'outils avant le contexte
# (le flag global est -g, ou sa forme longue --global ; la branche d'install est master)
brew install rtk
rtk init -g # Claude Code / Copilot (défaut)
rtk init -g --gemini # Gemini CLI
rtk init -g --agent cursor # Cursor
rtk gain # affiche les tokens économisés
# après init : "git status" est automatiquement réécrit en "rtk git status"
# Caveman - côté SORTIE : comprime le style des réponses générées
/caveman lite # supprime le remplissage
/caveman full # caveman par défaut (~75 % annoncés ; 65 % mesurés)
/caveman ultra # télégraphique
/caveman-stats # tokens réels de la session + économies cumulées
En pratique
# Pile combinée sur une session Claude Code lourde en CLI
rtk init -g # entrée : -80 % sur le tableau RTK
# (ls/tree -80%, grep -80%, cargo test -90%, total ~118k -> ~23,9k tokens)
curl -fsSL https://raw.githubusercontent.com/JuliusBrussee/caveman/main/install.sh | bash
/caveman full # sortie : 65 % en moyenne (plage 22-87 %)
# Vérifier les deux
rtk --version # NB : le README imprime "rtk 0.28.2" en exemple ; l'API donne v0.42.4
/caveman-stats
Impact pour une équipe
Si vos agents tournent sur des workflows CLI denses (suites de tests, git, grep répétés), le coût en tokens vient surtout des sorties d’outils, et RTK l’attaque à la source avec moins de 10 ms de surcoût. Caveman, lui, ne touche qu’aux tokens de sortie et revendique une « précision technique complète » sur le code et les chemins - utile quand un humain relit le diff.