Gaspillage de tokens dans Claude Code : Un auto-audit utilisateur montre que les corrections comportementales surpassent le changement de modèle

Un utilisateur de Reddit a passé une semaine à mesurer où allaient réellement leurs tokens Claude Code, au lieu de simplement se plaindre des changements de prix de mai. Leur conclusion : la plupart des brûlures étaient auto-infligées, et des changements de comportement ont récupéré plus de marge que le changement de modèle n'aurait permis.
Plus grands gains
/clearentre tâches non liées — un contexte obsolète de 200k tokens traînant pour une correction d'une ligne était l'habitude la plus coûteuse.- Faites-lui planifier avant de toucher aux fichiers. Une passe de planification, puis exécutez — moins cher et meilleur qu'une boucle explorer-modifier-explorer.
- Arrêtez de le laisser relire les fichiers qu'il vient de modifier. S'il vient de modifier un fichier, il n'a pas besoin de le rouvrir pour « vérifier ». Dites-le une fois dans vos règles.
- Recherchez avec un sous-agent, pas le fil principal. Grep-et-lire dans un dépôt déverse toute la botte de foin dans votre contexte principal de façon permanente. Un sous-agent ne retourne que la réponse.
- Supprimez les boucles toujours actives et
-pque vous ne surveillez pas. Les agents en arrière-plan brûlant des tokens pendant que vous dormez sont la majorité des factures cauchemardesques.
Aucune de ces corrections n'a nécessité un nouvel abonnement, un wrapper ou un serveur MCP. C'était de la discipline que l'utilisateur admet avoir été trop paresseux pour appliquer quand les limites semblaient infinies.
Le post reconnaît que rien de tout cela ne résout les hausses de prix réelles — cela vous empêche simplement de brûler des tokens supplémentaires par-dessus.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Orchestration multi-agents dans OpenClaw : centraliser les règles, générer des sous-agents
Un utilisateur d'OpenClaw explique comment il est passé d'instructions d'espace de travail dupliquées à un seul agent principal qui génère des sous-agents, imposant des règles architecturales (par exemple, persister les données structurées en .JSON) sur tous les espaces de travail des agents.

10 conseils pratiques pour utiliser Claude Code d'après un utilisateur de Reddit
Un utilisateur de Reddit partage des techniques spécifiques pour Claude Code, notamment l'utilisation de /effort high avec 'ultrathink' pour une réflexion prolongée, la création de branches de conversation isolées avec /fork, et la configuration de crochets personnalisés dans .claude/settings.json.

Les agents travailleurs ne devraient pas écrire directement la mémoire : un modèle Curateur-Agent
Un post Reddit détaille un pattern Memory Curator qui empêche les agents workers d'écrire directement dans la mémoire partagée, en routant les événements via une couche de validation et de cadrage.

Gérer la fenêtre de contexte de code de Claude pour optimiser les coûts et les performances
Un développeur explique que chaque appel API envoie l'intégralité de l'historique de la conversation, ce qui rend l'historique accumulé la partie coûteuse, et partage une méthode de travail consistant à démarrer de nouvelles sessions avec des notes de relais pour réduire les coûts et améliorer la qualité des réponses.