L'analyse de 100 millions de tokens dans Claude Code révèle une utilisation de 99,4 % des entrées.

✍️ OpenClawRadar📅 Publié: March 9, 2026🔗 Source
L'analyse de 100 millions de tokens dans Claude Code révèle une utilisation de 99,4 % des entrées.
Ad

Répartition de l'utilisation des tokens sur 100 millions de tokens suivis

Une analyse détaillée de l'utilisation de Claude Code a suivi 1 289 requêtes sur des sessions de codage prolongées, totalisant environ 100,9 millions de tokens. La répartition révèle un déséquilibre significatif entre les tokens d'entrée et de sortie.

Répartition des tokens :

  • Tokens d'entrée : 100,3 millions (99,4 % du total)
  • Tokens mis en cache : 84,2 millions (84 % des entrées)
  • Tokens de sortie : 616 000 (0,6 % du total)

Le goulot d'étranglement de la relecture du contexte

Claude Code consacre 99,4 % de son budget de tokens à lire le contexte et seulement 0,6 % à écrire du code. Ce schéma n'est pas spécifique à Claude Code mais reflète le fonctionnement actuel de tous les systèmes de codage agentique. Chaque fois que Claude Code effectue une action — lire un fichier, exécuter une commande, modifier du code — il nécessite que le contexte complet soit réinjecté, y compris la structure du dépôt, l'historique de la conversation, les résultats des outils et les journaux d'erreurs.

Les 84 millions de tokens mis en cache représentent le même contexte réenvoyé 1 289 fois car le modèle n'a pas de mémoire persistante entre les tours. Contrairement aux développeurs humains qui maintiennent un modèle mental de leur base de code, Claude Code suit un schéma de : tout oublier → tout relire → écrire du code → tout oublier à nouveau.

Ad

Limitations de la mise en cache des prompts

La mise en cache des prompts d'Anthropic rend ce processus moins coûteux mais pas plus rapide. Le goulot d'étranglement n'est pas la vitesse d'inférence — c'est la boucle de relecture. L'analyse suggère que le véritable déclencheur pour Claude Code et le codage agentique en général serait une mémoire de projet persistante — pas seulement des faits sauvegardés via des fichiers de mémoire ou CLAUDE.md, mais une compréhension compressée et évolutive de la base de code qui se transmet d'une session à l'autre.

Les systèmes actuels forcent essentiellement l'intelligence par la répétition du contexte au lieu de construire une compréhension. Le jour où cela changera pourrait rendre le codage par IA véritablement plus rapide en éliminant le besoin de traiter les mêmes informations à plusieurs reprises.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Minimax M2.7 et passage à l'échelle de plus de 100 000 instances OpenClaw abordés lors de la session Écosystème
News

Minimax M2.7 et passage à l'échelle de plus de 100 000 instances OpenClaw abordés lors de la session Écosystème

Jim et AndyML ont accueilli l'équipe Minimax pour discuter de Minimax M2.7 et de la manière dont ils ont mis à l'échelle leur environnement d'hébergement pour prendre en charge plus de 100 000 instances OpenClaw. La session a attiré 100 à 110 utilisateurs de Discord et plus de 350 000 spectateurs sur une diffusion simultanée chinoise.

OpenClawRadar
🦀
News

MARCHANDISATION DE L’INTELLIGENCE : EXPLICATION DES ACCORDS CIRCULAIRES SUR L’IA

Le financement circulaire de l'IA (par exemple, OpenAI→serveurs Microsoft, Nvidia→CoreWeave) reflète les marchés de matières premières traditionnels. Pas une bulle, mais un glissement vers l'intelligence en tant que bien fongible.

OpenClawRadar
GitHub Copilot passe à la facturation basée sur l'utilisation par consommation de jetons, remplaçant les requêtes premium le 1er juin 2026
News

GitHub Copilot passe à la facturation basée sur l'utilisation par consommation de jetons, remplaçant les requêtes premium le 1er juin 2026

GitHub Copilot passe des unités de requête premium aux crédits IA GitHub basés sur les tokens, sans changement de prix des formules. Tous les forfaits payants incluent des crédits mensuels égaux au coût de l'abonnement ; toute utilisation supplémentaire est facturée aux tarifs de l'API.

OpenClawRadar
4 mois pour atteindre 950 $MRR en construisant un serveur MCP pour Claude Code Intel
News

4 mois pour atteindre 950 $MRR en construisant un serveur MCP pour Claude Code Intel

Un développeur solo a construit un serveur MCP pour l'intelligence de codebase, atteignant 950 $ MRR en 4 mois avec 54 utilisateurs, travaillant 8 à 10 heures après son travail de jour. Pas de pub, pas de growth hacking — juste Reddit et Medium.

OpenClawRadar