bunx ccusage affiche 18 450 $ de crédits brûlés — les forfaits plats absorbent le coût

Un utilisateur de Reddit sur r/ClaudeAI a exécuté bunx ccusage monthly -s 20260501 --all et a découvert qu'il avait brûlé 18 450,29 $ de crédits en mai — pour un abonnement à prix fixe de 200 €/mois pour Claude Code et 200 €/mois pour Codex (400 € au total). L'outil a calculé 248M tokens en entrée, 42M tokens en sortie et 21,7B tokens au total en comptant les lectures cache.
Ce que montre bunx ccusage
La commande bunx ccusage@latest récupère les données d'utilisation réelles depuis l'historique de l'API d'Anthropic. Dans ce cas, le projet secondaire de l'utilisateur — développé le soir, le week-end et tôt le matin — a consommé bien plus que ce que couvre l'abonnement. Il a noté : « donc côté utilisation réelle, ils perdent littéralement de l'argent avec moi, je pense. »
Forfaits fixes vs. paiement à l'utilisation
Les forfaits fixes Claude Code à 200 € et Codex à 200 € sont actuellement subventionnés, comme le reconnaît l'utilisateur : « les abonnements sont payés avec l'argent des VC pour le moment. » Une telle consommation coûterait 18 450 $ en paiement à l'utilisation. Si Anthropic ajuste les prix ou supprime les options fixes, les gros utilisateurs comme celui-ci pourraient faire face à des augmentations importantes.
Comment vérifier votre propre utilisation
Exécutez ceci dans votre terminal :
bunx ccusage@latestOu pour un mois spécifique :
bunx ccusage monthly -s YYYYMMDD --allSi vous êtes sur un forfait fixe, ça vaut le coup de vérifier — surtout si vous utilisez Claude intensément en dehors des heures de travail.
Qui devrait s'y intéresser
Les développeurs abonnés aux forfaits fixes de Claude qui veulent connaître leur consommation réelle avant d'éventuels changements de tarifs. Utile aussi pour les équipes négociant des offres entreprise.
📖 Lire la source originale : r/ClaudeAI
👀 See Also

Outil RAG Local Construit avec Nemotron Nano 9B v2 et Appel d'Outils vLLM
Un développeur a créé un outil de recherche RAG local-first qui fonctionne entièrement sur un seul GPU en utilisant Nemotron Nano 9B v2 Japanese sur vLLM avec des plugins d'analyse personnalisés pour l'appel d'outils. Le système présente un flux en deux étapes d'extraction-exécution avec extraction de mots-clés bilingues et recherche parallèle FTS5/DuckDuckGo.

La bifurcation vllm-mlx ajoute l'appel d'outils et le cache de prompts pour les agents d'IA de codage locaux.
Un développeur a modifié vllm-mlx pour corriger les problèmes d'appel d'outils et ajouter la mise en cache des invites, réduisant le TTFT de 28s à 0,3s pour OpenClaw sur Apple Silicon. Le fork prend en charge Qwen3-Coder-Next à 65 tok/s sur M3 Ultra avec un appel de fonction fonctionnel.

ClawVibe : Un assistant vocal mains libres iOS pour agents IA avec STT/TTS intégré
ClawVibe est une application iOS native qui offre une interaction vocale mains libres avec des agents IA pendant les trajets. Elle utilise la reconnaissance vocale et la synthèse vocale sur l'appareil, prend en charge CarPlay et inclut la biométrie vocale pour filtrer le bruit de fond. Seul le texte est envoyé sur le réseau.

Compétence OpenClaw Réduit le Transfert d'Agent en Permettant l'Exécution Automatique
Une nouvelle compétence pour les agents OpenClaw aborde le problème courant où les agents identifient l'étape suivante mais s'arrêtent à 'voici ce qu'il faut faire ensuite', nécessitant un transfert à un humain. La compétence permet aux agents d'effectuer certaines actions eux-mêmes, comme s'inscrire, publier, répondre et signer.