Mesure des dépenses de tokens hors tâche dans Claude Code : la métrique 'Intention non déclarée'

✍️ OpenClawRadar📅 Publié: May 11, 2026🔗 Source
Mesure des dépenses de tokens hors tâche dans Claude Code : la métrique 'Intention non déclarée'
Ad

Un développeur créant des hooks personnalisés pour Claude Code a conçu une métrique appelée dépense d'intention non déclarée pour mesurer l'utilisation de tokens en dehors de l'objectif déclaré.

Résultats clés

  • Lors d'une session, le calcul total était de 5 137 tokens, dont 1 173 (22,8 %) classés comme non déclarés et 3 964 (77,2 %) comme déclarés.
  • La dépense non déclarée capture le coût des tentatives, des boucles, des dérives de raisonnement et des exécutions hors tâche — pas seulement les violations de gouvernance.
  • La métrique traite le coût comme un signal comportemental, pas seulement comme une télémétrie de facturation.
Ad

Défi d'implémentation

La surface du hook n'expose pas toujours suffisamment de contexte pour distinguer la véritable dérive d'une intention indéterminable. L'auteur note deux modes d'échec distincts : la véritable dérive (déplacement vers des fichiers/systèmes non liés) vs indéterminable à partir des données du hook. Des réponses différentes sont nécessaires selon le mode.

Exemple de format de sortie :

Calcul total 5 137 tokens
Non déclarés 1 173 tokens (22,8 %)
Déclarés 3 964 tokens (77,2 %)

Aucun outil ni bibliothèque n'est partagé dans la source ; le post est une invitation à la discussion. L'auteur se demande si d'autres mesurent le calcul hors tâche ou traitent encore la dépense de tokens uniquement en termes de facturation/optimisation.

Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Exécuter NemoClaw avec vLLM Local : Notes de Configuration et Observations sur l'Ingénierie d'Agents
Tools

Exécuter NemoClaw avec vLLM Local : Notes de Configuration et Observations sur l'Ingénierie d'Agents

Un développeur a documenté l'exécution de la plateforme d'agents IA sandbox NemoClaw de NVIDIA avec un modèle local Nemotron 9B v2 via vLLM sur WSL2. Les principales découvertes incluent des détails sur le routage de l'inférence, des problèmes de compatibilité des analyseurs et des observations sur l'écart en ingénierie des agents.

OpenClawRadar
Echo-TTS Porté sur Apple Silicon avec MLX pour une Synthèse Vocale Native avec Clonage de Voix
Tools

Echo-TTS Porté sur Apple Silicon avec MLX pour une Synthèse Vocale Native avec Clonage de Voix

Echo-TTS, un modèle de synthèse vocale par diffusion de 2,4 milliards de paramètres avec clonage vocal, a été adapté de CUDA pour fonctionner nativement sur les puces Apple de série M grâce à MLX. Sur un Mac mini M4 de base avec 16 Go de RAM, un clonage vocal de 5 secondes prend environ 10 secondes à générer, tandis que des clones de 30 secondes prennent environ 60 secondes.

OpenClawRadar
DeepSeek V4 Flash offre une qualité proche d'Opus pour les LLM locaux sur site
Tools

DeepSeek V4 Flash offre une qualité proche d'Opus pour les LLM locaux sur site

Un utilisateur de Reddit rapporte que DeepSeek 4 Flash atteint des performances proches d'Opus pour les agents IA locaux sur des données confidentielles, permettant un déploiement sur site sans AWS. Fonctionnant localement avec des GPU NVIDIA, mais encore lent à 1M tokens.

OpenClawRadar
PayClaw lance un bac à sable pour serveur MCP de paiement avec des cartes Visa virtuelles
Tools

PayClaw lance un bac à sable pour serveur MCP de paiement avec des cartes Visa virtuelles

PayClaw a lancé un environnement sandbox pour son serveur MCP de paiement, proposant des cartes Visa virtuelles verrouillées par marchand avec une expiration de 15 minutes, une approbation humaine par transaction protégée par MFA, et une déclaration d'intention avant l'émission de la carte. Les cartes de production sont prévues pour le 4 mars.

OpenClawRadar