Claudetop : Surveillance des Coûts en Temps Réel pour les Sessions de Code Claude

Claudetop : Surveillance des Coûts en Temps Réel pour les Sessions Claude Code
Claudetop est un outil de surveillance pour Claude Code qui affiche le suivi des coûts en temps réel, les métriques d'efficacité du cache et les comparaisons de modèles pendant les sessions de codage. L'outil a été créé après que le développeur a remarqué une divergence où les estimations du modèle indiquaient 10 $ mais que la facturation réelle était de 65 $, avec la compaction masquant 80 % de l'utilisation des tokens.
Options d'Installation
Trois méthodes d'installation sont disponibles :
- Cloner et installer :
git clone https://github.com/liorwn/claudetop.gitpuiscd claudetop && ./install.sh - En une ligne :
curl -fsSL https://raw.githubusercontent.com/liorwn/claudetop/main/install.sh | bash - En tant que plugin Claude Code :
claude plugin marketplace add liorwn/claudetoppuisclaude plugin install claudetop
L'installation du plugin fournit automatiquement le hook SessionEnd ainsi que les commandes slash : /claudetop:stats, /claudetop:dashboard, /claudetop:branch, /claudetop:export et /claudetop:pricing.
Informations Affichées
Pendant les sessions, Claudetop affiche :
- L'emplacement et la profondeur du projet actuel
- Le modèle actif et la durée de la session
- Le coût actuel, le taux de consommation horaire et le coût mensuel projeté
- Le pourcentage d'efficacité du cache et le coût par ligne
- Les coûts comparatifs pour d'autres modèles (Opus, Sonnet, Haiku)
- La répartition des tokens : pourcentages d'entrée/sortie avec les catégories fresh, cwrite et cread
Fonctionnalités Clés
Suivi des coûts en temps réel : Affiche le coût réel de la session (en vert), le taux de consommation horaire et la prévision mensuelle extrapolée à partir de l'historique. Les tarifs sont mis à jour automatiquement depuis pricing.json lorsque Anthropic modifie les prix.
Comparaison des coûts des modèles : Affiche ce que coûterait la session sur Opus, Sonnet ou Haiku avec des tarifs prenant en compte le cache qui tiennent compte du taux réel de succès du cache. Le modèle actuel est mis en gras pour une comparaison instantanée.
Surveillance de l'efficacité du cache : Le taux de succès du cache indique l'efficacité : vert (≥60 %) signifie que la plupart des tokens d'entrée sont réutilisés, rouge (<30 %) indique que quelque chose force des relectures complètes.
Alertes Intelligentes
Les alertes n'apparaissent que lorsque l'attention est nécessaire :
- JALON 5 $ / 10 $ / 25 $ : Jalon de coût franchi - vérification rapide de la valeur
- DÉPASSEMENT DE BUDGET : Budget quotidien dépassé - terminer ou changer de modèle
- ENVISAGER UNE NOUVELLE SESSION : >2h + >60 % de contexte - rendements décroissants
- FAIBLE CACHE : <20 % de cache après 5 min - le contexte a été réinitialisé, les tokens sont relus
- TAUX DE CONSOMMATION : >15 $/h de vélocité - sous-agents incontrôlés ou boucles serrées
- EN BOUCLE ? : >1 $ dépensé, aucune sortie de code - bloqué dans une boucle de recherche
- ESSAYER /fast : >0,05 $/ligne sur Opus - la tâche n'a pas besoin du plus gros modèle
- COMPACTER BIENTÔT : Fenêtre de contexte >80 % pleine - compaction automatique imminente
Historique et Analyse des Sessions
Chaque session est automatiquement enregistrée. Utilisez claudetop-stats avec divers arguments :
claudetop-stats- Résumé du jourclaudetop-stats week- Cette semaineclaudetop-stats month- Ce mois-ciclaudetop-stats all- Toutes les sessionsclaudetop-stats tag auth- Filtrer par étiquette
Cet outil est destiné aux développeurs utilisant Claude Code qui souhaitent une visibilité sur leurs habitudes de dépenses en IA et veulent optimiser l'utilisation des modèles et l'efficacité du cache.
📖 Read the full source: HN AI Agents
👀 See Also

Outil RAG Local Construit avec Nemotron Nano 9B v2 et Appel d'Outils vLLM
Un développeur a créé un outil de recherche RAG local-first qui fonctionne entièrement sur un seul GPU en utilisant Nemotron Nano 9B v2 Japanese sur vLLM avec des plugins d'analyse personnalisés pour l'appel d'outils. Le système présente un flux en deux étapes d'extraction-exécution avec extraction de mots-clés bilingues et recherche parallèle FTS5/DuckDuckGo.

Le chemin rapide de recherche de mémoire QMD d'OpenClaw présentait des bogues silencieux
La recherche en mémoire intégrée d'OpenClaw utilise une correspondance de mots-clés basique, mais les utilisateurs peuvent passer à QMD pour une recherche sémantique dans les fichiers markdown de l'espace de travail. Un chemin rapide via MCPorter était cassé avec trois bogues provoquant l'échec silencieux de chaque appel et le retour à une exécution CLI plus lente.

Claude Code v2.1.59 ajoute la mémoire automatique, la commande de copie et des améliorations du shell.
Claude Code v2.1.59 introduit la sauvegarde automatique du contexte dans la mémoire automatique avec la gestion de /memory, ajoute une commande /copy pour la sélection interactive des blocs de code, et améliore les suggestions de préfixes pour les commandes bash composées.

Protocole Agent Browser : un fork open-source de Chrome pour les agents IA atteint 90 % au benchmark Mind2Web
Agent Browser Protocol (ABP) est un fork open-source de Chrome qui gèle JavaScript et le temps après chaque action pour convertir la navigation web en chat multimodal pour les agents IA. Il a obtenu 90,53 % sur le benchmark Online Mind2Web et peut être ajouté à Claude Code avec une seule commande.