LLMSpend : Traqueur de coûts open-source pour les SDKs Anthropic et OpenAI

Ce que fait LLMSpend
LLMSpend est un package Python qui surveille les coûts d'utilisation des API pour les SDK d'Anthropic et d'OpenAI. Il a été créé car le tableau de bord d'Anthropic ne montre que les dépenses totales sans les détailler par fonctionnalité. L'outil suit les tokens, le coût et la latence par appel, en regroupant les données par fonctionnalité, modèle, utilisateur ou projet.
Comment l'utiliser
Installez-le avec pip install llmspend. L'intégration nécessite seulement deux lignes de code :
from llmspend import monitor
client = monitor.wrap(anthropic.Anthropic(), project="my-app")
Puis ajoutez un paramètre llmspend pour suivre des fonctionnalités spécifiques :
response = client.messages.create(
model="claude-sonnet-4-6",
max_tokens=1000,
messages=[{"role": "user", "content": query}],
llmspend={"feature": "chatbot"}
)
Rapports et tableau de bord
Depuis le terminal, exécutez llmspend stats --last 7d --by feature pour obtenir un résultat comme :
Total: $4.2100 across 847 calls
chatbot 512 $2.8900 1180ms
summarizer 335 $1.3200 640ms
Exécutez llmspend dashboard pour ouvrir un tableau de bord web local sur localhost:8888.
Détails techniques
- Stockage SQLite local — aucun compte nécessaire, aucune donnée ne quitte votre machine
- Fonctionne avec les SDK d'Anthropic et d'OpenAI
- Zéro dépendance (pure bibliothèque standard Python)
- Ne stocke jamais les prompts ou réponses — ne suit que les métriques de coût
- Pas de journalisation de prompts, de traçage ou d'évaluations — se concentre uniquement sur le suivi des coûts
- Sous licence MIT, open source sur GitHub
L'outil a été entièrement construit avec Claude Code en une seule session, Claude ayant écrit la logique de monkey-patching, le moteur de tarification, l'interface en ligne de commande et le tableau de bord web.
📖 Read the full source: r/ClaudeAI
👀 See Also

Documents de développement Brain-MCP - Outils pour Claude IA plutôt que pour les humains
Un développeur mainteneur du serveur Brain-MCP a ajouté une section 'Pour assistants IA' à la documentation avec des instructions comportementales, ce qui a permis à Claude d'utiliser les outils plus intelligemment et d'injecter proactivement du contexte lors des changements de sujets.

Claude Code v2.1.141 : Nouvelles variables d’environnement, amélioration des hooks et corrections de bugs
Anthropic a publié Claude Code v2.1.141 avec de nouvelles variables d'environnement (CLAUDE_CODE_PLUGIN_PREFER_HTTPS, ANTHROPIC_WORKSPACE_ID), le champ terminalSequence pour les hooks, la liste des agents par répertoire de travail, et plus de 20 corrections de bugs.

Utilisateur de Reddit mesure la surcharge des tokens MCP : 67 000 tokens consommés avant toute question
Un développeur a mesuré la surcharge de jetons de son serveur MCP à 67 000 jetons consommés avant même de poser une seule question, avec Playwright MCP utilisant 13 600 jetons et GitHub MCP utilisant 18 000 jetons en veille. Il a remplacé MCP par des compétences et des outils CLI pour réduire les coûts de contexte.

Cadre de Recherche d'Emploi Open-Source Développé en Claude Code
Un développeur a créé un framework open-source de recherche d'emploi dans Claude Code qui gère le profilage structuré, le scraping automatisé des portails d'emploi, l'évaluation de compatibilité et un pipeline d'agents rédacteur-relecteur pour des candidatures personnalisées. Le système s'arrête avant la soumission et nécessite une relecture manuelle.