Open-Source-Web-Dashboard verfolgt den Claude-Token-Verbrauch für Remote-Workflows.

Ein Entwickler hat react-ai-token-monitor als Open-Source veröffentlicht, ein webbasiertes Dashboard zur Verfolgung der Claude-Token-Nutzung in Remote- und Headless-Umgebungen. Das Tool wurde entwickelt, weil bestehende Desktop-Überwachungstools für Server-, Dev-Container-, CI- oder SSH-Workflows nicht gut funktionieren.
Wichtige Details
Das Dashboard analysiert lokale ~/.claude/projects/**/*.jsonl-Dateien in Echtzeit mithilfe eines Chokidar-Watchers mit Server-Sent Events (SSE) für Live-Updates. Es berechnet die Kosten basierend auf aktuellen API-Preisen für Opus-, Sonnet- und Haiku-Modelle sowie Cache-Lese-/Schreibvorgängen.
Zu den Funktionen gehören:
- Modellaufschlüsselungen
- Cache-Effizienz-Donut-Diagramme
- GitHub-ähnliche Aktivitäts-Hitmap
- Wöchentliche und monatliche Trends
- 3D-Übersichtsgrafik (reines SVG)
- Dunkles Design
- Keine externen API-Aufrufe – alle Daten bleiben lokal
Die eigenen Nutzungsdaten des Entwicklers aus dem März 2026 zeigten:
- 6,6 Millionen verbrauchte Tokens
- 4.808 US-Dollar Gegenwert zu API-Preisen
- 129 Sitzungen
- Cache-Lesevorgänge dominierten die Nutzung mit 100 % Effizienz an manchen Tagen (über 2,14 Mio. gecachte Tokens)
- Tage mit hoher Token-Nutzung (Spitze: 997.000) waren nicht immer die produktivsten
- Haiku erschien häufiger über den Cache als erwartet
Einrichtung und Nutzung
Um das Tool auszuführen:
npm install && npm run devDer Server bindet an 0.0.0.0 für Netzwerkzugriff von Telefonen oder Browsern. Das Tool ist MIT-lizenziert und wurde mit Claude Code erstellt.
Der Entwickler sucht Feedback der Community zu zusätzlichen Funktionen wie CSV-Export, Limit-Warnungen und Multi-Projekt-Unterstützung.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Mandala v0.3: Open-Source-Runtime für asynchrone Logistik-Telemetrie als OpenTelemetry-Spans zur Agentenargumentation
Mandala v0.3 bietet eine quelloffene Async-Runtime, die Telemetriedaten von Samsara, Descartes, Vizion und FMCSA über Webhooks aufnimmt, Ereignisse als OpenTelemetry-Spans ausgibt und Daten über MCP-Tools für LLM-Agenten bereitstellt.

Codebook-Verlustfreie LLM-Kompression: 10–25 % RAM-Reduzierung durch Bitweise Packung
Ein Entwickler hat einen Proof-of-Concept-Code für verlustfreie LLM-Kompression veröffentlicht, der durch bitweises generisches Packen indizierter Gewichte den Speicherverbrauch um 10-25% reduziert. Die Technik tauscht etwas Inferenzgeschwindigkeit gegen eine kleinere Modellgröße, wodurch größere Modelle auf Hardware mit begrenztem VRAM ausgeführt werden können.

Queuelo: Eine schlanke Genehmigungs-API für LLM-Agenten
Queuelo ist eine einfache API-Schicht, die es LLM-Agenten ermöglicht, vor irreversiblen Aktionen zu pausieren. Agenten senden POST-Anfragen für Aktionen, Sie werden benachrichtigt, um diese zu genehmigen oder abzulehnen, und der Agent erhält die Antwort per Webhook.

BrowserKing: Open-Source Chrome-Erweiterung zur Browsersteuerung über Claude und andere Modelle
BrowserKing ist eine kostenlose, quelloffene Chrome-Erweiterung, die Claude und über 15 weitere Modelle ermöglicht, Ihren Browser von einer Seitenleiste aus zu sehen und zu steuern. Sie macht Screenshots, sendet sie an das Modell und setzt dann Entscheidungen um, um Buttons zu klicken, Formulare auszufüllen, zu scrollen und Tabs zu navigieren.