Reddit-Benutzer misst MCP-Token-Overhead: 67.000 Token verbraucht, bevor überhaupt eine Frage gestellt wird

Messung des MCP-Token-Overheads
Ein Entwickler auf r/ClaudeAI maß den Token-Overhead seiner Model Context Protocol (MCP)-Server und stellte einen erheblichen Kontextverbrauch vor jeglicher Benutzerinteraktion fest.
Wichtige Erkenntnisse aus der Messung
Der Entwickler berichtete:
- 67.000 Token wurden verbraucht, bevor auch nur eine Frage gestellt wurde
- Dies entspricht einem Drittel seines Kontextfensters, nur um Werkzeugdefinitionen zu laden
- Playwright MCP allein verwendete 21 Werkzeugdefinitionen (~13.600 Token) pro Sitzung, unabhängig davon, ob ein Browser genutzt wurde oder nicht
- GitHub MCP verbrauchte ~18.000 Token im Leerlauf
Alternative Ansätze mit geringerem Overhead
Der Entwickler setzte Alternativen um:
- Ersetzte Playwright MCP durch einen Skill, der bei Bedarf geladen wird, und erreichte damit die gleiche Funktionalität bei etwa 1/7 der Kontextkosten
- Verwendete die GitHub CLI (gh) anstelle von GitHub MCP, was ~200 Token pro Befehl statt 18.000 Token im Leerlauf verbraucht
Vergleich zwischen den Ansätzen
Der Entwickler stellte fest, dass Skills + CLI-Tools:
- Die gleiche Arbeit wie MCP-Server verrichten
- Nur Token verbrauchen, wenn sie tatsächlich genutzt werden
- Sich auf Weise kombinieren lassen, die MCP-Server nicht ermöglichen
Die Messung verdeutlicht den Kompromiss zwischen Bequemlichkeit und Kontexteffizienz bei der Verwendung von MCP-Servern gegenüber On-Demand-Werkzeugen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Lokaler Trello-ähnlicher Projektmanager für OpenClaw-Agenten mit Markdown-Dateien
Ein Entwickler hat ein lokales Trello-Board für die Projektverwaltung mit OpenClaw-Agenten erstellt, wobei Node.js + Express für die API, React + react-trello für die Benutzeroberfläche und Markdown-Dateien mit YAML-Frontmatter als Datenschicht verwendet werden. Das System läuft auf der OpenClaw-Maschine und wird lokal genutzt, wobei die Agenten Karten-Dateien direkt im Dateisystem lesen und schreiben.

Claude Desktop Feature-Anfrage: Sitzungsstart-Hook für automatische Initialisierung
Ein Entwickler, der persistente Kontextsysteme für Claude Desktop erstellt, identifiziert eine Lücke: Das Feld für Benutzereinstellungen injiziert Anweisungen nur, wenn der Benutzer die erste Nachricht sendet, was manuelle Auslöser für die Initialisierung erfordert. Sie schlagen vor, ein Feld für die Ausführung "Bei Sitzungsstart" hinzuzufügen, das automatisch ausgeführt wird, wenn eine neue Konversation beginnt.

Höhlenmensch: Eine Claude-Code-Fähigkeit, die durch Höhlenmenschen-Sprache 75 % der Tokens einspart
Caveman ist eine Claude Code-Fähigkeit, die den Token-Verbrauch um etwa 75 % reduziert, indem Claude in einem prägnanten, höhlenmenschartigen Stil antwortet, während die volle technische Genauigkeit erhalten bleibt. Es wird über npx oder den Claude-Plugin-Marktplatz installiert.

Nanocode: Training Claude-like coding agents with JAX on TPUs
Nanocode ist eine JAX-Bibliothek zum end-to-end-Training von Claude-ähnlichen Coding-Agenten unter Verwendung von Constitutional AI und TPU-Optimierung. Das 1,3-Milliarden-Parameter-Modell kann in ~9 Stunden für 200 US-Dollar auf TPU v6e-8 trainiert werden.