Engramx v3.4: MCP Server + SQLite Wissensgraph reduziert Tokenverbrauch von Claude Code um 89%

Engramx v3.4 ist ein MCP-Server, kombiniert mit einem SQLite-basierten Wissensgraphen, der Dateilesevorgänge an der Agentengrenze abfängt. Wenn Claude Code versucht, eine Datei zu lesen, die engram indiziert hat, gibt der Hook eine strukturelle Zusammenfassung statt des Rohinhalts zurück. Das Ergebnis: derselbe Edit, derselbe Diff, aber weit weniger Token pro Roundtrip.
Wichtige Details
- Benchmark: Echte Codebasis mit 87 Dateien; aggregierte Token-Reduktion 89,1 %. Die beste Datei sank von 18.820 auf 306 Token. Das Benchmark-Skript ist
bench/real-world.ts– Sie können es in jedem eigenen Projekt ausführen. - IDE-Unterstützung: Funktioniert nativ in 8 IDEs: Claude Code (Hooks + offizielles Plugin in Prüfung), Cursor (MDC + MCP + VS Code-Erweiterung auf OpenVSX), Cline, Continue.dev, Aider, Windsurf, Zed und OpenAI Codex CLI. Eine Installation, ein Graph, alle Tools profitieren.
- Lokal-first: Die SQLite-Datenbank befindet sich unter
.engram/graph.dbin Ihrem Repository. Nichts verlässt Ihren Rechner. Lizenz unter Apache 2.0. Kein Konto, keine Telemetrie. - Installation:
npm install -g engramxdanncd ~/ihr-projektundengram setup. Für Cursor führen Siecode --install-extension nickcirv.engram-vscodeaus. - Tracking: Der Befehl
engram costzeigt die Token-Ersparnis pro Projekt und Woche. Nach 24 Stunden normaler Nutzung zeigt der Digest echte Zahlen. - Kommende v4.0 „Mesh + Spine“: Erscheint am 25. Mai. Optionale Föderationsschicht zum Teilen von Fehlern und ADRs zwischen Maschinen, ohne Quellcode zu teilen. Phase 1 bereits gemerged: ed25519-Identität, 14-Kategorie-PII-Gate, 1007 Tests.
Das Tool adressiert direkt das Erreichen der Claude Code Max 5x-Limits in unter 2 Stunden bei echter Arbeit – ein einziger komplexer Prompt ließ den Session-Zähler von 21 % auf 100 % springen.
📖 Vollständige Quelle lesen: r/ClaudeAI
👀 Siehe auch

Lean Context: Claude Code Plugin wandelt ausführliche Dokumente in agentenoptimierte Dateien um
Ein kostenloses, quelloffenes Claude Code-Plugin namens Lean Context durchsucht Projekt-Dokumentationen und entfernt Inhalte, die KI-Agenten durch Grepping entdecken können, behält dabei nur wesentliche, nicht offensichtliche Befehle, Fallstricke und Umgebungsbesonderheiten. In einem .NET-E-Commerce-Projekttest reduzierte es 8 Dokumente mit insgesamt 1.263 Zeilen auf nur 23 Zeilen.

vllm-mlx-Fork fügt Tool-Calling und Prompt-Cache für lokale KI-Codierungsagenten hinzu
Ein Entwickler hat vllm-mlx modifiziert, um Probleme bei Tool-Aufrufen zu beheben und Prompt-Caching hinzuzufügen, wodurch die TTFT für OpenClaw auf Apple Silicon von 28s auf 0,3s reduziert wurde. Der Fork unterstützt Qwen3-Coder-Next mit 65 Tok/s auf dem M3 Ultra mit funktionierendem Funktionsaufruf.

Scrapling integriert als Scraping-Backbone von OpenClaw
Scrapling, eine Open-Source-Bibliothek, die Seitenstrukturen erlernt und sich an Änderungen anpasst, wurde in OpenClaw als Kern-Scraping-Engine integriert. Sie ist 774x schneller als BeautifulSoup mit Lxml und unterstützt mehrere Selektortypen mit asynchronen Sitzungen.

Claw Code Agent: Python-Neuimplementierung der Claude-Code-Architektur für lokale Modelle
Claw Code Agent ist eine Python-Neuimplementierung der Claude-Code-Agent-Architektur, die mit lokalen Open-Source-Modellen über OpenAI-kompatible Backends wie vLLM und Ollama läuft und Funktionen wie Tool-Aufrufe, Slash-Befehle und gestufte Berechtigungen bietet.