Hollow AgentOS reduziert den Claude-Code-Token-Verbrauch um 68,5 % mit JSON-nativem OS-Ansatz

Was das ist
Hollow AgentOS ist eine JSON-native Betriebssystem-Abstraktionsschicht, die speziell für KI-Agenten entwickelt wurde. Sie behebt die Ineffizienz, Agenten auf Infrastruktur laufen zu lassen, die für Menschen gebaut wurde, wo jeder Status-Check typischerweise 9 Shell-Befehle ausführt und Cold Starts das erneute Auffinden von Kontext von Grund auf erfordern.
Wichtige Details
Das Projekt liefert messbare Token-Reduktionen in fünf realen Szenarien:
- Semantische Suche vs. grep + cat: 91% weniger Tokens
- Agenten-Aufnahme vs. kalte Log-Analyse: 83% weniger Tokens
- Status-Abfrage vs. Shell-Befehle: 57% weniger Tokens
- Gesamtreduktion: 68,5%
Der Benchmark ist vollständig reproduzierbar mit python3 tools/bench_compare.py.
Technische Umsetzung
Hollow AgentOS integriert sich über MCP (Model Context Protocol) in Claude Code und führt lokale Inferenz durch Ollama aus. Das Projekt ist MIT-lizenziert und auf GitHub verfügbar.
Wichtige Klarstellung zur Architektur: Dies ist kein Kernel-Ersatz. Der Autor vergleicht es damit, wie Android auf Linux aufsitzt - Android-Entwickler schreiben niemals Kernel-Code, sie interagieren nur mit der Android-Schicht. Hollow zielt darauf ab, die vollständige Abstraktionsschicht zwischen Agenten und dem zugrundeliegenden System zu sein, sodass Agenten niemals direkt das zugrundeliegende Betriebssystem berühren müssen.
Was derzeit ausgeliefert wird, wird als "die Grundlage dieser Vision, nicht das fertige Produkt" beschrieben, aber selbst in diesem Stadium liefert es "eine große Token-Reduktion und messbare Geschwindigkeitsverbesserung ohne merklichen Genauigkeitsverlust".
Für wen es gedacht ist
Entwickler, die agentische Workflows mit Claude Code ausführen und die Token-Nutzung und Leistung optimieren möchten.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Open-Source-MCP-Server fügt Claude Desktop integriertes Sitzungsgedächtnis hinzu
Ein Entwickler hat einen TypeScript-MCP-Server mit integriertem Sitzungsspeicher erstellt, um den Kontext zwischen Claude Desktop-Codingsitzungen zu bewahren, wodurch separate Speicherinfrastruktur überflüssig wird. Der Server umfasst Sitzungs-Speicher-/Ladefunktionen sowie zusätzliche Tools wie Brave Search und Google Gemini-Integration.

Open-Sourced Claude Code Skills: Eine /do-Pipeline, die Rückfragen um 80% reduzierte
Ein Entwickler hat 15 Claude Code Skills aus über 100 Freelance-Projekten als Open Source veröffentlicht. Der /do-Befehl führt eine 5-stufige Pipeline aus (/todo → /dev → /verify-dev → /build → /test → push) mit automatischen Fehlerbehebungsschleifen, was zu 80 % weniger Rückfragen und 60-65 % besserer Codequalität bei über 2000 Commits führt.
LTM: Ein JSON-Protokoll für portables Agentengedächtnis über Modelle und Maschinen hinweg
LTM ist ein JSON-Protokoll (Core Memory Packet) plus CLI/Server zum Speichern von Agentenkontext – Sackgassen, Einschränkungen, nächste Schritte – über Modelle, Editoren und Maschinen hinweg. Pakete sind 2-5 KB groß, schwärzen Geheimnisse und unterstützen MCP.

Multi-LLM Papier-Trading-Bot mit Claude Opus als leitendem Ingenieur und Gemini als Stratege: Architekturaufschlüsselung
Ein Solo-Entwickler teilt einen 4.900-Zeilen Paper-Trading-Bot auf Alpaca, bei dem Claude Opus 4 (Engineer) ein Vetorecht gegenüber Gemini Pro (Strategist) hat, samt eines Protokolls mit über 270 Einträgen, dem sogenannten Strategist Codex.