Hollow AgentOS reduziert den Claude-Code-Token-Verbrauch um 68,5 % mit JSON-nativem OS-Ansatz

Was das ist
Hollow AgentOS ist eine JSON-native Betriebssystem-Abstraktionsschicht, die speziell für KI-Agenten entwickelt wurde. Sie behebt die Ineffizienz, Agenten auf Infrastruktur laufen zu lassen, die für Menschen gebaut wurde, wo jeder Status-Check typischerweise 9 Shell-Befehle ausführt und Cold Starts das erneute Auffinden von Kontext von Grund auf erfordern.
Wichtige Details
Das Projekt liefert messbare Token-Reduktionen in fünf realen Szenarien:
- Semantische Suche vs. grep + cat: 91% weniger Tokens
- Agenten-Aufnahme vs. kalte Log-Analyse: 83% weniger Tokens
- Status-Abfrage vs. Shell-Befehle: 57% weniger Tokens
- Gesamtreduktion: 68,5%
Der Benchmark ist vollständig reproduzierbar mit python3 tools/bench_compare.py.
Technische Umsetzung
Hollow AgentOS integriert sich über MCP (Model Context Protocol) in Claude Code und führt lokale Inferenz durch Ollama aus. Das Projekt ist MIT-lizenziert und auf GitHub verfügbar.
Wichtige Klarstellung zur Architektur: Dies ist kein Kernel-Ersatz. Der Autor vergleicht es damit, wie Android auf Linux aufsitzt - Android-Entwickler schreiben niemals Kernel-Code, sie interagieren nur mit der Android-Schicht. Hollow zielt darauf ab, die vollständige Abstraktionsschicht zwischen Agenten und dem zugrundeliegenden System zu sein, sodass Agenten niemals direkt das zugrundeliegende Betriebssystem berühren müssen.
Was derzeit ausgeliefert wird, wird als "die Grundlage dieser Vision, nicht das fertige Produkt" beschrieben, aber selbst in diesem Stadium liefert es "eine große Token-Reduktion und messbare Geschwindigkeitsverbesserung ohne merklichen Genauigkeitsverlust".
Für wen es gedacht ist
Entwickler, die agentische Workflows mit Claude Code ausführen und die Token-Nutzung und Leistung optimieren möchten.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Benchmarking von 88 kleinen GGUF-Modellen auf einem Mac Mini M4 mit 16 GB
Eine automatisierte Pipeline testete 88 GGUF-Modelle auf einem Mac Mini M4 mit 16 GB RAM, identifizierte 9 als unbrauchbar und 4 LFM2-8B-A1B-MoE-Modelle auf der Pareto-Front für Geschwindigkeit und Qualität.

Akademische Forschungskompetenzen für Claude Code: Eine Mensch-in-der-Schleife-Pipeline für das Verfassen wissenschaftlicher Arbeiten
Academic Research Skills (ARS) v3.7.0+ ist ein Claude Code Plugin, das die Referenzsuche, Zitierformatierung, Datenprüfung und logische Konsistenzprüfung automatisiert, während der menschliche Forscher die Kontrolle behält. Installation über /plugin marketplace add Imbad0202/academic-research-skills.

LAP: Über 1.500 API-Spezifikationen für die Nutzung durch LLMs zusammengestellt, um Halluzinationen bei Claude zu reduzieren
LAP ist ein Tool, das über 1.500 echte API-Spezifikationen in ein schlankes Format kompiliert, das für LLMs optimiert ist. Es bietet verifizierte Endpunkte und Parameter, um KI-Coding-Agenten wie Claude davon abzuhalten, falsche API-Aufrufe zu halluzinieren.

OpenClaw-Benchmark zeigt: Qwen3.5:27B übertrifft andere lokale LLMs bei Agenten-Aufgaben
Ein Benchmark von 7 lokalen LLMs bei 22 realen Agentenaufgaben mit OpenClaw ergab, dass qwen3.5:27b-q4_K_M mit 59,4 % abschnitt, während der Zweitplatzierte qwen3.5:35b nur 23,2 % erreichte. Die meisten Modelle konnten grundlegende Werkzeuge wie E-Mail-Funktionen nicht finden.