Hollow AgentOS reduziert den Claude-Code-Token-Verbrauch um 68,5 % mit JSON-nativem OS-Ansatz

✍️ OpenClawRadar📅 Veröffentlicht: 29. März 2026🔗 Source
Hollow AgentOS reduziert den Claude-Code-Token-Verbrauch um 68,5 % mit JSON-nativem OS-Ansatz
Ad

Was das ist

Hollow AgentOS ist eine JSON-native Betriebssystem-Abstraktionsschicht, die speziell für KI-Agenten entwickelt wurde. Sie behebt die Ineffizienz, Agenten auf Infrastruktur laufen zu lassen, die für Menschen gebaut wurde, wo jeder Status-Check typischerweise 9 Shell-Befehle ausführt und Cold Starts das erneute Auffinden von Kontext von Grund auf erfordern.

Wichtige Details

Das Projekt liefert messbare Token-Reduktionen in fünf realen Szenarien:

  • Semantische Suche vs. grep + cat: 91% weniger Tokens
  • Agenten-Aufnahme vs. kalte Log-Analyse: 83% weniger Tokens
  • Status-Abfrage vs. Shell-Befehle: 57% weniger Tokens
  • Gesamtreduktion: 68,5%

Der Benchmark ist vollständig reproduzierbar mit python3 tools/bench_compare.py.

Ad

Technische Umsetzung

Hollow AgentOS integriert sich über MCP (Model Context Protocol) in Claude Code und führt lokale Inferenz durch Ollama aus. Das Projekt ist MIT-lizenziert und auf GitHub verfügbar.

Wichtige Klarstellung zur Architektur: Dies ist kein Kernel-Ersatz. Der Autor vergleicht es damit, wie Android auf Linux aufsitzt - Android-Entwickler schreiben niemals Kernel-Code, sie interagieren nur mit der Android-Schicht. Hollow zielt darauf ab, die vollständige Abstraktionsschicht zwischen Agenten und dem zugrundeliegenden System zu sein, sodass Agenten niemals direkt das zugrundeliegende Betriebssystem berühren müssen.

Was derzeit ausgeliefert wird, wird als "die Grundlage dieser Vision, nicht das fertige Produkt" beschrieben, aber selbst in diesem Stadium liefert es "eine große Token-Reduktion und messbare Geschwindigkeitsverbesserung ohne merklichen Genauigkeitsverlust".

Für wen es gedacht ist

Entwickler, die agentische Workflows mit Claude Code ausführen und die Token-Nutzung und Leistung optimieren möchten.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Benchmarking von 88 kleinen GGUF-Modellen auf einem Mac Mini M4 mit 16 GB
Werkzeuge

Benchmarking von 88 kleinen GGUF-Modellen auf einem Mac Mini M4 mit 16 GB

Eine automatisierte Pipeline testete 88 GGUF-Modelle auf einem Mac Mini M4 mit 16 GB RAM, identifizierte 9 als unbrauchbar und 4 LFM2-8B-A1B-MoE-Modelle auf der Pareto-Front für Geschwindigkeit und Qualität.

OpenClawRadar
Akademische Forschungskompetenzen für Claude Code: Eine Mensch-in-der-Schleife-Pipeline für das Verfassen wissenschaftlicher Arbeiten
Werkzeuge

Akademische Forschungskompetenzen für Claude Code: Eine Mensch-in-der-Schleife-Pipeline für das Verfassen wissenschaftlicher Arbeiten

Academic Research Skills (ARS) v3.7.0+ ist ein Claude Code Plugin, das die Referenzsuche, Zitierformatierung, Datenprüfung und logische Konsistenzprüfung automatisiert, während der menschliche Forscher die Kontrolle behält. Installation über /plugin marketplace add Imbad0202/academic-research-skills.

OpenClawRadar
LAP: Über 1.500 API-Spezifikationen für die Nutzung durch LLMs zusammengestellt, um Halluzinationen bei Claude zu reduzieren
Werkzeuge

LAP: Über 1.500 API-Spezifikationen für die Nutzung durch LLMs zusammengestellt, um Halluzinationen bei Claude zu reduzieren

LAP ist ein Tool, das über 1.500 echte API-Spezifikationen in ein schlankes Format kompiliert, das für LLMs optimiert ist. Es bietet verifizierte Endpunkte und Parameter, um KI-Coding-Agenten wie Claude davon abzuhalten, falsche API-Aufrufe zu halluzinieren.

OpenClawRadar
OpenClaw-Benchmark zeigt: Qwen3.5:27B übertrifft andere lokale LLMs bei Agenten-Aufgaben
Werkzeuge

OpenClaw-Benchmark zeigt: Qwen3.5:27B übertrifft andere lokale LLMs bei Agenten-Aufgaben

Ein Benchmark von 7 lokalen LLMs bei 22 realen Agentenaufgaben mit OpenClaw ergab, dass qwen3.5:27b-q4_K_M mit 59,4 % abschnitt, während der Zweitplatzierte qwen3.5:35b nur 23,2 % erreichte. Die meisten Modelle konnten grundlegende Werkzeuge wie E-Mail-Funktionen nicht finden.

OpenClawRadar