OpenClaw Multi-Agent-Workflow-Probleme: Stillstand, Kontextverlust und Token-Ineffizienz

Herausforderungen bei OpenClaw-Multi-Agent-Workflows
Ein Entwickler hat erhebliche Probleme mit dem Multi-Agent-Workflow-System von OpenClaw detailliert beschrieben, insbesondere im Zusammenhang mit der Aufrechterhaltung der Autonomie während komplexer Projektanalysen. Der Nutzer kehrt aufgrund dieser Probleme zu anderen agentenbasierten Frameworks zurück.
Technisches Setup
Die getestete Konfiguration umfasste:
- Modelle: Gemini 3 Pro und Codex
- Struktur: 1 COO-Agent (Orchestrator) plus mehrere spezialisierte Task-Agenten
- Konfiguration: Benutzerdefinierte SOUL.md-, IDENTITY.md- und USER.md-Dateien für den Kontext
- Integration: Verschiedene Clawhub.ai-Fähigkeiten
Gemeldete Probleme
Workflow-Stillstand
Agenten bleiben während des Betriebs häufig hängen. Der Orchestrator (COO) geht davon aus, dass die Agenten noch verarbeiten, aber das Dashboard zeigt nach den ersten 10 Minuten keine Aktivität mehr. Die Implementierung einer "Check-in"-Schleife löste den Kommunikationsabbruch zwischen den Agenten nicht.
Kontextverlust/-leckage
Trotz der Bereitstellung benutzerdefinierter Dokumentationsdateien müssen Agenten für grundlegende Projektfakten ständig neu aufgefordert werden. Das System scheint mit dem Langzeit-Task-Statusmanagement zu kämpfen.
Token-Ineffizienz
In einem Durchlauf wurden über 400 Millionen Tokens ohne greifbare Ausgabe verbraucht. Dies lag hauptsächlich daran, dass Agenten in Schleifen gerieten oder dieselben Schritte erneut analysierten, ohne zu "Aktions"-Phasen überzugehen.
Nutzerbewertung
Der Entwickler stellt in Frage, ob OpenClaw derzeit nur eine "coole Benutzeroberfläche" für manuelle Aufforderungen ist, anstatt ein stabiles autonomes System. Er stellt fest, dass es sich für langlaufende Aufgaben deutlich weniger stabil anfühlt als Claude Code oder sogar grundlegende AutoGPT-Setups.
Der Nutzer fragt speziell: Gibt es bestimmte Konfigurationen oder "Clawhub"-Fähigkeiten, die das Autonomieproblem tatsächlich beheben, oder ist die Architektur derzeit zu fragil für Multi-Agent-Schleifen?
📖 Read the full source: r/openclaw
👀 Siehe auch

Routerly: Selbst gehostetes LLM-Gateway mit Laufzeit-Routingrichtlinien und Budgetkontrolle
Routerly ist ein kostenloses, quelloffenes, selbst gehostetes LLM-Gateway, das zur Laufzeit Modellauswahl basierend auf Routing-Richtlinien wie günstigste, schnellste oder leistungsfähigste ermöglicht, zusammen mit projektbezogenen Budgetgrenzen und Token-für-Token-Nachverfolgung. Es ist OpenAI-kompatibel für den nahtlosen Einsatz mit Tools wie Cursor, LangChain und Open WebUI.

Claude Code v2.1.90 fügt Mausunterstützung mit dem Flag CLAUDE_CODE_NO_FLICKER hinzu
Anthropic hat Claude Code v2.1.90 mit einer neuen Funktion veröffentlicht, die Mausunterstützung in der Chat-Oberfläche ermöglicht. Benutzer können sie aktivieren, indem sie die Umgebungsvariable CLAUDE_CODE_NO_FLICKER=1 setzen, bevor sie claude ausführen.
Claude Code vs. Codex: 36 vs. 28 Dateien, 2,50 $ vs. 2,04 $, Endlosschleife erkannt — Praxisvergleich
Ein Entwickler führt die gleichen zwei Aufgaben mit Claude Code und Codex (Cursor) aus: PR-Triage-Bot und Echtzeit-Code-Review-UI. Ergebnisse: 36 vs. 28 Dateien, 2,50 $ vs. 2,04 $ Kosten, Claude produzierte weniger TypeScript-Fehler, Codex hatte eine Endlosschleife in React.

Agent-Frameworks verschwenden pro Sitzung über 350.000 Token durch erneutes Senden statischer Dateien.
Ein Benchmark auf einem lokalen Qwen 3.5 122B-Setup zeigte, dass Agent-Frameworks pro Sitzung über 350.000 Token verschwenden, indem sie statische Dateien erneut senden. Ein Compile-Time-Ansatz reduzierte den Abfragekontext von 1.373 Token auf 73, was einer Reduzierung um 95 % entspricht.