Die Untersuchung der OpenClaw-Token-Nutzung deckt Konfigurationsprobleme auf.

Token-Verbrauchsuntersuchung deckt Konfigurationsprobleme auf
Ein Entwickler berichtete, dass er sein wöchentliches OpenAI Codex-Abonnement in etwa 1,5 Tagen aufgebraucht hatte, während er OpenClaw für tägliche KI-Nachrichtenaktualisierungen nutzte. Er verwendete Claude Code, um eine tiefgehende Überprüfung seines Setups durchzuführen, und identifizierte mehrere Konfigurationsprobleme, die einen übermäßigen Token-Verbrauch verursachten.
Wichtige Erkenntnisse aus der Untersuchung
Die Untersuchung deckte mehrere Konfigurationsprobleme auf:
- Telegram requireMention-Einstellung: Alle Gruppenchats hatten
requireMention: false, was bedeutet, dass jede Nachricht den Agenten auslöste. Die Einstellung auftruebewirkt, dass Bots nur bei @Erwähnungen reagieren. - Web-Abfrage-Standardeinstellungen: Die
readability-Einstellung war standardmäßig deaktiviert, wodurch Abfragen selbst bei fehlgeschlagenen Anfragen rohe CSS/JS-Inhalte zurückgaben. 21 von 21web_fetch-Aufrufen waren fehlgeschlagen, aber dennoch wurden Seitenstrukturen in den Kontext geladen. - Modellvererbung: Agentenspezifische Modellüberschreibungen erben nicht von Standardeinstellungen. Das Ändern von
agents.defaults.model.primaryzugpt-5.4-miniwirkte sich nicht auf vier Agenten aus, die hartcodierte Überschreibungen aufgpt-5.4hatten. - Verwaiste Sitzungsdateien: Es wurden 41
.reset.*/.deleted.*-Transkriptdateien (~56 MB) gefunden, auf die nichts mehr verweist. - Keine Schutzmaßnahmen für Web-Recherchen: Ein Web-Recherche-Agent (verantwortlich für 78 % des Token-Verbrauchs) hatte kein Abfragebudget, keine Stoppregeln und kein „Lokalen Speicher vor der Suche prüfen“-Muster.
Konfigurationskorrekturen
Die Untersuchung empfahl diese spezifischen Konfigurationsänderungen:
openclaw config set tools.web.fetch.readability true
openclaw config set tools.web.fetch.maxChars 12000
openclaw config set tools.web.fetch.timeoutSeconds 15
openclaw config set tools.web.fetch.cacheTtlMinutes 30Zur Sitzungsbereinigung:
openclaw sessions cleanup --all-agents --enforce --fix-missingSchnell-Checkliste
- Überprüfen Sie
requireMentionin allen Gruppenchats - Aktivieren Sie
tools.web.fetch.readabilityund setzen SiemaxChars/timeoutSeconds - Überprüfen Sie agentenspezifische Modellüberschreibungen – Standardeinstellungen werden nicht vererbt
- Führen Sie
openclaw sessions cleanup --all-agents --dry-run --fix-missingaus - Fügen Sie Abfragebudgets und Stoppregeln für rechenintensive Agenten hinzu
Der Entwickler merkte an, dass Claude Code besonders nützlich für forensische Analysen war: Es durchsuchte 2 Tage Gateway-Protokolle mit grep, zählte 510 gpt-5.4-Referenzen gegenüber 23 gpt-5.4-mini in aktiven Sitzungen, fand 198 CSS-Variablenreferenzen in fehlgeschlagenen Abfrageergebnissen und identifizierte 56 % Redundanz in Startdateien.
📖 Read the full source: r/openclaw
👀 Siehe auch

Stiller Erfolg: Ein Dev-Ansatz für Cron-Job-Benachrichtigungen
Ein Entwickler auf r/openclaw stellt keine Erfolgsbenachrichtigungen mehr für gesunde Cron-Jobs zu, sondern alarmiert nur bei Authentifizierungsfehlern, Zustandskorruption oder wiederholten Fehlschlägen.

8 Monate tägliche Nutzung von Claude: 9 praktische Tipps (ohne Code)
Ein Reddit-Nutzer teilt 9 hart erlernte Lektionen aus 8 Monaten täglicher Claude-Nutzung für Schreiben und Recherche – nicht Code – mit Tipps zu Bearbeitung, Kontextverwaltung, Stilvorgabe und der Nutzung von Claude als Denkpartner.

Verbesserung von OpenClaw mit der Macht des lokalen LLM: Einführung von GLM-4.7-Flash
Die Integration von GLM-4.7-Flash mit OpenClaw revolutioniert die Automatisierung durch KI, indem sie eine nahtlose lokale Bereitstellung und ausgeklügelte Code-Ausführung ermöglicht.

Haben Sie in einem Monat 850 Dollar für OpenClaw ausgegeben? Beheben Sie Ihre Architektur, nicht Ihr Modell
Ein Entwickler verbrannte in einem Monat 850 $ für ein OpenClaw-Multi-Agenten-Setup – davon 350 $ an einem einzigen Tag. Die Lösung war nicht ein günstigeres Modell, sondern das Systemdesign: striktes Context-Pruning, Sitzungsrücksetzungen, n8n für Nicht-Denksportaufgaben und eine Routing-Ebene für günstige vs. leistungsstarke Modelle.