Slash-Agent-Start-Token um 60% reduzieren: Bereinigen Sie den Arbeitsbereich Ihres Bots
Ein Entwickler auf r/openclaw teilte eine praktische Methode, um den Start-Token-Verbrauch für LLM-basierte Coding-Agenten drastisch zu senken. Der Ansatz: Ein LLM über alle Markdown-Dateien im Stammverzeichnis des Arbeitsbereichs laufen lassen, um Ballast und Duplikate zu identifizieren und zu beseitigen.
Wichtige Maßnahmen
- Jede Markdown-Datei im Stammverzeichnis auf redundante oder zu ausführliche Inhalte überprüft (z. B. Änderungsprotokolle, duplizierte Erinnerungen, Benutzerinformationen).
- Die verbleibenden Dateien ähnlich wie ein Speichersystem strukturiert, um Konsistenz zu gewährleisten.
- Ein CLI-Tool (
codex) verwendet, anstatt den Agenten einzubeziehen, um den Prozess objektiv zu halten. - Eine Datei
TOOLSmit Kurznotizen und einen separaten Ordnertools/mit detailierten Werkzeugbeschreibungen erstellt, die der Agent bei Bedarf abrufen kann. - Neue Dateien wie
voicehinzugefügt, um einen konsistenten Ton über verschiedene Modelle hinweg zu wahren.
Ergebnisse
Die Start-Token sanken von 80k auf 31k – eine Reduzierung um 61 %. Der Arbeitsbereich wurde schlanker und der Agent reagierte schneller, ohne dass wesentlicher Kontext verloren ging.
Warum das wichtig ist
Hohe Start-Token bedeuten langsamere Antwortzeiten und höhere Kosten. Regelmäßige Überprüfungen der Arbeitsbereichsdateien mit einem LLM – außerhalb der Agentenschleife – verhindern die Ansammlung von Ballast und halten das Token-Budget unter Kontrolle.
Für wen das gedacht ist
Entwickler, die langlebige KI-Coding-Agenten betreiben und Token-Verschwendung reduzieren sowie die Agentenleistung verbessern möchten, ohne die Kontextqualität zu beeinträchtigen.
📖 Read the full source: r/openclaw
👀 Siehe auch

Claude Code: Kontextverwaltung statt Prompt-Engineering
Ein Entwickler teilt mit, dass nach einem Jahr der Nutzung von Claude Code die entscheidende Fähigkeit nicht die Formulierung von Prompts oder die Modellauswahl ist, sondern das Bereitstellen umfassender Projektkontexte im Voraus, um bessere Ergebnisse zu erzielen.

Claude Code Headless-Modus mit --print-Flag
Claude Code kann im Headless-Modus mit dem --print-Flag ausgeführt werden, was es ermöglicht, Prompts für automatisierte Ausgaben ohne interaktive Sitzungen einzulesen. Dies ermöglicht die Integration in CI/CD-Pipelines, Git-Hooks und Bash-Skripte.

Multi-Model-Routing reduziert die OpenClaw-API-Kosten um 50 %.
Ein Entwickler reduzierte die OpenClaw-API-Kosten um 50 %, indem er verschiedene Aufgaben über verschiedene Modelle leitete: Claude für komplexe Denkaufgaben, DeepSeek für Dateioperationen und Testgenerierung sowie Gemini oder GPT für mittelschwere Aufgaben.

Schreiben effektiver SOUL.md-Dateien für KI-Codierungsagenten
Ein Reddit-Beitrag aus r/openclaw zeigt den Unterschied zwischen vagen und spezifischen SOUL.md-Anweisungen und verdeutlicht, dass präzise Prompts zu nützlicherem KI-Agentenverhalten führen.