Workflow-Speicher statt Tooling: Warum Kontext laden besser ist als gigantische Prompts

Ein häufiges Fehlermuster bei Coding-Agents ist nicht das Fehlen von Tools – es ist das Fehlen des richtigen Workflow-Gedächtnisses. Der Agent hat Shell, Git, Browser, Dateizugriff. Das Problem ist, dass er in den falschen Workflow gerät, ohne die Regeln dieses Workflows zu kennen.
Ein Release ist nicht einfach "den Build ausführen". Ein Hotfix ist nicht einfach "den Code ändern". Ein Deployment ist nicht einfach "die Datei pushen". Eine Migration ist nicht einfach "das Schema bearbeiten". Jedes hat einen Haufen langweiligen Kontext: was zuerst geprüft werden muss, was niemals übersprungen werden darf, was danach aktualisiert werden muss, was als erledigt gilt.
Der Ansatz: Bedarfsorientiertes Laden von Checklisten
Anstatt alles in den permanenten Prompt zu packen (der schnell zu einer Suppe wird), lade den Workflow-Kontext nur dann, wenn er benötigt wird:
- Wenn die Aufgabe wie ein Release aussieht → lade die Release-Checkliste.
- Wenn der Agent Paketdateien berührt → lade die Paketierungsnotizen.
- Wenn er eine Migration durchführt → lade die Backup- und Verifikationsregeln.
- Wenn er einen Hotfix behebt → lade die Changelog-/Sync-Regeln.
- Entferne diesen zusätzlichen Kontext, wenn der Workflow beendet ist.
Dies ändert das Fehlermuster signifikant. Der Agent hört auf, wie ein riesiger Prompt zu agieren, der versucht, sich an alles zu erinnern, und verhält sich eher wie ein Arbeitsplatz, an dem die richtige Checkliste bereits auf dem Schreibtisch liegt, wenn du sie brauchst.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

4 Dateien, die Claude Code veranlassten, sicheren Produktionsdatenbank-Code zu schreiben
Ein Entwickler teilt vier Dateien – CLAUDE.md, MEMORY.md, framework.md, decisions/log.md – plus eine Python-Bridge mit Idempotenzschlüsseln und Schreibsperren, die es Claude Code ermöglicht, sicher in eine Convex-Proddatenbank zu schreiben.

Wie man das 1M-Kontextfenster von Claude Code deaktiviert, um den Token-Verbrauch zu reduzieren
Anthropic-Benutzer können das 1M-Kontextfenster in Claude Code deaktivieren, indem sie Umgebungsvariablen zur settings.json hinzufügen, was unerwarteten Token-Verbrauch reduzieren kann. Die Quelle bietet zwei Konfigurationsoptionen: vollständiges Deaktivieren des 1M-Kontexts oder Begrenzen des automatischen Kompaktfensters.

Claude-Benutzereinstellungen: Ein Reddit-Nutzer-Setup für präzise, kritische Antworten
Ein Reddit-Nutzer teilt seine Claude User Preferences-Anpassungen, um weniger geschäftliche und direkt kritische Antworten zu erhalten. Tipps zur Vermeidung von Wiederholungen, zum Beginnen mit Schlussfolgerungen und zur Vereinfachung der Zeichensetzung.

Einsatzbericht: Qwen 3.6 27B auf einem M2 MacBook Pro (32 GB) – quälend langsam, aber intelligente Ausgabe
Der Betrieb von Qwen 3.6 27B IQ4_XS auf einem M2 MacBook Pro mit 32 GB RAM liefert anfangs 7,9 t/s, bei 52k Kontext sinkt die Geschwindigkeit auf 3,1 t/s. Die Codequalität beeindruckt, aber die Speicherbandbreite ist der Engpass.