Zwei Muster zur Verhinderung von KI-Agenten-Gedächtnisverfall: AutoDream und Skeptisches Retrieval

OpenClaws Ansatz zur Gedächtnisverwaltung
OpenClaw hat zwei MIT-lizenzierte Muster veröffentlicht, um das Problem des langsamen Verfalls in dateibasierten KI-Gedächtnissystemen anzugehen, bei denen Fakten ohne ordnungsgemäße Kennzeichnung veralten und Agenten dazu veranlassen, auf veralteten Kontext zu reagieren. Obwohl derzeit OpenClaw-spezifisch, lassen sich die Konzepte auf jedes dateibasierte Gedächtnissystem anwenden.
AutoDream: Nächtliche Gedächtniskonsolidierung
AutoDream ist ein Cron-Agent, der um 3 Uhr morgens läuft, um Gedächtniswartung durchzuführen. Er liest Sitzungstranskripte, extrahiert tägliche Protokolle, bevor sie verblassen, aktualisiert strukturierte Gedächtnisdateien und entfernt veraltete Einträge. Die zentrale Erkenntnis ist, dass tägliche Protokolle das reichhaltigste Rohmaterial darstellen, aber am schnellsten verfallen, daher extrahiert der Job alles, was es wert ist, behalten zu werden, bevor sie kalt werden. Das Gedächtnis wird kontinuierlich umgeschrieben, anstatt nur angehängt.
Skeptical Retrieval: Abklinggewichtete Gedächtnisbewertung
Skeptical Retrieval ersetzt die flache Top-N-Abrufmethode der standardmäßigen semantischen Suche durch einen zusammengesetzten Score: semantisch × Abklingfaktor × Abrufverstärkung. Während die standardmäßige semantische Suche eine sechs Wochen alte Tatsache genauso behandelt wie eine von gestern, wendet dieser Ansatz unterschiedliche Abklingraten auf verschiedene Dateitypen an (stabile Fakten bei λ=0,02 vs. operative Aufgaben bei λ=0,08). Häufig abgerufene Ausschnitte erhalten eine logarithmische Verstärkung, und Ergebnisse mit geringem Vertrauen werden unterdrückt statt eingefügt.
Wie sie zusammenarbeiten
Die beiden Muster bilden eine sich selbst verbessernde Gedächtnisschleife: AutoDream verfolgt, welche Ausschnitte zitiert wurden, Abrufzahlen fließen in die zusammengesetzte Bewertung ein, und AutoDream entfernt Ausschnitte, die nie abgerufen werden. Die Implementierung beginnt mit Phase 0 (nur Disziplin beim Denken), die nichts kostet, gefolgt von Phase 1 (Abrufverfolgung), die einen Cron-Update benötigt.
Der Entwickler merkt an, dass die Wahl der Abklingraten Iteration erforderte, um richtig zu funktionieren, und steht zur Diskussion darüber offen. Beide Muster sind auf GitHub verfügbar:
- https://github.com/LeoStehlik/openclaw-skeptical-retrieval
- https://github.com/LeoStehlik/openclaw-autodream
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Hollow AgentOS reduziert den Claude-Code-Token-Verbrauch um 68,5 % mit einem JSON-nativen Betriebssystem für KI-Agenten.
Hollow AgentOS ist ein JSON-natives Betriebssystem für KI-Agenten, das den Token-Verbrauch von Claude Code um 68,5 % reduziert, indem es ineffiziente Shell-Befehl-Overheads eliminiert. Es integriert sich über MCP in Claude Code, führt lokale Inferenz über Ollama aus und ist unter der MIT-Lizenz verfügbar.

OpenClaw Budget Guard Plugin verhindert gleichzeitige Budgetüberschreitungen
Ein neues OpenClaw-Plugin namens @runcycles/openclaw-budget-guard löst das Problem der gleichzeitigen Budgetüberschreitung durch die Implementierung atomarer Kontostandsprüfungen, Reservierungen vor der Ausführung und idempotenter Wiederholungsversuche. Es erfordert einen Cycles-Server mit Redis und kann über einen Bash-Befehl installiert werden.

Übersetze zu de: Reframe-Slash-Befehl für Claude Code wendet kognitionswissenschaftliche Technik zur Problemlösung an
Ein Entwickler hat einen /reframe-Slash-Befehl für Claude Code erstellt, der eine kognitionswissenschaftliche Technik namens Distanz-Engagement-Oszillation implementiert. Der Ansatz wurde mit 50 Problemen über drei Open-Weight-LLMs getestet und übertraf durchgängig andere Methoden.

context-link v1.0.0: Lokaler MCP-Server reduziert Claude Code Token-Verbrauch um 91%
context-link v1.0.0 ist ein lokaler MCP-Server, der Codebasen mit Tree-sitter indiziert, um Claude nur die benötigten Symbole, Abhängigkeiten und Strukturen bereitzustellen, was den Token-Verbrauch in bestimmten Fällen um 91 % und bei vollständigen Aufgaben um 70–80 % reduziert.