Ansatz zur selbstverbessernden Speicherfähigkeit in lokalen KI-Agenten

✍️ OpenClawRadar📅 Veröffentlicht: 15. April 2026🔗 Source
Ansatz zur selbstverbessernden Speicherfähigkeit in lokalen KI-Agenten
Ad

Speicherarchitektur für persistente KI-Agenten

Ein Entwickler auf r/LocalLLaMA hat seinen Ansatz geteilt, um KI-Agenten zu erstellen, die Fehler nicht über Sitzungen hinweg wiederholen. Das Kernproblem, das angegangen wird, ist, dass jede Sitzung bei Null beginnt, Kontextfenster zurückgesetzt werden und Korrekturen zwischen den Sitzungen verloren gehen.

Speicherimplementierung

Das System verwendet Markdown als Single Source of Truth anstelle einer Datenbank. MEMORY.md ist von Menschen bearbeitbar – lösche eine Zeile in vim und der Agent vergisst sie. SQLite und FAISS (HNSW, 768-dim) sind abgeleitete Caches, die jederzeit aus Markdown neu aufgebaut werden können. Dies ermöglicht es Benutzern, den Speicher ihres Agenten mit git zu versionieren.

Episodenbewertung und Regellernen

Jede Ausführung erhält eine Bewertung von +1/-1 und wird als Episode gespeichert. Bei ähnlichen zukünftigen Aufgaben werden relevante Episoden in den Kontext gezogen. Wenn die gleiche Fehlersignatur (SHA256 von Werkzeugname + normalisierter Fehler) zweimal innerhalb von 7 Tagen auftaucht, generiert ein Regellerner eine einzeilige Präventionsregel.

Regeln starten mit 0,40 Konfidenz und benötigen 0,60, um tatsächlich in zukünftige Prompts injiziert zu werden. Erfolg erhöht die Konfidenz um +0,03, Misserfolg senkt sie um -0,05. Regeln, die nicht helfen, zerfallen schließlich.

Ad

Vertrauenseskalationssystem

Anstatt Berechtigungsebenen im Voraus zu konfigurieren, verfolgt der Agent Genehmigungsmuster. 5 Genehmigungen mit 90%+ Rate = automatische Beförderung. Eine Rücknahme = Zurückstufung. Es gibt einen Schattenmodus zur Überwachung.

Aufgabenzersetzung und Sicherheit

Komplexe Ziele werden zu einem DAG (gerichteter azyklischer Graph). Zirkuläre Abhängigkeiten werden über topologische Sortierung erkannt, Fehlerkaskaden werden zu abhängigen Knoten via DFS (Tiefensuche) weitergegeben. Ein Abschlusstor prüft 18 Anforderungen (R01-R18) – hat der Agent tatsächlich Dateien gelesen, Änderungen geschrieben, Ergebnisse verifiziert, im Arbeitsbereich geblieben?

Sicherheitsfunktionen umfassen 43 Bash-Risikomuster, Dual-Pass-Analyse (roh + dekodiert), Fail-Closed-Design (Guardian-Absturz = Verweigerung) und eine minimale beschreibbare Tiefe von 3, um rm -rf / zu verhindern.

Der Entwickler sucht Feedback dazu, ob der Konfidenzzerfall bei Regeln richtig erscheint und ob die Asymmetrie von +0,03/-0,05 optimal ist. Er fragt sich auch, ob es bessere Alternativen zu HNSW für diesen Umfang gibt (typischerweise <10k Episoden).

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

oMLX führt SSD-KV-Caching für Apple Silicon ein und reduziert die Antwortzeiten von OpenClaw von 30-90 Sekunden auf 5 Sekunden.
Werkzeuge

oMLX führt SSD-KV-Caching für Apple Silicon ein und reduziert die Antwortzeiten von OpenClaw von 30-90 Sekunden auf 5 Sekunden.

oMLX ist ein neues Backend, das KV-Cache-Blöcke im Safetensors-Format auf der SSD speichert und so Cache-Invalidierungen bei Kontextwechseln verhindert. Dadurch reduziert sich die Antwortzeit von OpenClaw bei Folgeanfragen von 30-90 Sekunden auf 5 Sekunden.

OpenClawRadar
OpenClaw Skill Server für Indische Marktanalyse und Handel
Werkzeuge

OpenClaw Skill Server für Indische Marktanalyse und Handel

Ein Open-Source-Handelsterminal für den indischen Markt wurde als OpenClaw-Skill-Server integriert, sodass Agenten Marktdaten abrufen und Multi-Agenten-Analysen über HTTP durchführen können. Das System bietet strukturierte Handelspläne mit Einstiegspreisen, Stop-Loss-Orders und Zielen für drei Risikoprofile.

OpenClawRadar
Tangent: Chrome-Erweiterung zum Verzweigen von Claude-Gespraechen
Werkzeuge

Tangent: Chrome-Erweiterung zum Verzweigen von Claude-Gespraechen

Kostenlose Open-Source-Erweiterung zum Oeffnen von Seitenthreads in Claude ohne den Platz zu verlieren.

OpenClaw Radar
Skales Desktop AI Agent, entwickelt mit Claude, verfügt über einen Clippy-ähnlichen Maskottchen-Stil
Werkzeuge

Skales Desktop AI Agent, entwickelt mit Claude, verfügt über einen Clippy-ähnlichen Maskottchen-Stil

Skales ist ein Desktop-KI-Agent, der lokal auf Windows und macOS läuft und Claude über die OpenRouter/Anthropic-API für logisches Denken und Werkzeugausführung nutzt. Er beinhaltet ein schwebendes Desktop-Buddy-Maskottchen mit einem Büroklammer-Skin-Referenz und kann Befehle wie E-Mails senden, Dateien verwalten, im Web surfen und Kalender verwalten ausführen.

OpenClawRadar