Reflektierender MCP-Server implementiert Reflexionspapier für persistente Programmieragenten-Erinnerung

Ein Entwickler hat das Reflexion-Papier (Shinn et al., NeurIPS 2023) als MCP-Server implementiert, um ein häufiges Problem bei lokalen Coding-Agenten anzugehen: das Fehlen eines persistenten Speichers zwischen Sitzungen. Das Tool namens reflect-mcp ermöglicht es Agenten, Fehler zu merken und Wiederholungen zu vermeiden.
Wie es funktioniert
Das System arbeitet nach einem strukturierten Ablauf:
- Nach jedem Testfehler kritisiert der Agent seine eigene Arbeit und extrahiert Muster aus der Fehlermeldung
- Diese Lektionen werden für zukünftige Referenz gespeichert
- Vor dem Start neuer Aufgaben ruft der Agent vergangene Lektionen mittels Volltextsuche ab
- Die Mustererkennung ist vollständig regex-basiert – keine LLM-Aufrufe sind für die Klassifizierung nötig
Der Entwickler merkt an, dass Fehlermeldungen vorhersehbar genug sind, damit deterministische Mustererkennung effektiv funktioniert. Der Agent schreibt die Kritik, da er den Kontext hat, während der Server die Strukturierung und Deduplizierung der Lektionen übernimmt.
Technische Implementierung
- Als MCP (Model Context Protocol) Server gebaut
- Verwendet SQLite mit FTS5 für Speicherung und Suche
- Funktioniert mit jedem MCP-kompatiblen Client
- Installation via:
cargo install reflect-mcp
Ergebnisse nach einer Woche
Der Entwickler berichtete von mehreren Verbesserungen im Verhalten seines Coding-Agenten:
- Hörte auf, dasselbe
unwrap()auf Benutzereingaben anzuwenden - Hörte auf, die Zeitzonenbehandlung zu vergessen
- Begann, zuvor gesehene Fehlermuster automatisch zu vermeiden
- Die Musterverfolgung machte wiederkehrende Fehler im Projekt sichtbar
Das Projekt ist auf GitHub verfügbar unter https://github.com/rohansx/reflect. Der Entwickler sucht Feedback von anderen, die mit persistenten Speicherlösungen für lokale Coding-Agenten experimentiert haben.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Fable 5 in Claude Code: Kostenanalyse des ersten Tages — 210 Dollar API-Äquivalent, 0 Dollar bezahlt
Ein Entwickler wechselte in Claude Code zu claude-fable-5 und maß die Token-Nutzung bei 742 Antworten. API-äquivalente Kosten: 210,15 $. Tatsächlich bezahlt: 0 $ während des Aktionszeitraums bis zum 22. Juni.

Caliby: Open-Source eingebettete Vektordatenbank für KI-Agenten mit hybrider Text+Vektor-Speicherung
Caliby ist eine eingebettete C++-Vektordatenbank mit Python-Bindungen (pip install caliby), die HNSW-, DiskANN- und IVF+PQ-Indizes unterstützt, eine 4-fache Leistung gegenüber pgvector beansprucht und nativ Text neben Vektoren für KI-Agenten-/RAG-Anwendungsfälle speichert.

Die Claude-Fähigkeit für Devvit verbessert die Genauigkeit der Codegenerierung von 73 % auf 100 %.
Ein Entwickler hat eine strukturierte SKILL.md-Prompt-Schicht für Claude erstellt, die Kontext für Reddits Devvit-Plattform bereitstellt und die Evaluierungsergebnisse bei gängigen Devvit-Aufgaben von 7/10 auf 10/10 verbessert, indem spezifische Laufzeitfehler verhindert werden.

Claude Sessions: Leichte Desktop-App zum Durchsuchen des Claude-Code-Verlaufs
Claude Sessions ist eine neue Desktop-Anwendung, die Entwicklern ermöglicht, ihren Claude Code-Sitzungsverlauf lokal zu durchsuchen. Sie liest aus ~/.claude/projects, organisiert Sitzungen nach Projekten, verarbeitet große Sitzungen mit bis zu 500.000+ Tokens ohne Verzögerung und umfasst Suchfunktionalität sowie Tastaturnavigation.