Bio-inspiriertes Gedächtnissystem für lokale LLMs: Implementierung von LTP und selektivem Vergessen

✍️ OpenClawRadar📅 Veröffentlicht: 25. März 2026🔗 Source
Bio-inspiriertes Gedächtnissystem für lokale LLMs: Implementierung von LTP und selektivem Vergessen
Ad

Bio-inspirierte Gedächtnisarchitektur für lokale LLMs

Ein Entwickler hat einen lokalen MCP-Server erstellt, der menschliche Gedächtnismechaniken simuliert, um sauberen Kontext für lokale LLMs zu erhalten. Das System implementiert drei bio-inspirierte Schichten in Python/TypeScript anstelle einer statischen RAG-Pipeline.

Kern-Gedächtnismechaniken

  • Verstärkung (Long-Term Potentiation): Jedes Mal, wenn ein Thema abgefragt wird, erhöht sich dessen access_count, wodurch häufig genutzte Erinnerungen gestärkt werden.
  • Selektives Vergessen: Ungenutzte Verbindungen zerfallen mit der Zeit, wobei das System schwache Atome automatisch archiviert, um Kontextverschmutzung zu verhindern.
  • Konsolidierung: Ein wöchentlicher "Schlaf"-Zyklus destilliert kürzliche Protokolle mithilfe eines schlanken SLM in Kernwissensatome.

Technische Implementierungsdetails

  • Hybridsuche: Kombiniert sqlite-vec für semantische Suche mit Text-Fallbacks, um Timeouts selbst bei fehlgeschlagenen Embeddings zu verhindern.
  • Nicht-blockierendes MCP: Wickelt synchrone Datenbank- und Embedding-Operationen in asyncio-Executors ein, um LM Studio reaktionsfähig zu halten.
  • Identitätsschicht: Nutzt eine persistente "Soul"-Datei (soul.md), um Zustand und Persona über Sitzungen hinweg zu bewahren.
  • Zugriffsbasierte Verstärkung: Der access_count-Mechanismus ermöglicht es dem Modell, sich basierend auf Interaktionsmustern zu entwickeln, anstatt nur statische Fakten abzurufen.
Ad

Entwicklungskontext und Validierung

Das Projekt wurde entwickelt, um Kontextgrenzen in standardmäßigen RAG-Implementierungen für lokale KI zu adressieren. Der Entwickler validierte die Architektur, indem er ein lokales LLM (mit Gemini) den Code analysieren ließ, was drei Innovationen hervorhob: echte kognitive Agenten mit zugriffsbasierter Verstärkung und Zerfall, robuste Hybridsuche mit Fallbacks und nicht-blockierende Architektur für Reaktionsfähigkeit.

Das Ziel ist, ein System zu schaffen, das sich an Wichtiges erinnert und Rauschen vergisst, ähnlich dem menschlichen Gedächtnis während des Schlafs. Der Entwickler erforscht, ob bio-inspirierte Gedächtnisarchitekturen Kontextbeschränkungen lokal lösen können, ohne Cloud-Abhängigkeiten oder Blackboxen.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Prompt-Caching-MCP-Plugin reduziert automatisch die Claude-API-Kosten, indem es stabilen Kontext identifiziert.
Werkzeuge

Prompt-Caching-MCP-Plugin reduziert automatisch die Claude-API-Kosten, indem es stabilen Kontext identifiziert.

Das Prompt-Caching-MCP-Plugin identifiziert automatisch stabile Kontextteile wie Systemprompts und Werkzeugdefinitionen, markiert sie dann für Anthropics Caching-Funktion und reduziert so die API-Kosten in Codingsitzungen um 80-92%.

OpenClawRadar
OpenClaw Guild: Mehrbenutzer-AI-Agenten-Server für Teams
Werkzeuge

OpenClaw Guild: Mehrbenutzer-AI-Agenten-Server für Teams

OpenClaw Guild erweitert das Einzelbenutzer-OpenClaw zu einem Mehrbenutzer-AI-Server mit rollenbasierter Zugriffskontrolle, isolierten Daten pro Agent und einem 4-stufigen Speichersystem. Es beinhaltet ein Web-Admin-Dashboard und Docker-compose-Bereitstellung für einen 15-minütigen Einrichtungsprozess.

OpenClawRadar
Vibeyard fügt P2P-Sitzungsteilung für Claude Code hinzu.
Werkzeuge

Vibeyard fügt P2P-Sitzungsteilung für Claude Code hinzu.

Vibeyard, eine Open-Source-IDE für Claude Code, unterstützt jetzt Peer-to-Peer-Sitzungsteilung. Benutzer können Live-Terminalsitzungen mit Teammitgliedern über verschlüsselte WebRTC-Verbindungen mit Lese- oder Lese-Schreib-Zugriffsmodi teilen.

OpenClawRadar
Open-Source-Dashboard zeigt tatsächliche Claude-Code-Computekosten auf
Werkzeuge

Open-Source-Dashboard zeigt tatsächliche Claude-Code-Computekosten auf

Ein Entwickler hat die Ratenbegrenzungsformel von Claude Code reverse-engineered, um ein lokales Dashboard zu erstellen, das Echtzeit-Nutzungsprozentsätze, tatsächliche Dollarkosten, Verbrauchsrate, Spitzenzeiten und welche Skills/Hooks aktiv sind anzeigt. Das Tool zeigte, dass ein 100-Dollar/Monat-Plan in einem Monat 13.286 Dollar an äquivalenter API-Rechenleistung verbrauchte.

OpenClawRadar