Lokales MCP-Speichersystem mit Konsolidierung für KI-Gespräche

✍️ OpenClawRadar📅 Veröffentlicht: 26. Februar 2026🔗 Source
Lokales MCP-Speichersystem mit Konsolidierung für KI-Gespräche
Ad

Was das ist

Ein Entwickler hat ein lokales Speichersystem für KI-Gespräche geschaffen, das Informationen konsolidiert und synthetisiert, anstatt sie nur zu speichern. Als MCP-Server aufgebaut, funktioniert es mit kompatiblen Clients wie Claude Desktop und Claude Code und läuft zu 100 % lokal, ohne dass Daten Ihre Hardware verlassen.

Wie es funktioniert

Der entscheidende Unterschied zu herkömmlichen RAG-Systemen ist der Konsolidierungsprozess. Alle 6 Stunden gruppiert eine lokale LLM (Qwen 2.5-7B, die in LM Studio läuft) aktuelle Erinnerungen nach Themen und fasst sie zu strukturierten Wissensdokumenten zusammen. Sie extrahiert Fakten, Lösungen und Präferenzen, vereint sie mit bestehendem Wissen und versioniert alles.

Technischer Stack

  • Embeddings: nomic-embed-text-v1.5 über LM Studio
  • Vektorsuche: FAISS (semantisch + Keyword-Hybrid)
  • Konsolidierungs-LLM: Qwen 2.5-7B (Q4) über LM Studio
  • Speicher: SQLite für Episoden, FAISS für Vektoren
  • Protokoll: MCP – funktioniert mit allem, was es unterstützt
  • Konfiguration: TOML

Funktionen

  • Semantische Deduplizierung mit Kosinus-Ähnlichkeitsschwelle von 0,95
  • Adaptives Überraschungs-Scoring – häufig genutzte Erinnerungen werden verstärkt, veraltete verblassen
  • Atomare Schreibvorgänge mit tempfile + os.replace für Absturzschutz
  • Tombstone-basierte FAISS-Löschung – O(1) anstatt den gesamten Index neu aufzubauen
  • Graceful Degradation – wenn LM Studio ausfällt, funktioniert die Speicherung weiter, Konsolidierung pausiert
  • 88 Tests bestanden
Ad

MCP-Tools

  • memory_store – speichere eine Episode mit Typ, Tags, Überraschungs-Score
  • memory_recall – semantische Suche über Episoden + konsolidiertes Wissen
  • memory_forget – markiere eine Episode zur Entfernung
  • memory_correct – aktualisiere ein Wissensdokument
  • memory_export – vollständiges JSON-Backup
  • memory_status – Systemstatusprüfung

Warum MCP gewählt wurde

Modelle werden häufig ersetzt, aber angesammeltes Wissen sollte nicht mit ihnen verschwinden. MCP macht den Speicher portabel – ein Speicher, viele Schnittstellen. Die Speicherschicht wird wertvoller als jedes einzelne Modell.

Praktische Ergebnisse

Nach etwa einer Woche Nutzung hat das System Wissensdokumente über PC-Hardware, VR-Einrichtung, Programmierpräferenzen und Projektarchitekturen aufgebaut – alles aus normalen Gesprächen synthetisiert. Wenn neue Chats beginnen, kennt die KI bereits den Kontext des Nutzers, ohne dass er ihn neu erklären muss.

Anforderungen

  • Python 3.11+
  • LM Studio mit geladenem Qwen 2.5-7B und nomic-embed-text-v1.5
  • Beliebiger MCP-Client

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

Code-Evolution-Methode verdreifacht die Leistung von LLM im ARC-AGI-2-Benchmark
Werkzeuge

Code-Evolution-Methode verdreifacht die Leistung von LLM im ARC-AGI-2-Benchmark

Forscher erzielten eine 2,8-fache Verbesserung auf dem ARC-AGI-2-Benchmark durch Code-Evolution mit Open-Weight-Modellen und erreichten 34 % Genauigkeit bei 2,67 US-Dollar pro Aufgabe. Dieselbe Methode brachte Gemini 3.1 Pro auf 95 % Genauigkeit bei 8,71 US-Dollar pro Aufgabe.

OpenClawRadar
Relay: Ein Tool zur Übergabe von Claude-Code-Sitzungen an andere KI-Agenten
Werkzeuge

Relay: Ein Tool zur Übergabe von Claude-Code-Sitzungen an andere KI-Agenten

Relay ist ein Rust-Binary, das den Sitzungskontext von Claude Code extrahiert – einschließlich Gesprächsverlauf, Tool-Aufrufe, Fehler und Git-Status – und ihn an andere KI-Agenten wie Codex oder Gemini weitergibt, wenn Ratenlimits erreicht werden. Es unterstützt 8 Agenten und kann über GitHub oder npm installiert werden.

OpenClawRadar
HN SOTA: Verfolgung der Beliebtheit von Codierungsmodellen durch Hacker News-Kommentare
Werkzeuge

HN SOTA: Verfolgung der Beliebtheit von Codierungsmodellen durch Hacker News-Kommentare

HN SOTA ist eine täglich aktualisierte Pipeline, die Hacker News-Kommentare scannt, Gemini verwendet, um Codierungsmodelle aus der OpenRouter-Liste zu identifizieren, und die Stimmung pro Erwähnung in einem öffentlichen Google Sheet protokolliert. Die Top-10-Modelle nach Erwähnungen über ein gleitendes 10-Tage-Fenster werden angezeigt.

OpenClawRadar
XLI: Open-Source Python-Bibliothek für Claude Code-ähnliche Terminal-Benutzeroberflächen
Werkzeuge

XLI: Open-Source Python-Bibliothek für Claude Code-ähnliche Terminal-Benutzeroberflächen

Du baust einen Coding-Agenten? Das Terminal-UI ist die halbe Arbeit. XLI ist eine Open-Source-Python-Bibliothek, die Claude Codes Streaming-Markdown, Tool-Karten, Inline-Genehmigungen und Slash-Befehle nachbildet – ohne die Bildlauffunktion deines Terminals zu kapern.

OpenClawRadar