Open-Source-MCP-Speicherserver mit Wissensgraphen und Lernfunktionen

Ein Open-Source-MCP-Server namens cuba-memorys bietet persistenten Speicher für KI-Agenten und geht über einfache RAG- oder Vektorspeicher hinaus. Geschrieben in Rust mit einem PostgreSQL + pgvector-Backend implementiert er eine Wissensgraphen-Architektur mit Lernfähigkeiten.
Architektur und Funktionen
Das System speichert Entitäten, Beobachtungen und typisierte Beziehungen statt flacher Dokumente. Wichtige Funktionen umfassen:
- Exponentieller Zerfall — Erinnerungen verblassen realistisch mittels Wichtigkeit = Wichtigkeit * exp(-0,693 * Tage/Halbwertszeit) mit einer 30-Tage-Halbwertszeit
- Hebb'sche + BCM-Metaplastizität — Ojas Regel mit EMA-Gleitwert-Schwelle; Erinnerungen verstärken sich durch Zugriff und normalisieren sich selbst via BCM
- 4-Signal-RRF-Fusion (k=60) — Kombiniert ts_rank + Trigramme + pgvector HNSW + Wichtigkeit mit entropiegesteuerter Gewichtung, um schlüsselwortdominante vs. semantische Abfragen zu erkennen
- Leiden-Community-Erkennung — Traag et al. 2019 Algorithmus zur Entdeckung von Clustern im Wissensgraphen
- Personalisierter PageRank — Bewertet Entitätswichtigkeit basierend auf Graphentopologie
- Anti-Halluzinations-Verifizierung — Trianguliert Behauptungen gegen gespeichertes Wissen mit abgestufter Konfidenzbewertung
- Fehlerspeicher mit Mustererkennung — Löst Warnungen aus, wenn ≥3 ähnliche Fehler auftreten
Leistungsbenchmarks
Die Rust-Implementierung zeigt deutliche Verbesserungen gegenüber der ursprünglichen Python-Version:
- Binärgröße: ~50MB venv (Python) vs 7,6MB (Rust)
- Entität erstellen: ~2ms (Python) vs 498μs (Rust)
- Hybridsuche: <5ms (Python) vs 2,52ms (Rust)
- Speichernutzung: ~120MB (Python) vs ~15MB (Rust)
- Abhängigkeiten: 12 Pakete (Python) vs 0 Laufzeit (Rust)
Implementierungsdetails
Der Server bietet 13 MCP-Tools und funktioniert mit jedem MCP-kompatiblen Client, einschließlich Claude Code, Cursor und Windsurf. Er ist selbst gehostet mit einem PostgreSQL-Backend und macht keine externen API-Aufrufe. Alle Algorithmen basieren auf peer-reviewed Papern mit Zitaten im README.
Installationsoptionen:
pip install cuba-memorys
oder
npm install -g cuba-memorys
Das Projekt ist unter CC BY-NC 4.0 Lizenz auf GitHub verfügbar.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Strukturierte Denkvorlage verbessert die Genauigkeit von KI-Code-Reviews
Ein Reddit-Nutzer teilt eine strukturierte Denkvorlage, die von der Meta-Forschung adaptiert wurde und KI-Modelle dazu zwingt, bestimmte analytische Schritte abzuschließen, bevor sie Code-Reviews generieren, was die Genauigkeit laut arXiv:2603.01896 um 5-12 Prozentpunkte verbessert.

Claude Auto-Continue: Chrome-Erweiterung automatisiert Unterbrechungen durch das Tool-Use-Limit
Ein Entwickler hat eine kostenlose Chrome-Erweiterung erstellt, die automatisch auf 'Weiter' klickt, wenn Claude nach etwa 20 Werkzeugaufrufen sein Nutzungslimit erreicht, und so manuelle Unterbrechungen in agentenbasierten Arbeitsabläufen eliminiert. Die Erweiterung enthält eine optionale Token-Minimierung und funktioniert über alle Tabs und Fenster hinweg.

Exasol veröffentlicht MCP-Server für Datenbankkontext in KI-Agenten-Workflows
Exasol hat einen MCP-Server veröffentlicht, der Datenbanken ermöglicht, KI-Agenten Kontext über verfügbare Daten, Geschäftsregeln und sichere Interaktionsmethoden bereitzustellen. Der Server ist standardmäßig schreibgeschützt, unterstützt hochparallele Workflows und kann on-premise, in der Cloud oder in hybriden Umgebungen eingesetzt werden.

DeepSeek V4 Flash liefert nahe Opus-Qualität für lokale LLMs vor Ort
Reddit-Benutzer berichtet, dass DeepSeek 4 Flash für lokale KI-Agenten mit vertraulichen Daten eine Leistung nahe Opus-Niveau erreicht und einen lokalen Einsatz ohne AWS ermöglicht. Läuft lokal mit NVIDIA-GPUs, aber bei 1M Token immer noch langsam.