Soul MCP Server fügt lokalen LLMs persistente Speicher und Sicherheit hinzu

✍️ OpenClawRadar📅 Veröffentlicht: 22. März 2026🔗 Source
Soul MCP Server fügt lokalen LLMs persistente Speicher und Sicherheit hinzu
Ad

Was Soul leistet

Soul ist ein Open-Source-MCP-Server, der entwickelt wurde, um das Sitzungsspeicherproblem für lokale LLMs zu lösen. Durch die Verwendung von zwei einfachen Befehlen ermöglicht er Agenten, sich alles über Sitzungen hinweg zu merken, anstatt am Ende jeder Sitzung zu vergessen.

Hauptfunktionen

  • Persistenter Speicher: Zwei Befehle steuern die Speicherpersistenz: n2_boot zu Sitzungsbeginn und n2_work_end am Ende der Sitzung
  • Ark-Sicherheitssystem: Integrierte Sicherheit, die gefährliche Befehle wie rm -rf und DROP DATABASE ohne Token-Kosten blockiert
  • Cloud-Speicher: Konfigurierbarer Cloud-Speicher mit einer einzigen Konfigurationszeile
  • Open Source: Veröffentlicht unter der Apache-2.0-Lizenz
Ad

Einrichtung mit Ollama + Open WebUI

Installations- und Konfigurationsschritte:

  1. Installation via npm: npm install n2-soul
  2. In Open WebUI zu Einstellungen → Tools → MCP-Server gehen
  3. Einen neuen Server mit dem Befehl "node" hinzufügen
  4. Die Argumente auf Ihren Pfad zu node_modules/n2-soul/index.js setzen

Der Server funktioniert auch mit LM Studio und Cursor.

Zusätzliche Ressourcen

Für detaillierte Funktionen und Community-Diskussionen besuchen Sie das GitHub-Repository und verwandte Reddit-Beiträge. Der Entwickler sucht Feedback von der lokalen LLM-Community.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

SuperContext: Ein Persistent Memory Framework für KI-Codierungsagenten
Werkzeuge

SuperContext: Ein Persistent Memory Framework für KI-Codierungsagenten

SuperContext ist ein Open-Source-Framework, das KI-Codierungswerkzeugen wie Claude durch strukturierte, zielgerichtete Dateien anstelle großer Anleitungsdokumente dauerhafte Erinnerung verleiht. Es enthält einen ausführbaren Prompt, der das System in etwa 10 Minuten ohne manuelle Einrichtung aufbaut.

OpenClawRadar
SpruceChat läuft mit 0,5B LLM direkt auf Miyoo-Handhelds über llama.cpp
Werkzeuge

SpruceChat läuft mit 0,5B LLM direkt auf Miyoo-Handhelds über llama.cpp

SpruceChat führt Qwen2.5-0.5B vollständig auf dem Gerät auf Handheld-Spielgeräten mit llama.cpp aus, ohne Cloud oder WiFi zu benötigen. Auf einem Miyoo A30 (Cortex-A7 Quad-Core) lädt es in ~60 Sekunden und generiert mit ~1-2 Token/Sekunde.

OpenClawRadar
Krasis: Hybride CPU/GPU-Laufzeitumgebung für große MoE-Modelle erreicht 3.324 Tok/s Prefill auf RTX 5080
Werkzeuge

Krasis: Hybride CPU/GPU-Laufzeitumgebung für große MoE-Modelle erreicht 3.324 Tok/s Prefill auf RTX 5080

Krasis ist eine hybride CPU/GPU-Laufzeitumgebung, die große MoE-Modelle ausführt, indem sie die Vorausfüllung auf der GPU und die Dekodierung auf der CPU verarbeitet. Sie erreicht 3.324 Token/Sekunde bei der Vorausfüllung auf einer RTX 5080 mit Qwen3-Coder-Next 80B Q4. Sie benötigt etwa das 2,5-fache der Modellgröße im System-RAM, ermöglicht aber die Ausführung von Modellen, die für den VRAM zu groß sind.

OpenClawRadar
FlowBoard v5: Der Projektarbeitsbereich, in dem Ihre KI-Agenten tatsächlich laufen
Werkzeuge

FlowBoard v5: Der Projektarbeitsbereich, in dem Ihre KI-Agenten tatsächlich laufen

FlowBoard v5 ist ein React-basiertes Projekt-Workspace für KI-Agenten mit einem ereignisgesteuerten Task-Speicher (SQLite), Multi-Agenten-Unterstützung, Ideen-zu-Spezifikationen-Schleife und modularen Übersichts-Widgets.

OpenClawRadar