Soul MCP Server fügt lokalen LLMs persistente Speicher und Sicherheit hinzu

Was Soul leistet
Soul ist ein Open-Source-MCP-Server, der entwickelt wurde, um das Sitzungsspeicherproblem für lokale LLMs zu lösen. Durch die Verwendung von zwei einfachen Befehlen ermöglicht er Agenten, sich alles über Sitzungen hinweg zu merken, anstatt am Ende jeder Sitzung zu vergessen.
Hauptfunktionen
- Persistenter Speicher: Zwei Befehle steuern die Speicherpersistenz:
n2_bootzu Sitzungsbeginn undn2_work_endam Ende der Sitzung - Ark-Sicherheitssystem: Integrierte Sicherheit, die gefährliche Befehle wie
rm -rfundDROP DATABASEohne Token-Kosten blockiert - Cloud-Speicher: Konfigurierbarer Cloud-Speicher mit einer einzigen Konfigurationszeile
- Open Source: Veröffentlicht unter der Apache-2.0-Lizenz
Einrichtung mit Ollama + Open WebUI
Installations- und Konfigurationsschritte:
- Installation via npm:
npm install n2-soul - In Open WebUI zu Einstellungen → Tools → MCP-Server gehen
- Einen neuen Server mit dem Befehl "node" hinzufügen
- Die Argumente auf Ihren Pfad zu
node_modules/n2-soul/index.jssetzen
Der Server funktioniert auch mit LM Studio und Cursor.
Zusätzliche Ressourcen
Für detaillierte Funktionen und Community-Diskussionen besuchen Sie das GitHub-Repository und verwandte Reddit-Beiträge. Der Entwickler sucht Feedback von der lokalen LLM-Community.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

tmux-IDE: Eine terminalbasierte Multi-Agenten-IDE für Claude
tmux-IDE ist eine quelloffene, deklarative Terminal-IDE, die sich auf agentenbasierte Entwicklung konzentriert und Multi-Agenten-Layouts für Claude-Coding-Agenten erstellt. Es ermöglicht Entwicklern, sich über SSH in ihre IDE einzuloggen, Claude Anweisungen zu geben und ihren Computer auszuschalten, während Claude weiterhin in tmux-Sitzungen arbeitet.

Kopflose OpenClaw-Einrichtung mit Discord über Docker-Skripte
Ein GitHub-Repository bietet Skripte, um OpenClaw mit Discord in einem headless Docker-Container auszuführen und dabei die TUI/WebUI zu umgehen. Es enthält ein Verwaltungsskript mit Befehlen wie claw init, start und stop sowie vorkonfigurierte Unterstützung für die OpenAI Responses API, Chromium und verschiedene Tools.

Entwickler erreicht Sub-Sekunden-Latenz bei STT/TTS mit lokalen Whisper- und Coqui-TTS-Servern
Ein Entwickler hat Open-Source-Server-Implementierungen für Whisper STT und Coqui TTS veröffentlicht, die eine Latenz von etwa 0,2 Sekunden für Spracherkennung und etwa 250 ms für Sprachsynthese erreichen, wodurch konversationelle KI-Agenten ohne Cloud-Abhängigkeiten ermöglicht werden.

Gemma-4 26B-A4B mit Opencode läuft effizient auf dem M5 MacBook Air
Ein 32GB M5 MacBook Air kann das Gemma-4-26B-A4B-it-UD-IQ4_XS-Modell mit 300 Token/Sekunde bei der Eingabeverarbeitung und 12 Token/Sekunde bei der Generierung im Energiesparmodus ausführen, wobei es nur 8W Leistung verbraucht, ohne warm oder laut zu werden.