soul.py fügt lokalen LLMs mit einem einfachen dateibasierten Ansatz persistente Speicherung hinzu

soul.py ist eine Python-Bibliothek, die persistente Speicherung für lokale LLM-Sitzungen bereitstellt, indem sie den Konversationsverlauf in menschenlesbaren Markdown-Dateien speichert, wodurch Datenbanken oder laufende Server überflüssig werden.
Funktionsweise
Die Bibliothek erstellt zwei Markdown-Dateien: SOUL.md für Identitätsinformationen und MEMORY.md für Konversationsprotokolle. Jedes Mal, wenn Sie agent.ask() aufrufen, liest das System beide Dateien in die Systemaufforderung ein, verarbeitet die Anfrage und fügt den Austausch dann an MEMORY.md an. Dadurch bleibt der Speicher über Prozesse und Sitzungen hinweg erhalten.
Grundlegende Verwendung
Installation und Einrichtung:
pip install soul-agent
soul initBeispielimplementierung mit Ollama:
from soul import Agent
agent = Agent(
provider="openai-compatible",
base_url="http://localhost:11434/v1",
model="llama3.2",
api_key="ollama"
)
agent.ask("Mein Name ist Prahlad, ich arbeite in einem KI-Forschungslabor.")
Später in einer neuen Sitzung:
agent.ask("Was wissen Sie über mich?")
Antwort: "Sie sind Prahlad und arbeiten in einem KI-Forschungslabor."
Hauptmerkmale
- Funktioniert mit Ollama-, OpenAI- und Anthropic-Modellen
- Keine Datenbank oder Server erforderlich
- Menschenlesbare Markdown-Dateien
- Git-versionierbar und manuell bearbeitbar
- Speicher bleibt über Prozesse und Sitzungen hinweg erhalten
- Speziell für die Hinzufügung von persistentem Speicher zu lokalen Modellen entwickelt
Das Tool wurde entwickelt, um das Problem zu lösen, dass lokale LLMs Informationen zwischen Sitzungen vergessen, und bietet eine leichtgewichtige Alternative zu datenbankgestützten Lösungen.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Claude Code schreibt PostHogs SQL-Parser neu: 70-fache Beschleunigung durch eigenschaftsbasiertes Testen und parallele Agenten
PostHog nutzte mehrere parallele Claude Code Sitzungen, um ihren SQL-Parser neu zu schreiben und erreichte eine 70-fache Beschleunigung. Der neue Parser besteht aus 16.000 Zeilen handgeschriebenem rekursiv-absteigendem Code mit eigenschaftsbasierten Tests.

KI-Funktionen: Laufzeit-Codegenerierung mit automatisierter Verifizierung
AI Functions ist eine Python-Bibliothek, mit der Sie Funktionen mit natürlichen Sprachspezifikationen anstelle von Implementierungscode definieren können, zur Laufzeit generierten LLM-Code ausführt und Ausgaben mit Nachbedingungen validiert, die bei Fehlern automatische Wiederholungen auslösen.

SideX: Ein auf Tauri basierender Port von Visual Studio Code
SideX ist ein Port von Visual Studio Code, der Electron durch Tauri ersetzt und dabei ein Rust-Backend und die native Webview des Betriebssystems nutzt. Das Projekt beansprucht dieselbe Architektur mit 96 % geringerer Größe, wobei Kern-Editier- und Terminalfunktionen derzeit funktionieren.

Aufbau eines sprachgesteuerten Multi-Agenten-Systems auf Basis von Claude Code
Ein Entwickler baute eine sprachgesteuerte Wake-Word-Schleife für Claude Code, die Unter-Agents spawnen, Arbeit parallelisieren und Ergebnisse automatisch einer Qualitätssicherung unterzieht. Vollständige technische Aufschlüsselung inklusive Sprecherverifizierung und PID-Watcher.