Memento Vault: Lokales Tool für dauerhaften Kontext in Claude-Code-Sitzungen

✍️ OpenClawRadar📅 Veröffentlicht: 27. März 2026🔗 Source
Memento Vault: Lokales Tool für dauerhaften Kontext in Claude-Code-Sitzungen
Ad

Memento Vault löst das Problem, dass Claude Code Kontexte zwischen Sitzungen vergisst, indem es automatisch relevante Informationen erfasst und abruft – ohne manuelle Wartung.

Funktionsweise

Das Tool nutzt Hooks, die in den Lebenszyklus von Claude Code eingreifen:

  • Bei Sitzungsende: Ein Hook liest das Protokoll, bewertet es und entscheidet, was behalten wird. Bedeutende Sitzungen führen zu atomaren Notizen in einem lokalen Git-Repo. Jede Notiz enthält eine Idee mit Frontmatter (inklusive Zuverlässigkeitsbewertungen und Tags) sowie Wikilinks zu verwandten Notizen. Unbedeutende Sitzungen erhalten einen Einzeiler in einem Tageslog.
  • Bei Sitzungsbeginn: Es injiziert eine Einführung, die Ihre letzten Projektsitzungen und die relevantesten Vault-Notizen für Ihre anstehende Arbeit anzeigt.
  • Bei jeder Eingabe: Es durchsucht Ihren Vault und zeigt passende Notizen an, bevor Claude Ihre Eingabe verarbeitet.
  • Bei jedem Dateizugriff: Es fügt Kontext zu Codebereichen hinzu, die Sie zuvor bearbeitet haben.
Ad

Technische Details

Alle Abfragen nutzen lokale BM25 + Vektorsuche ohne LLM-Aufrufe. Das System hat eine durchschnittliche Latenz von 472 ms pro Eingabe und verursacht keine Betriebskosten. Der Kontext-Overhead beträgt etwa 149 Eingabeeinheiten pro Sitzung. Die Abfragequalität erreicht NDCG@10 = 0.892 auf LongMemEval (500 Fragen).

Eine Hintergrund-Konsolidierungsschicht namens Inception clustert Notizen nach Ähnlichkeit der Embeddings und erstellt nach Sitzungen Muster-Notizen, die wiederkehrende Probleme über Projekte hinweg identifizieren.

Das gesamte System verwendet Markdown-Dateien in einem Git-Repo, die in Obsidian durchsuchbar, mit grep durchsuchbar und mit git log vergleichbar sind. Es gibt keine Datenbank-, Docker- oder Cloud-Abhängigkeiten.

Installation

git clone https://github.com/sandsower/memento-vault.git
cd memento-vault
./install.sh --experimental

Voraussetzungen: Python 3 und Claude Code. QMD fügt semantische Suche hinzu (optional). Läuft unter Linux und macOS.

Das Projekt umfasst 271 Tests und ist unter MIT-Lizenz veröffentlicht.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Auto Router vs Sonnet: Kosteneinsparungen vs Antwortqualität
Werkzeuge

Auto Router vs Sonnet: Kosteneinsparungen vs Antwortqualität

Die Auto Router-Funktion von Open Router wählt LLMs dynamisch basierend auf der Kontextkomplexität aus und bietet erhebliche Kosteneinsparungen (0,8 Cent vs. 0,00071 Cent pro Anfrage), aber Nutzer berichten von einer verschlechterten Antwortqualität im Vergleich zu Sonnet 4.6.

OpenClawRadar
MCP als Beobachtbarkeitsschnittstelle: Verbindung von KI-Agenten mit Kernel-Tracepoints
Werkzeuge

MCP als Beobachtbarkeitsschnittstelle: Verbindung von KI-Agenten mit Kernel-Tracepoints

Das Model Context Protocol (MCP) entwickelt sich zur Schnittstelle zwischen KI-Agenten und Infrastruktur-Telemetrie, wobei Datadog einen MCP-Server ausliefert und Qualys Sicherheitsbedenken äußert. Der Artikel untersucht zwei Ansätze: das Einbinden bestehender Plattformen oder den Aufbau von MCP-nativer Observability, die direkt mit Kernel-Tracepoints verbindet.

OpenClawRadar
Hollow AgentOS reduziert den Claude-Code-Token-Verbrauch um 68,5 % mit einem JSON-nativen Betriebssystem für KI-Agenten.
Werkzeuge

Hollow AgentOS reduziert den Claude-Code-Token-Verbrauch um 68,5 % mit einem JSON-nativen Betriebssystem für KI-Agenten.

Hollow AgentOS ist ein JSON-natives Betriebssystem für KI-Agenten, das den Token-Verbrauch von Claude Code um 68,5 % reduziert, indem es ineffiziente Shell-Befehl-Overheads eliminiert. Es integriert sich über MCP in Claude Code, führt lokale Inferenz über Ollama aus und ist unter der MIT-Lizenz verfügbar.

OpenClawRadar
Lokale Qwen-Modelle erreichen Browser-Automatisierung mit schrittweiser Planung und kompakter DOM.
Werkzeuge

Lokale Qwen-Modelle erreichen Browser-Automatisierung mit schrittweiser Planung und kompakter DOM.

Ein Entwickler fand heraus, dass kleine lokale LLMs wie Qwen 8B und 4B bei der Browser-Automatisierung erfolgreich sind, indem sie schrittweise Planung anstelle von vorab erstellten Mehrschrittplänen verwenden, kombiniert mit einer kompakten semantischen DOM-Darstellung, die den Token-Verbrauch von 50-100K+ auf ~15K für vollständige Abläufe reduziert.

OpenClawRadar