skill-depot: Ein lokales Speicher- und Fähigkeitensystem für MCP-kompatible KI-Agenten

Was skill-depot leistet
skill-depot löst das Problem, dass sich KI-Agenten-Fähigkeiten und Wissen über verstreute Verzeichnisse anhäufen. Anstatt alles in den Kontext zu laden (was Tokens verschwendet) oder nichts zu laden (und gelerntes Material zu vergessen), bietet es ein Retrieval-System, das Agentenwissen als Markdown-Dateien speichert und Vektoreinbettungen nutzt, um semantisch zu suchen und selektiv nur das zu laden, was relevant ist.
Wie es funktioniert
Agenten interagieren mit skill-depot über drei Detailstufen:
skill_search("query")liefert Suchergebnisse mit Name, Score und Ausschnittskill_preview("skill-name")liefert eine strukturierte Übersicht mit Überschriften und erstem Satz pro Abschnittskill_read("skill-name")liefert den vollständigen Markdown-Inhalt
Das Tool skill_learn ermöglicht es Agenten, Wissen spontan zu erstellen oder anzuhängen, und gibt Aktionen wie „erstellt“ oder „angefügt“ mit zusammengeführten Tags zurück.
Technische Umsetzung
- Einbettungen: Nutzt das lokale Transformer-Modell all-MiniLM-L6-v2 über ONNX (384-dimensionale Vektoren, ~80 MB einmaliger Download)
- Speicher: SQLite + sqlite-vec für Vektorsuche
- Fallback: BM25-Termfrequenzsuche, wenn das Modell nicht verfügbar ist
- Protokoll: MCP mit 9 Tools (search, preview, read, learn, save, update, delete, reindex, list)
- Format: Standard-Markdown + YAML-Frontmatter (gleiches Format wie Claude Code und Codex verwenden)
Einrichtung und Anwendungsfall
Die Einrichtung ist einfach: npx skill-depot init. Das Tool ist für lokalen, konfigurationsfreien, MCP-nativen Einsatz konzipiert, ohne API-Schlüssel zu verwalten, ohne Server zu betreiben und ohne Framework-Bindung. Der Kompromiss ist ein engerer Fokus – es bietet keine Sitzungsverwaltung oder automatische Speicherextraktion (noch nicht).
Vergleich mit anderen Tools
- mem0: Gut für verwaltete Speicherschicht mit polierter API, hat aber Cloud-Abhängigkeit
- OpenViking: Vollständige Kontextdatenbank mit Sitzungsverwaltung, Multi-Typ-Speicher und automatischer Extraktion aus Gesprächen
- LangChain/LlamaIndex-Speichermodule: Solide, wenn man bereits in diesen Ökosystemen ist
Zukünftige Überlegungen
Der Entwickler erwägt, hinzuzufügen:
- Speichertypen (Unterscheidung zwischen Fähigkeiten, Erinnerungen und Ressourcen)
- Deduplizierung, um nahezu doppelte Einträge zu erkennen
- TTL/Verfall für automatische Bereinigung temporären Wissens
- Konfidenzbewertung, bei der über mehrere Sitzungen verstärkte Erinnerungen höher eingestuft werden
📖 Read the full source: r/openclaw
👀 Siehe auch

Kontext-Routing-Schicht reduziert Claude-Code-Token-Verbrauch durch Verfolgung aufgerufener Dateien
Ein Entwickler sparte etwa 80 US-Dollar pro Monat bei der Nutzung von Claude Code, indem er eine Kontext-Routing-Ebene hinzufügte, die verhindert, dass die KI bei Folgefragen dieselben Repository-Dateien erneut liest. Das Tool verfolgt, welche Dateien bereits aufgerufen wurden, um redundanten Token-Verbrauch zu reduzieren.

agentcontract v0.0.1: Eine portable JSON-Berechtigungsschicht für KI-Codierungsagenten
agentcontract v0.0.1 führt eine portable JSON-Berechtigungsschicht für KI-Agenten ein, mit einer lokalen Browser-UI zum Bearbeiten, Validieren und Testen von Tool-Aufrufen.

Benchmark zeigt: KI-Browser-Automatisierungstools variieren um das 2,6-fache bei den Token-Kosten trotz identischer Genauigkeit
Ein Benchmark von 4 CLI-Browser-Automatisierungstools mit Claude Sonnet 4.6 bei 6 realen Aufgaben ergab, dass alle 100% Genauigkeit erreichten, aber openbrowser-ai 36.010 Tokens verwendete, während andere 77.123–94.130 Tokens benötigten. Die Anzahl der Tool-Aufrufe war der stärkste Prädiktor für die Token-Kosten.

Claude Pulse Browser-Erweiterung zeigt Token-Anzahlen, Cache-Timer und Ratenbegrenzungen auf Claude.ai an
Claude Pulse ist eine clientseitige Chrome-Erweiterung, die ein Echtzeit-Dashboard zu Claude.ai hinzufügt und Token-Zahlen pro Nachricht, gesamte Kontextnutzung, Prompt-Cache-Ablauftimer und einen Fortschrittsbalken für das Rate-Limit anzeigt. Inklusive Chat-Export nach Markdown.