Lokale semantische Speichersuche für OpenClaw-Agenten mittels Harrier-Embeddings

Ein neues Repository zeigt, wie man einem OpenClaw-Agenten eine lokale semantische Gedächtnissuche ohne das Senden von Embeddings an einen externen Dienst ermöglicht. Der Ansatz betreibt einen kleinen lokalen Embedding-Server auf Basis von Microsofts Harrier-Modell (microsoft/harrier-oss-v1-0.6b), stellt eine Ollama-kompatible API bereit und verbindet diese mit OpenClaws memorySearch-Konfiguration.
Wie es funktioniert
Der Embedding-Server führt Harrier lokal aus und bietet die Endpunkte /api/embed und /api/embeddings an, die dem API-Format von Ollama entsprechen. OpenClaws memorySearch unterstützt bereits Ollama-ähnliche Endpunkte, daher genügt es, auf http://localhost:8000 zu verweisen, um dem Agenten eine lokale, hochmoderne semantische Gedächtnisschicht zu geben.
Warum dies für das Agentengedächtnis wichtig ist
Die meisten Agent-Gedächtnissysteme haben zwei Schwachstellen:
- Zu viel Gedächtnis in den Prompt zu stopfen, verbrennt Tokens und macht den Kontext unübersichtlich.
- Gedächtnisdateien klein und manuell zu halten, wird mit wachsender Historie schwer wartbar.
Die semantische Gedächtnissuche bietet einen Mittelweg. Das Langzeitgedächtnis bleibt in normalen Markdown-Dateien (MEMORY.md, tägliche Protokolle, Notizen, Projektdateien), die lesbar und bearbeitbar sind. Zur Laufzeit ruft der Agent nur relevante Abschnitte ab.
Vorteile
- Weniger Tokenverschwendung – nicht jede dauerhafte Tatsache wird in jeden Prompt gestopft.
- Sauberere Gedächtnisdateien – keine Notwendigkeit, alles in einen riesigen Kontextklumpen zu pressen.
- Besseres Abrufen – findet konzeptionell verwandte Notizen, auch wenn die Formulierung nicht exakt übereinstimmt.
- Einfachere Fehlersuche – die Quelle der Wahrheit ist Klartext, keine undurchsichtige Vektordatenbank.
- Bessere Privatsphäre – Embeddings werden lokal berechnet, keine Daten an eine gehostete API gesendet.
Was das Repository enthält
- Kleiner Python-Embedding-Server mit Ollama-kompatiblen Endpunkten
- Beispielkonfiguration für OpenClaw
memorySearch - macOS launchd-Dienstvorlage
- Mock-Markdown-Gedächtniskorpus
- Smoke-Tests und lokale Abfragedemo
Das Repository befindet sich unter github.com/promptclickrun/harrier-openclaw-memory-search.
📖 Lesen Sie die vollständige Quelle: r/openclaw
👀 Siehe auch

Benutzer berichten von gemischtem Wert aus OpenClaw und ClawDBot: Was Sie wissen müssen.
OpenClaw und ClawDBot sind vielversprechende KI-Tools zur Automatisierung von Code, haben jedoch einige Nutzer enttäuscht. Dieser Artikel untersucht wichtige Erkenntnisse aus einer Reddit-Diskussion über Nutzererfahrungen und den Wert, den diese Plattformen bieten.

Solitaire: Open-Source Identitätsinfrastruktur für KI-Agenten
Solitaire ist eine Open-Source-Identitätsinfrastruktur für KI-Agenten, die sich darauf konzentriert, wie Agenten ihre Arbeitsbeziehung mit Nutzern im Laufe der Zeit verbessern, nicht nur auf Erinnerungsabruf. Es ist lokal-first, modellunabhängig und verfügbar über pip install solitaire-ai.

Rift CLI: Verwalten Sie Git Worktrees für parallele KI-Agenten-Workflows
Rift ist ein CLI-Tool, das isolierte Git-Worktrees und Branches erstellt, um mehrere KI-Coding-Agenten wie Claude Code gleichzeitig im selben Repository auszuführen. Es umfasst Lifecycle-Hooks, deterministisches Port-Mapping und Multi-Editor-Workspace-Unterstützung.

OpenClaw React Client Update fügt Modell pro Agent, CLI-Tool und Auto-Start hinzu
Der Open-Source-OpenClaw-Client hat ein großes Update mit vier wichtigen Funktionen erhalten: Modellzuweisung pro Agent, automatische Updates, ein neues CLI-Tool zur Verwaltung und automatischer Start nach Systemneustart.