RAG Hybride pour la Mémoire d'Agent Local avec OpenClaw, Ollama et nomic-embed-text

✍️ OpenClawRadar📅 Publié: March 10, 2026🔗 Source
RAG Hybride pour la Mémoire d'Agent Local avec OpenClaw, Ollama et nomic-embed-text
Ad

Problème : Récupération, pas stockage

Le développeur avait des mois de journaux de mémoire quotidiens stockés dans des fichiers markdown, ce qui fonctionnait pour sauvegarder les informations mais pas pour les retrouver. Lorsque l'agent avait besoin d'un contexte passé, il revenait à exécuter ls, ouvrait les fichiers un par un, dépensait des tokens et parfois manquait des informations pertinentes. Le problème était la récupération par signification, pas le stockage.

Solution : RAG hybride avec plongements locaux

Le développeur a activé memorySearch dans OpenClaw en utilisant Ollama comme fournisseur et nomic-embed-text pour les plongements locaux, fonctionnant en mode hybride. Hybride signifie 70% de similarité vectorielle (cosinus via nomic-embed-text) combinée à 30% de correspondance par mots-clés BM25. Les vecteurs gèrent la proximité sémantique tandis que BM25 gère les noms exacts, les versions et les identifiants. MMR réduit les résultats redondants, et la décroissance temporelle donne plus de poids aux journaux récents. Tout fonctionne localement sans API externes.

Configuration

"memorySearch": {
  "provider": "ollama",
  "query": {
    "hybrid": {
      "enabled": true,
      "vectorWeight": 0.7,
      "textWeight": 0.3,
      "mmr": {
        "enabled": true,
        "lambda": 0.7
      },
      "temporalDecay": {
        "enabled": true,
        "halfLifeDays": 30
      }
    }
  }
}

Instructions d'installation

  • OpenClaw détecte Ollama automatiquement à localhost:11434
  • Pas besoin de spécifier baseUrl ou modèle - il récupère nomic-embed-text s'il est téléchargé
  • Exécutez ollama pull nomic-embed-text d'abord, puis redémarrez la passerelle
  • Évitez de définir provider: "openai" et de pointer baseUrl vers Ollama - utilisez provider: "ollama" directement
Ad

Changement comportemental requis

Activer l'outil n'était pas suffisant. Sans instructions explicites pour utiliser memorySearch avant de lire les fichiers directement, l'agent le sautait et prenait la voie plus lente et consommatrice de tokens. Le développeur a écrit une règle dans AGENTS.md et MEMORY.md dans l'espace de travail pour intégrer la recherche de mémoire dans le flux de travail normal de l'agent.

Résultats avant vs après

  • Avant : Parcourir les dossiers, ouvrir les fichiers aveuglément, espérer que la formulation corresponde, gaspiller des tokens, manquer le contexte
  • Après : Exécuter memory_search avec une requête sémantique, récupérer des résultats classés avec des scores de similarité, ouvrir la meilleure correspondance, répondre à partir de notes passées réelles
  • Les scores de similarité pour les résultats pertinents varient généralement de 0,45 à 0,48 pour nomic-embed-text sur les journaux en prose

Notes pratiques

  • nomic-embed-text a une limite de contexte de 2048 tokens par défaut, pas 8192 - les gros fichiers peuvent être tronqués lors de l'indexation
  • Les fichiers de mémoire en espagnol fonctionnent bien - nomic-embed-text gère l'espagnol sans problème
  • La qualité de la récupération dépend de la qualité des notes - les journaux vagues causent toujours des difficultés à la recherche sémantique

Pile technologique

  • OpenClaw (local, auto-hébergé)
  • Ollama + nomic-embed-text:latest
  • SQLite avec sqlite-vec et FTS5 (créé automatiquement par OpenClaw lors de la première utilisation)
  • Mac mini M4, 16 Go de mémoire unifiée

📖 Lire la source complète : r/openclaw

Ad

👀 See Also

Création d'un CLI de revue de code IA avec Claude : une voie non conventionnelle
Use Cases

Création d'un CLI de revue de code IA avec Claude : une voie non conventionnelle

GrandCru est un outil CLI de revue de code développé par un ancien officier militaire utilisant l'IA Claude. Il propose un schéma Zod à double canal pour les retours techniques et les commentaires créatifs.

OpenClawRadar
L'agent IA OpenClaw identifie de manière autonome les bogues, crée et soumet des PR GitHub.
Use Cases

L'agent IA OpenClaw identifie de manière autonome les bogues, crée et soumet des PR GitHub.

Un développeur rapporte que son agent d'IA OpenClaw a diagnostiqué un problème récurrent, l'a retracé jusqu'à un package tiers, puis a créé de manière autonome une branche GitHub, effectué plusieurs commits, révisé son propre code et soumis une pull request au dépôt du package.

OpenClawRadar
Start-up de santé IA utilise l'IA et un partenariat avec Mark Cuban pour lutter contre les refus de remboursement d'assurance.
Use Cases

Start-up de santé IA utilise l'IA et un partenariat avec Mark Cuban pour lutter contre les refus de remboursement d'assurance.

Une startup spécialisée dans l'IA pour la santé a développé des outils utilisant l'intelligence artificielle pour aider à contester et faire annuler des refus de remboursement d'assurance maladie, avec la participation de Mark Cuban dans l'approche de la startup.

OpenClawRadar
Création d'un Bot de Surveillance pour Chats sur Discord avec ESP32-S3, MiniClaw et l'IA Multimodale
Use Cases

Création d'un Bot de Surveillance pour Chats sur Discord avec ESP32-S3, MiniClaw et l'IA Multimodale

Un développeur a créé un bot Discord utilisant un ESP32-S3 Sense avec MiniClaw qui capture des images ou de l'audio de son chat, les envoie au modèle VLM-4V de Zhipu AI et renvoie des descriptions en langage naturel au lieu d'alertes de mouvement génériques.

OpenClawRadar