RAG Híbrido para Memória de Agente Local com OpenClaw, Ollama e nomic-embed-text

✍️ OpenClawRadar📅 Publicado: March 10, 2026🔗 Source
RAG Híbrido para Memória de Agente Local com OpenClaw, Ollama e nomic-embed-text
Ad

Problema: Recuperação, Não Armazenamento

O desenvolvedor tinha meses de registros de memória diários armazenados em arquivos markdown, o que funcionava para salvar informações, mas não para encontrá-las novamente. Quando o agente precisava de contexto passado, ele voltava a executar ls, abrindo arquivos um por um, gastando tokens e às vezes perdendo informações relevantes. O problema era a recuperação por significado, não o armazenamento.

Solução: RAG Híbrido com Embeddings Locais

O desenvolvedor habilitou memorySearch no OpenClaw usando Ollama como provedor e nomic-embed-text para embeddings locais, rodando em modo híbrido. Híbrido significa 70% de similaridade vetorial (cosseno via nomic-embed-text) combinado com 30% de correspondência de palavras-chave BM25. O vetor lida com proximidade semântica enquanto o BM25 lida com nomes exatos, versões e IDs. O MMR reduz resultados redundantes, e o decaimento temporal dá mais peso aos registros recentes. Tudo roda localmente sem APIs externas.

Configuração

"memorySearch": {
  "provider": "ollama",
  "query": {
    "hybrid": {
      "enabled": true,
      "vectorWeight": 0.7,
      "textWeight": 0.3,
      "mmr": {
        "enabled": true,
        "lambda": 0.7
      },
      "temporalDecay": {
        "enabled": true,
        "halfLifeDays": 30
      }
    }
  }
}

Instruções de Configuração

  • OpenClaw detecta Ollama automaticamente em localhost:11434
  • Não é necessário especificar baseUrl ou modelo - ele pega nomic-embed-text se baixado
  • Execute ollama pull nomic-embed-text primeiro, depois reinicie o gateway
  • Evite definir provider: "openai" e apontar baseUrl para Ollama - use provider: "ollama" diretamente
Ad

Mudança Comportamental Necessária

Habilitar a ferramenta não foi suficiente. Sem instruções explícitas para usar memorySearch antes de ler arquivos diretamente, o agente pulava isso e tomava a rota mais lenta e pesada em tokens. O desenvolvedor escreveu uma regra tanto no AGENTS.md quanto no MEMORY.md no workspace para tornar a busca de memória parte do fluxo de trabalho normal do agente.

Resultados Antes vs Depois

  • Antes: Navegar pastas, abrir arquivos às cegas, torcer para a redação corresponder, desperdiçar tokens, perder contexto
  • Depois: Executar memory_search com consulta semântica, recuperar resultados classificados com pontuações de similaridade, abrir a melhor correspondência, responder a partir de notas passadas reais
  • Pontuações de similaridade para resultados relevantes normalmente variam de 0,45 a 0,48 para nomic-embed-text em registros de prosa

Notas Práticas

  • nomic-embed-text tem um limite de contexto de 2048 tokens por padrão, não 8192 - arquivos grandes podem ser truncados na indexação
  • Arquivos de memória em espanhol funcionam bem - nomic-embed-text lida com espanhol sem problemas
  • A qualidade da recuperação depende da qualidade das notas - registros vagos ainda causam dificuldades na busca semântica

Stack Tecnológico

  • OpenClaw (local, auto-hospedado)
  • Ollama + nomic-embed-text:latest
  • SQLite com sqlite-vec e FTS5 (criado automaticamente pelo OpenClaw no primeiro uso)
  • Mac mini M4, 16GB de memória unificada

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

🦀
Use Cases

OpenClaw + Shopify: Agentes de IA gerenciam caixa de entrada, e-mail, iMessage e até criação de produtos a partir de fotos

Um usuário detalha a configuração do OpenClaw para gerenciar Inbox, Email e iMessage para informações de pedidos, além de usar Claude com Shopify CLI para realizar qualquer ação na loja via texto. Um fluxo notável: enviar uma foto do iPhone, o OpenClaw a lê e publica o produto com todos os campos preenchidos.

OpenClawRadar
Construindo um Radar de Shows com OpenClaw: Coletando Dados de Múltiplas Fontes para Apresentações de Artistas
Use Cases

Construindo um Radar de Shows com OpenClaw: Coletando Dados de Múltiplas Fontes para Apresentações de Artistas

Um desenvolvedor criou um radar de shows usando OpenClaw em um VPS que puxa artistas do Spotify, escaneia múltiplas fontes diariamente, normaliza eventos, combina artistas, remove duplicatas e rastreia novos anúncios via tarefas cron.

OpenClawRadar
Configuração de Orquestração Multi-IA Usando Claude Code com GPT e Gemini
Use Cases

Configuração de Orquestração Multi-IA Usando Claude Code com GPT e Gemini

Um desenvolvedor compartilha sua configuração onde o Claude Code orquestra o GPT-5.4 e o Gemini 3.1 Pro no mesmo IDE, usando arquivos markdown para contexto persistente e comandos CLI para comunicação entre modelos.

OpenClawRadar
Desenvolvedor Cria Sistema Empresarial Personalizado no Claude com Memória Persistente e Composição de Habilidades
Use Cases

Desenvolvedor Cria Sistema Empresarial Personalizado no Claude com Memória Persistente e Composição de Habilidades

Um desenvolvedor criou um sistema personalizado no Claude Pro que vai além de tarefas básicas, apresentando 13 habilidades personalizadas com entradas/saídas definidas, memória persistente entre sessões, briefings diários automatizados e composições de habilidades que encadeiam ou paralelizam operações. O sistema roda em Supabase, Cloudflare Pages e HTML/CSS/JS vanilla.

OpenClawRadar