Búsqueda en Memoria Semántica Local para Agentes OpenClaw Usando Embeddings Harrier

✍️ OpenClawRadar📅 Publicado: 7 de junio de 2026🔗 Source
Búsqueda en Memoria Semántica Local para Agentes OpenClaw Usando Embeddings Harrier
Ad

Un nuevo repositorio muestra cómo dar a un agente de OpenClaw búsqueda de memoria semántica local sin enviar embeddings a un servicio externo. El enfoque ejecuta un pequeño servidor de embeddings local alrededor del modelo Harrier de Microsoft (microsoft/harrier-oss-v1-0.6b), expone una API compatible con Ollama y la conecta a la configuración memorySearch de OpenClaw.

Cómo funciona

El servidor de embeddings ejecuta Harrier localmente y proporciona los endpoints /api/embed y /api/embeddings que coinciden con el formato de API de Ollama. OpenClaw ya soporta endpoints estilo Ollama en su memorySearch, por lo que apuntarlo a http://localhost:8000 le da al agente una capa de memoria semántica local de última generación.

Por qué esto es importante para la memoria del agente

La mayoría de los sistemas de memoria para agentes tienen dos puntos débiles:

  • Meter demasiada memoria en el prompt quema tokens y desordena el contexto.
  • Mantener archivos de memoria pequeños y manuales se vuelve difícil de mantener a medida que crece el historial.

La búsqueda de memoria semántica ofrece un camino intermedio. La memoria a largo plazo se mantiene en archivos markdown normales (MEMORY.md, registros diarios, notas, archivos de proyecto) que son legibles y editables por humanos. En tiempo de ejecución, el agente recupera solo los fragmentos relevantes.

Ad

Beneficios

  • Menos desperdicio de tokens — no se mete cada dato duradero en cada prompt.
  • Archivos de memoria más limpios — no es necesario comprimir en un solo blob de contexto gigante.
  • Mejor recuperación — encuentra notas conceptualmente relacionadas incluso cuando las palabras no coinciden exactamente.
  • Depuración más fácil — la fuente de verdad es texto plano, no una base de datos vectorial opaca.
  • Mejor privacidad — los embeddings se calculan localmente, no se envían datos a una API alojada.

Qué incluye el repositorio

  • Pequeño servidor Python de embeddings que implementa endpoints compatibles con Ollama
  • Ejemplo de configuración memorySearch de OpenClaw
  • Plantilla de servicio launchd para macOS
  • Corpus de memoria markdown de prueba
  • Pruebas de humo y demo de consulta local

El repositorio está en github.com/promptclickrun/harrier-openclaw-memory-search.

📖 Leer la fuente completa: r/openclaw

Ad

👀 Ver también

Smriti: Un sistema similar a Git para gestionar el estado del razonamiento de LLM y prevenir la deriva en las conversaciones.
Herramientas

Smriti: Un sistema similar a Git para gestionar el estado del razonamiento de LLM y prevenir la deriva en las conversaciones.

Smriti es una herramienta de código abierto que permite a los desarrolladores guardar, restaurar, ramificar y comparar estados de razonamiento en conversaciones con LLM para prevenir la deriva. Trata las interacciones como estado en lugar de historial de chat, permitiendo retrocesos limpios y exploración alternativa sin contaminación.

OpenClawRadar
Voygr lanza la API de Validación de Negocios para Inteligencia de Lugares Nuevos
Herramientas

Voygr lanza la API de Validación de Negocios para Inteligencia de Lugares Nuevos

La API de Validación de Negocios de Voygr verifica si las empresas están operando, cerradas, rebrandizadas o inválidas mediante la agregación de múltiples fuentes de datos y la detección de señales conflictivas. El equipo está construyendo un perfil de lugar infinito y consultable que combina datos precisos de lugares con contexto web actualizado como noticias, artículos y eventos.

OpenClawRadar
ClawControl v1.7.1 soluciona problemas de uso diario en el cliente OpenClaw.
Herramientas

ClawControl v1.7.1 soluciona problemas de uso diario en el cliente OpenClaw.

ClawControl v1.7.1 es un cliente de código abierto para OpenClaw disponible en Windows, Mac, Linux, iOS y Android. Esta versión se centra en solucionar los problemas de '¿por qué está haciendo eso?' que se encuentran durante el uso diario de OpenClaw.

OpenClawRadar
Código de Claude Utilizado para Simular Más de 4,000 Juegos de Hombre Lobo Ciego con LLMs
Herramientas

Código de Claude Utilizado para Simular Más de 4,000 Juegos de Hombre Lobo Ciego con LLMs

Un desarrollador utilizó Claude Code para construir un simulador donde los LLM juegan al Werewolf ciego de una noche, ejecutando aproximadamente 4,600 juegos en modelos de OpenAI y xAI. El experimento reveló patrones de votación consistentes basados en nombres a pesar de las señales mínimas del juego.

OpenClawRadar