Búsqueda en Memoria Semántica Local para Agentes OpenClaw Usando Embeddings Harrier

Un nuevo repositorio muestra cómo dar a un agente de OpenClaw búsqueda de memoria semántica local sin enviar embeddings a un servicio externo. El enfoque ejecuta un pequeño servidor de embeddings local alrededor del modelo Harrier de Microsoft (microsoft/harrier-oss-v1-0.6b), expone una API compatible con Ollama y la conecta a la configuración memorySearch de OpenClaw.
Cómo funciona
El servidor de embeddings ejecuta Harrier localmente y proporciona los endpoints /api/embed y /api/embeddings que coinciden con el formato de API de Ollama. OpenClaw ya soporta endpoints estilo Ollama en su memorySearch, por lo que apuntarlo a http://localhost:8000 le da al agente una capa de memoria semántica local de última generación.
Por qué esto es importante para la memoria del agente
La mayoría de los sistemas de memoria para agentes tienen dos puntos débiles:
- Meter demasiada memoria en el prompt quema tokens y desordena el contexto.
- Mantener archivos de memoria pequeños y manuales se vuelve difícil de mantener a medida que crece el historial.
La búsqueda de memoria semántica ofrece un camino intermedio. La memoria a largo plazo se mantiene en archivos markdown normales (MEMORY.md, registros diarios, notas, archivos de proyecto) que son legibles y editables por humanos. En tiempo de ejecución, el agente recupera solo los fragmentos relevantes.
Beneficios
- Menos desperdicio de tokens — no se mete cada dato duradero en cada prompt.
- Archivos de memoria más limpios — no es necesario comprimir en un solo blob de contexto gigante.
- Mejor recuperación — encuentra notas conceptualmente relacionadas incluso cuando las palabras no coinciden exactamente.
- Depuración más fácil — la fuente de verdad es texto plano, no una base de datos vectorial opaca.
- Mejor privacidad — los embeddings se calculan localmente, no se envían datos a una API alojada.
Qué incluye el repositorio
- Pequeño servidor Python de embeddings que implementa endpoints compatibles con Ollama
- Ejemplo de configuración
memorySearchde OpenClaw - Plantilla de servicio launchd para macOS
- Corpus de memoria markdown de prueba
- Pruebas de humo y demo de consulta local
El repositorio está en github.com/promptclickrun/harrier-openclaw-memory-search.
📖 Leer la fuente completa: r/openclaw
👀 Ver también

Reddit MCP personalizado para Claude Desktop/Código compartido en GitHub
Un desarrollador ha lanzado un MCP de Reddit personalizado diseñado para Claude Desktop y Claude Code para integrar la investigación de Reddit directamente en el flujo de trabajo. La herramienta está documentada en GitHub y disponible para uso gratuito.

Transmitido: Una Habilidad de Código Claude para Publicación Instantánea de HTML en URLs en Vivo
Aired es una herramienta de código abierto que publica HTML en una URL en vivo en 2 segundos mediante habilidades de Claude Code o servidores MCP. No requiere registro, configuración de despliegue ni instalación para herramientas de IA basadas en web, y funciona con Claude Code, Cursor, VS Code, Codex y Windsurf.

Artifactr: Herramienta CLI de prioridad local para gestionar artefactos de agentes de codificación con IA
Artifactr es una herramienta CLI gratuita y de código abierto para gestionar artefactos de LLM como habilidades, comandos y definiciones de agentes. Almacena archivos en bóvedas portátiles sin conexiones de red y admite sincronización automática mediante enlaces simbólicos.

Qure: Aplicación de Escritorio para Generar Pruebas E2E a partir de Flujos de Navegador Grabados
Qure es una aplicación de escritorio de JetBrains (actualmente en beta cerrada) que genera código de prueba web de extremo a extremo a partir de grabaciones realizadas en su navegador integrado. En lugar de describir flujos de prueba en texto para agentes de IA, los desarrolladores graban sus escenarios de control de calidad manual interactuando con su producto, y la IA produce código de prueba funcional que coincide con su base de código existente.