agentmemory V4 logra un 96.2% en el benchmark LongMemEval, superando a los sistemas de memoria de IA comerciales.

✍️ OpenClawRadar📅 Publicado: 27 de marzo de 2026🔗 Source
agentmemory V4 logra un 96.2% en el benchmark LongMemEval, superando a los sistemas de memoria de IA comerciales.
Ad

agentmemory V4 es un sistema de memoria de código abierto para agentes de IA que acaba de lograr un récord mundial con un puntaje del 96.2% en LongMemEval, el punto de referencia estándar para la memoria a largo plazo de agentes de IA.

Rendimiento en el Punto de Referencia

El sistema superó a varias empresas de memoria de IA con financiamiento:

  • PwC Chronos: 95.6%
  • Mastra: 94.87%
  • OMEGA: 93.2% (sin procesar)
  • Supermemory: 85.86%
  • Emergence AI: 86%
  • Zep: 71.2%

Detalles del Desarrollo

Construido por una sola persona en 16 días en una PC de gama media (i3-12100F) con un costo total de $1,000. El sistema utiliza Claude Opus como generador y GPT-4o como juez, pero la arquitectura de recuperación es la innovación central.

Ad

Arquitectura Técnica

El sistema combina múltiples técnicas de recuperación en un solo sistema respaldado por SQLite:

  • HNSW (Hierarchical Navigable Small World) para búsqueda aproximada del vecino más cercano
  • BM25 para recuperación de texto tradicional
  • Codificador cruzado para puntuación de relevancia
  • Integración de gráfico de conocimiento
  • Anclaje temporal para recuperación de memoria consciente del tiempo

Disponibilidad

El sistema es de código abierto bajo la licencia MIT y está disponible en: github.com/JordanMcCann/agentmemory

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Wisepanel MCP Server permite la deliberación multi-LLM en Claude Code y Cursor
Herramientas

Wisepanel MCP Server permite la deliberación multi-LLM en Claude Code y Cursor

Wisepanel lanzó un servidor MCP que ejecuta deliberaciones multiagente directamente desde Claude Code, Cursor o cualquier cliente MCP, utilizando un sistema de mejora de contexto divergente con los modelos ChatGPT, Claude, Gemini y Perplexity.

OpenClawRadar
La Caída Silenciosa de Claude: Falla de la Capa de Acción Cuando los Agentes de IA Aterrizan en Sitios Empresariales
Herramientas

La Caída Silenciosa de Claude: Falla de la Capa de Acción Cuando los Agentes de IA Aterrizan en Sitios Empresariales

Claude puede leer sitios web de negocios (precios, flujos de reserva, formularios), pero falla en la capa de acción — reservar, enviar o enrutar — debido a la falta de endpoints invocables. Esto provoca una pérdida de usuarios invisible, sin señales analíticas.

OpenClawRadar
El servidor MCP conecta agentes de IA a sesiones existentes de Chrome con cookies y autenticación.
Herramientas

El servidor MCP conecta agentes de IA a sesiones existentes de Chrome con cookies y autenticación.

@playwright-repl/mcp es un servidor MCP que conecta agentes de IA a tu navegador Chrome existente a través de la extensión Dramaturg, proporcionando acceso a tu sesión real del navegador, incluyendo cookies y autenticación. Es compatible con JavaScript completo de Playwright, aserciones y funciona con Claude Desktop, Claude Code, Cursor o cualquier cliente MCP.

OpenClawRadar
Lightning MLX: Motor de AI local rápido para uso agente en Apple Silicon ofrece 220 tok/s en Qwen 35B-A3B
Herramientas

Lightning MLX: Motor de AI local rápido para uso agente en Apple Silicon ofrece 220 tok/s en Qwen 35B-A3B

Lightning MLX afirma ser la inferencia local de IA más rápida en Apple Silicon, optimizada para agentes de código y llamadas a herramientas. Los benchmarks muestran 40.67 tok/s en Qwen3.6-27B y 220.86 tok/s en Qwen3.6-35B-A3B desde un MacBook Max M5 (128 GB).

OpenClawRadar