agentmemory V4 logra un 96.2% en el benchmark LongMemEval, superando a los sistemas de memoria de IA comerciales.

agentmemory V4 es un sistema de memoria de código abierto para agentes de IA que acaba de lograr un récord mundial con un puntaje del 96.2% en LongMemEval, el punto de referencia estándar para la memoria a largo plazo de agentes de IA.
Rendimiento en el Punto de Referencia
El sistema superó a varias empresas de memoria de IA con financiamiento:
- PwC Chronos: 95.6%
- Mastra: 94.87%
- OMEGA: 93.2% (sin procesar)
- Supermemory: 85.86%
- Emergence AI: 86%
- Zep: 71.2%
Detalles del Desarrollo
Construido por una sola persona en 16 días en una PC de gama media (i3-12100F) con un costo total de $1,000. El sistema utiliza Claude Opus como generador y GPT-4o como juez, pero la arquitectura de recuperación es la innovación central.
Arquitectura Técnica
El sistema combina múltiples técnicas de recuperación en un solo sistema respaldado por SQLite:
- HNSW (Hierarchical Navigable Small World) para búsqueda aproximada del vecino más cercano
- BM25 para recuperación de texto tradicional
- Codificador cruzado para puntuación de relevancia
- Integración de gráfico de conocimiento
- Anclaje temporal para recuperación de memoria consciente del tiempo
Disponibilidad
El sistema es de código abierto bajo la licencia MIT y está disponible en: github.com/JordanMcCann/agentmemory
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Wisepanel MCP Server permite la deliberación multi-LLM en Claude Code y Cursor
Wisepanel lanzó un servidor MCP que ejecuta deliberaciones multiagente directamente desde Claude Code, Cursor o cualquier cliente MCP, utilizando un sistema de mejora de contexto divergente con los modelos ChatGPT, Claude, Gemini y Perplexity.

La Caída Silenciosa de Claude: Falla de la Capa de Acción Cuando los Agentes de IA Aterrizan en Sitios Empresariales
Claude puede leer sitios web de negocios (precios, flujos de reserva, formularios), pero falla en la capa de acción — reservar, enviar o enrutar — debido a la falta de endpoints invocables. Esto provoca una pérdida de usuarios invisible, sin señales analíticas.

El servidor MCP conecta agentes de IA a sesiones existentes de Chrome con cookies y autenticación.
@playwright-repl/mcp es un servidor MCP que conecta agentes de IA a tu navegador Chrome existente a través de la extensión Dramaturg, proporcionando acceso a tu sesión real del navegador, incluyendo cookies y autenticación. Es compatible con JavaScript completo de Playwright, aserciones y funciona con Claude Desktop, Claude Code, Cursor o cualquier cliente MCP.

Lightning MLX: Motor de AI local rápido para uso agente en Apple Silicon ofrece 220 tok/s en Qwen 35B-A3B
Lightning MLX afirma ser la inferencia local de IA más rápida en Apple Silicon, optimizada para agentes de código y llamadas a herramientas. Los benchmarks muestran 40.67 tok/s en Qwen3.6-27B y 220.86 tok/s en Qwen3.6-35B-A3B desde un MacBook Max M5 (128 GB).