agentmemory V4 logra un 96.2% en el benchmark LongMemEval, superando a los sistemas de memoria de IA comerciales.

✍️ OpenClawRadar📅 Publicado: 27 de marzo de 2026🔗 Source
agentmemory V4 logra un 96.2% en el benchmark LongMemEval, superando a los sistemas de memoria de IA comerciales.
Ad

agentmemory V4 es un sistema de memoria de código abierto para agentes de IA que acaba de lograr un récord mundial con un puntaje del 96.2% en LongMemEval, el punto de referencia estándar para la memoria a largo plazo de agentes de IA.

Rendimiento en el Punto de Referencia

El sistema superó a varias empresas de memoria de IA con financiamiento:

  • PwC Chronos: 95.6%
  • Mastra: 94.87%
  • OMEGA: 93.2% (sin procesar)
  • Supermemory: 85.86%
  • Emergence AI: 86%
  • Zep: 71.2%

Detalles del Desarrollo

Construido por una sola persona en 16 días en una PC de gama media (i3-12100F) con un costo total de $1,000. El sistema utiliza Claude Opus como generador y GPT-4o como juez, pero la arquitectura de recuperación es la innovación central.

Ad

Arquitectura Técnica

El sistema combina múltiples técnicas de recuperación en un solo sistema respaldado por SQLite:

  • HNSW (Hierarchical Navigable Small World) para búsqueda aproximada del vecino más cercano
  • BM25 para recuperación de texto tradicional
  • Codificador cruzado para puntuación de relevancia
  • Integración de gráfico de conocimiento
  • Anclaje temporal para recuperación de memoria consciente del tiempo

Disponibilidad

El sistema es de código abierto bajo la licencia MIT y está disponible en: github.com/JordanMcCann/agentmemory

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

La brevedad supera al plugin cavernícola en el benchmark de compresión de Claude Code
Herramientas

La brevedad supera al plugin cavernícola en el benchmark de compresión de Claude Code

Un benchmark de 24 prompts muestra que el plugin de compresión 'caveman' de Claude Code produce los mismos conteos de tokens y calidad que simplemente anteponer 'sé breve'. Sin embargo, la forma de salida consistente del plugin y sus reglas de escape de seguridad ofrecen ventajas estructurales.

OpenClawRadar
Artifactr: Herramienta CLI de prioridad local para gestionar artefactos de agentes de codificación con IA
Herramientas

Artifactr: Herramienta CLI de prioridad local para gestionar artefactos de agentes de codificación con IA

Artifactr es una herramienta CLI gratuita y de código abierto para gestionar artefactos de LLM como habilidades, comandos y definiciones de agentes. Almacena archivos en bóvedas portátiles sin conexiones de red y admite sincronización automática mediante enlaces simbólicos.

OpenClawRadar
ThumbGate implementa el patrón de agente de lenguaje natural de Tsinghua para la seguridad de la IA.
Herramientas

ThumbGate implementa el patrón de agente de lenguaje natural de Tsinghua para la seguridad de la IA.

La herramienta de código abierto ThumbGate implementa el patrón Natural-Language Agent Harness del artículo NLAH de Tsinghua, mapeando cuatro componentes: contratos a reglas de prevención a partir de retroalimentación negativa, puertas de verificación a ganchos PreToolUse, estado duradero a base de datos de lecciones SQLite+FTS5, y adaptadores a adaptadores de servidor MCP para múltiples agentes de IA de codificación.

OpenClawRadar
Sistema de búsqueda de empleo con IA de código abierto, construido con Claude Code, que evalúa ofertas y genera currículums personalizados.
Herramientas

Sistema de búsqueda de empleo con IA de código abierto, construido con Claude Code, que evalúa ofertas y genera currículums personalizados.

Un desarrollador ha hecho de código abierto un proyecto de Claude Code que convierte tu terminal en un centro de mando para la búsqueda de empleo. El sistema evalúa las ofertas de trabajo en 10 dimensiones, genera currículums en PDF optimizados para ATS, escanea más de 45 páginas de carreras de empresas e incluye 14 modos de habilidades.

OpenClawRadar