SDK de Memoria Engram: Memoria Basada en Grafos para Agentes de IA con Modelos Locales

SDK de Memoria de Grafos para Modelos de IA Locales
Engram Memory SDK es un sistema de memoria de grafos de código abierto diseñado para agentes de IA que funciona con modelos locales mediante la integración de LiteLLM. La arquitectura central separa la ingesta de la recuperación: solo necesitas el LLM una vez durante la ingesta para extraer entidades y relaciones, mientras que la recuperación opera mediante búsqueda vectorial pura, recorrido de grafos y puntuación sin requerir llamadas adicionales al LLM.
Detalles Técnicos
El SDK está construido con Python asíncrono y utiliza Neo4j como su base de datos backend. Según la fuente, promedia ~735 tokens por operación de ingesta y logra una latencia de recuperación de 95ms. El sistema incluye funciones de memoria de auto-reestructuración con descomposición y agrupamiento ejecutándose en segundo plano.
Configuración e Instalación
La instalación es sencilla:
pip install engram-memory-sdkLa configuración requiere un archivo .env con estas variables:
LLM_MODEL=ollama/llama3 # o cualquier modelo local compatible con LiteLLM
NEO4J_URI=bolt://localhost:7687El sistema admite cualquier modelo a través de LiteLLM, incluyendo implementaciones locales mediante Ollama, vLLM y text-generation-webui. La ventaja clave es la eficiencia de costos: con un pequeño modelo local manejando la extracción, las operaciones de recuperación continuas tienen literalmente un costo de $0 ya que no consumen tokens del LLM.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Lumyr: Generación de Dashboard mediante Claude con Automatización en Python y Streamlit
Lumyr es una herramienta que genera paneles de control en vivo y compartibles a partir de descripciones en inglés sencillo, utilizando Claude para la generación de paneles y automatizando la capa de Python y Streamlit. Los usuarios no necesitan escribir Python, abrir Streamlit, desplegar, configurar alojamiento ni gestionar infraestructura.

MemAware Benchmark Prueba la Memoria de la IA Más Allá de la Búsqueda por Palabras Clave
MemAware es un punto de referencia con 900 preguntas en 3 niveles de dificultad que evalúa si los asistentes de IA con memoria pueden recuperar contexto relevante cuando las consultas no lo sugieren. Los resultados muestran que la búsqueda BM25 obtuvo un 2,8 % frente al 0,8 % sin memoria, mientras que la búsqueda vectorial cae al 0,7 % en conexiones entre dominios.

Resultados de Referencia: CLI de GitHub frente a Enfoques MCP para Agentes de IA
Un benchmark independiente comparó GitHub CLI, MCP, MCP con Búsqueda de Herramientas y MCP con Modo Código para tareas de agentes de IA. GitHub CLI fue la opción más rentable, mientras que los enfoques MCP mostraron compensaciones en costo, latencia y modos de fallo.

Un Sistema para que Claude Code Aprenda Tu Proyecto con el Tiempo
Un desarrollador creó una configuración simple para ayudar a Claude Code a retener el contexto entre sesiones mediante la adición de un archivo CLAUDE.md, una carpeta docs con convenciones del proyecto y tres prompts para inicializar, refinar y capturar patrones.