Engram v1.0.0: Memoria Persistente para LLMs Locales mediante Grafo de Conocimiento

Qué hace Engram
Engram resuelve el problema de que los LLMs olviden todo entre sesiones al proporcionar memoria persistente mediante un grafo de conocimiento. A diferencia de las bases de datos vectoriales que solo encuentran texto similar, Engram comprende relaciones y puede razonar sobre ellas.
Características principales
- Grafo de conocimiento con entidades tipadas, relaciones y propiedades
- Búsqueda híbrida que combina BM25 + similitud vectorial usando incrustaciones de Ollama/OpenAI o ONNX local
- Ciclo de vida de confianza donde los hechos se fortalecen con confirmación, se debilitan con el tiempo y se corrigen ante contradicciones
- Motor de inferencia con encadenamiento hacia adelante/atrás que deriva nuevos hechos a partir de reglas
- Servidor MCP incorporado que funciona con Claude Code, Cursor y Windsurf listo para usar
- API REST HTTP con más de 25 endpoints en el puerto 3030
- Interfaz web incorporada para exploración del grafo, búsqueda y consultas en lenguaje natural
- Sincronización malla peer-to-peer entre instancias con autenticación ed25519
- CORS habilitado para cualquier integración frontend
Detalles técnicos
Todo el sistema se ejecuta como un binario de 8.3 MB sin dependencias externas. Todos los datos residen en un único archivo .brain que puede copiarse para respaldo o moverse para migración. No se requiere nube, Docker, Python ni base de datos externa.
Integración MCP
La configuración MCP es simple:
{
"mcpServers": {
"engram": {
"command": "engram",
"args": ["mcp", "/path/to/knowledge.brain"]
}
}
}El servidor MCP expone estas herramientas: engram_store, engram_relate, engram_query, engram_search, engram_prove y engram_explain.
Comandos de inicio rápido
engram create my.brain
engram store "PostgreSQL" my.brain
engram serve my.brainDespués de ejecutar engram serve, la interfaz web está disponible en http://localhost:3030.
Disponibilidad
Engram es gratuito para uso personal, de investigación y educativo, con una licencia comercial disponible. El código fuente y las versiones están en GitHub.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Tandem MCP: Ejecuta y gestiona sesiones de Claude Code desde el chat de Claude.ai
Tandem es un servidor MCP de código abierto que conecta el chat de Claude.ai con sesiones locales de Claude Code, permitiendo bucles de codificación autónomos sin copiar y pegar.

Agent Forge: Herramienta de Código Abierto que Estructura Pipelines Multiagente para Claude Code
Agent Forge es una habilidad de Claude Code que genera tuberías de múltiples agentes completas a partir de descripciones de casos de uso. Crea archivos de instrucciones, scripts de orquestación, directorios de flujo de datos y configuraciones de GitHub Actions basándose en patrones observados en sistemas de múltiples agentes existentes.

Phaselock: Un Sistema de Control de Agentes de IA Inspirado en Técnicas de Crianza
Phaselock es una habilidad de agente de código abierto que implementa cuatro mecanismos de control para agentes de IA: compuertas explícitas antes de la acción, retroalimentación inmediata sobre errores, opciones restringidas y aplicación mecánica de reglas. Funciona con Claude Code, Cursor, Windsurf y herramientas que admiten hooks.

Google PM publica como código abierto un agente de memoria siempre activo con almacenamiento SQLite, sin base de datos vectorial.
Shubham Saboo, gerente sénior de productos de IA en Google, ha liberado como código abierto un Agente de Memoria Siempre Activo que almacena recuerdos estructurados en SQLite en lugar de utilizar bases de datos vectoriales, funcionando con Gemini 3.1 Flash-Lite con consolidación de memoria programada cada 30 minutos.