Engram v1.0.0: Memoria Persistente para LLMs Locales mediante Grafo de Conocimiento

Qué hace Engram
Engram resuelve el problema de que los LLMs olviden todo entre sesiones al proporcionar memoria persistente mediante un grafo de conocimiento. A diferencia de las bases de datos vectoriales que solo encuentran texto similar, Engram comprende relaciones y puede razonar sobre ellas.
Características principales
- Grafo de conocimiento con entidades tipadas, relaciones y propiedades
- Búsqueda híbrida que combina BM25 + similitud vectorial usando incrustaciones de Ollama/OpenAI o ONNX local
- Ciclo de vida de confianza donde los hechos se fortalecen con confirmación, se debilitan con el tiempo y se corrigen ante contradicciones
- Motor de inferencia con encadenamiento hacia adelante/atrás que deriva nuevos hechos a partir de reglas
- Servidor MCP incorporado que funciona con Claude Code, Cursor y Windsurf listo para usar
- API REST HTTP con más de 25 endpoints en el puerto 3030
- Interfaz web incorporada para exploración del grafo, búsqueda y consultas en lenguaje natural
- Sincronización malla peer-to-peer entre instancias con autenticación ed25519
- CORS habilitado para cualquier integración frontend
Detalles técnicos
Todo el sistema se ejecuta como un binario de 8.3 MB sin dependencias externas. Todos los datos residen en un único archivo .brain que puede copiarse para respaldo o moverse para migración. No se requiere nube, Docker, Python ni base de datos externa.
Integración MCP
La configuración MCP es simple:
{
"mcpServers": {
"engram": {
"command": "engram",
"args": ["mcp", "/path/to/knowledge.brain"]
}
}
}El servidor MCP expone estas herramientas: engram_store, engram_relate, engram_query, engram_search, engram_prove y engram_explain.
Comandos de inicio rápido
engram create my.brain
engram store "PostgreSQL" my.brain
engram serve my.brainDespués de ejecutar engram serve, la interfaz web está disponible en http://localhost:3030.
Disponibilidad
Engram es gratuito para uso personal, de investigación y educativo, con una licencia comercial disponible. El código fuente y las versiones están en GitHub.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Optio: Orquestrando Agentes de Codificación con IA en Kubernetes desde el Ticket hasta la PR
Optio es un sistema de orquestación de código abierto que convierte tickets en solicitudes de extracción fusionadas utilizando agentes de codificación con IA como Claude Code o Codex. Maneja el ciclo de vida completo en pods de Kubernetes aislados con un bucle de retroalimentación que reanuda automáticamente a los agentes en fallos de CI o comentarios de revisión.

ATLAS: Marco de Aprendizaje Adaptativo en Tiempo de Prueba Supera a Claude Sonnet en Puntos de Referencia de Codificación con GPU de $500
ATLAS logra un 74,6% de aprobación@1-v(k=3) en LiveCodeBench con un modelo congelado de 14B en una única GPU de consumo, superando el 71,4% de Claude 4.5 Sonnet a una fracción del costo mediante generación basada en restricciones y refinamiento iterativo autoverificado.

devcontainer-mcp: Dale a los agentes de IA su propio entorno de desarrollo, no el tuyo
devcontainer-mcp es un servidor MCP que expone 45 herramientas para que agentes de IA creen, gestionen y trabajen dentro de contenedores de desarrollo respaldados por Docker, DevPod o GitHub Codespaces, manteniendo limpia la máquina anfitriona.

Phalanx CLI coordina múltiples agentes de IA para ciclos automatizados de revisión de código.
Un desarrollador creó Phalanx, una herramienta CLI que coordina agentes de IA de diferentes proveedores: Codex maneja la codificación, Claude Opus realiza revisiones de código y Claude Sonnet orquesta el ciclo. Una herramienta complementaria llamada Codebones comprime repositorios en mapas estructurales para reducir el uso de tokens.