Engram v1.0.0 : Mémoire persistante pour les LLM locaux via un graphe de connaissances

Ce que fait Engram
Engram résout le problème des LLM qui oublient tout entre les sessions en fournissant une mémoire persistante via un graphe de connaissances. Contrairement aux bases de données vectorielles qui ne trouvent que du texte similaire, Engram comprend les relations et peut raisonner dessus.
Fonctionnalités principales
- Graphe de connaissances avec entités typées, relations et propriétés
- Recherche hybride combinant BM25 + similarité vectorielle utilisant les embeddings Ollama/OpenAI ou ONNX local
- Cycle de vie de confiance où les faits se renforcent avec confirmation, s'affaiblissent avec le temps et se corrigent en cas de contradiction
- Moteur d'inférence avec chaînage avant/arrière qui déduit de nouveaux faits à partir de règles
- Serveur MCP intégré qui fonctionne avec Claude Code, Cursor et Windsurf dès l'installation
- API REST HTTP avec 25+ endpoints sur le port 3030
- Interface web intégrée pour l'exploration du graphe, la recherche et les requêtes en langage naturel
- Synchronisation maillée pair-à-pair entre instances avec authentification ed25519
- CORS activé pour toute intégration frontale
Détails techniques
Le système entier fonctionne comme un binaire de 8,3 Mo sans aucune dépendance externe. Toutes les données résident dans un seul fichier .brain qui peut être copié pour sauvegarde ou déplacé pour migration. Aucun cloud, Docker, Python ou base de données externe n'est requis.
Intégration MCP
La configuration MCP est simple :
{
"mcpServers": {
"engram": {
"command": "engram",
"args": ["mcp", "/path/to/knowledge.brain"]
}
}
}Le serveur MCP expose ces outils : engram_store, engram_relate, engram_query, engram_search, engram_prove et engram_explain.
Commandes de démarrage rapide
engram create my.brain
engram store "PostgreSQL" my.brain
engram serve my.brainAprès avoir exécuté engram serve, l'interface web est disponible à http://localhost:3030.
Disponibilité
Engram est gratuit pour un usage personnel, de recherche et éducatif, avec une licence commerciale disponible. Le code source et les versions sont sur GitHub.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Extension OpenClaw Claude mise à jour pour utiliser l'Agent SDK suite aux changements de facturation d'Anthropic
Un développeur d'extension OpenClaw a réécrit son intégration CLI Claude pour utiliser le SDK officiel claude-agent-sdk après qu'Anthropic a commencé à détecter et reclasser l'utilisation CLI comme utilisation d'application tierce, qui facture contre un pool de crédits séparé au lieu des limites du plan Max. L'approche SDK s'authentifie via la connexion Claude Code existante et facture comme une utilisation normale du plan Max.

Développement local d'IA avec Qwen3.6-27B et Opencode sur un 5090
Un utilisateur de Reddit partage son expérience de transition des outils de codage IA cloud (Claude Code, Cursor) vers une configuration locale utilisant Opencode + llama-server + Qwen3.6-27B avec un contexte de 128K sur une seule RTX 5090, citant la liberté vis-à-vis des limites d'utilisation et des risques liés aux comptes.

OpenAlly : Assistant IA local pour Android avec contrôle téléphonique
OpenAlly est une application Android qui exécute un assistant IA localement sur votre téléphone via un processus Node.js intégré, avec 51 compétences intégrées et des capacités de contrôle téléphonique via le compagnon Aster. Elle se connecte à plus de 19 plateformes de messagerie et prend en charge 18 fournisseurs de modèles avec vos propres clés API.

Jake Benchmark v1 : Tests de Performance des LLM Locaux pour les Agents d'IA OpenClaw
Un développeur a testé 7 LLM locaux en tant qu'agents IA avec OpenClaw en utilisant 22 tâches pratiques incluant le traitement d'emails, la planification de réunions et la détection de phishing. Les résultats varient de 59,4 % pour Qwen 27B à 1,6 % pour Nemotron 30B, avec des journaux de conversation détaillés disponibles.