Engram v1.0.0 : Mémoire persistante pour les LLM locaux via un graphe de connaissances

✍️ OpenClawRadar📅 Publié: March 9, 2026🔗 Source
Engram v1.0.0 : Mémoire persistante pour les LLM locaux via un graphe de connaissances
Ad

Ce que fait Engram

Engram résout le problème des LLM qui oublient tout entre les sessions en fournissant une mémoire persistante via un graphe de connaissances. Contrairement aux bases de données vectorielles qui ne trouvent que du texte similaire, Engram comprend les relations et peut raisonner dessus.

Fonctionnalités principales

  • Graphe de connaissances avec entités typées, relations et propriétés
  • Recherche hybride combinant BM25 + similarité vectorielle utilisant les embeddings Ollama/OpenAI ou ONNX local
  • Cycle de vie de confiance où les faits se renforcent avec confirmation, s'affaiblissent avec le temps et se corrigent en cas de contradiction
  • Moteur d'inférence avec chaînage avant/arrière qui déduit de nouveaux faits à partir de règles
  • Serveur MCP intégré qui fonctionne avec Claude Code, Cursor et Windsurf dès l'installation
  • API REST HTTP avec 25+ endpoints sur le port 3030
  • Interface web intégrée pour l'exploration du graphe, la recherche et les requêtes en langage naturel
  • Synchronisation maillée pair-à-pair entre instances avec authentification ed25519
  • CORS activé pour toute intégration frontale
Ad

Détails techniques

Le système entier fonctionne comme un binaire de 8,3 Mo sans aucune dépendance externe. Toutes les données résident dans un seul fichier .brain qui peut être copié pour sauvegarde ou déplacé pour migration. Aucun cloud, Docker, Python ou base de données externe n'est requis.

Intégration MCP

La configuration MCP est simple :

{
  "mcpServers": {
    "engram": {
      "command": "engram",
      "args": ["mcp", "/path/to/knowledge.brain"]
    }
  }
}

Le serveur MCP expose ces outils : engram_store, engram_relate, engram_query, engram_search, engram_prove et engram_explain.

Commandes de démarrage rapide

engram create my.brain
engram store "PostgreSQL" my.brain
engram serve my.brain

Après avoir exécuté engram serve, l'interface web est disponible à http://localhost:3030.

Disponibilité

Engram est gratuit pour un usage personnel, de recherche et éducatif, avec une licence commerciale disponible. Le code source et les versions sont sur GitHub.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

🦀
Tools

Interface utilisateur et serveur pour les autoencodeurs en langage naturel d'Anthropic sur llama.cpp

Un serveur llama.cpp personnalisé et une interface Mikupad pour les autoencodeurs en langage naturel à poids ouverts d'Anthropic, prenant en charge l'extraction d'activations, l'explication, la reconstruction et le guidage par édition d'explications.

OpenClawRadar
McPherson AI lance deux nouvelles compétences opérationnelles pour la restauration rapide sur ClawHub : diagnostic des coûts alimentaires et audit des fuites de main-d'œuvre.
Tools

McPherson AI lance deux nouvelles compétences opérationnelles pour la restauration rapide sur ClawHub : diagnostic des coûts alimentaires et audit des fuites de main-d'œuvre.

Deux nouvelles compétences gratuites ont été publiées sur ClawHub : qsr-food-cost-diagnostic détecte les problèmes de coût des marchandises vendues chaque semaine avec un diagnostic à quatre leviers, et qsr-labor-leak-auditor assure un suivi quotidien de la main-d'œuvre avec des alertes en milieu de semaine pour éviter les dépassements de budget.

OpenClawRadar
Outils Open Source Claude pour la Chasse Automatisée aux Bounties de Bugs
Tools

Outils Open Source Claude pour la Chasse Automatisée aux Bounties de Bugs

Trois dépôts open source automatisent le pipeline de bug bounty en utilisant Claude Code. Les outils gèrent la reconnaissance, la recherche de vulnérabilités web2/web3, et génèrent des rapports prêts à soumettre.

OpenClawRadar
Ctxpact : Proxy de Compactage de Contexte pour LLM Locaux
Tools

Ctxpact : Proxy de Compactage de Contexte pour LLM Locaux

Ctxpact est un proxy compatible OpenAI qui compresse les entrées trop volumineuses pour les LLM locaux avec des fenêtres de contexte de 16k, en utilisant un pipeline à 3 étapes incluant des stratégies de DCP, de résumé et d'extraction. Les benchmarks montrent 110k tokens compressés à 12k avec une précision de compréhension de lecture de 8/8.

OpenClawRadar