SDK Mémoire Engram : Mémoire basée sur des graphes pour agents IA avec modèles locaux

SDK de Mémoire Graphique pour Modèles d'IA Locaux
Engram Memory SDK est un système de mémoire graphique open-source conçu pour les agents d'IA qui fonctionne avec des modèles locaux via l'intégration LiteLLM. L'architecture principale sépare l'ingestion de la récupération : vous n'avez besoin du LLM qu'une seule fois pendant l'ingestion pour extraire les entités et les relations, tandis que la récupération fonctionne par recherche vectorielle pure, parcours de graphe et notation sans nécessiter d'appels LLM supplémentaires.
Détails Techniques
Le SDK est construit avec Python asynchrone et utilise Neo4j comme base de données backend. Selon la source, il moyenne environ ~735 tokens par opération d'ingestion et atteint une latence de récupération de 95ms. Le système inclut des fonctionnalités d'auto-restructuration de la mémoire avec décroissance et regroupement fonctionnant en arrière-plan.
Configuration et Installation
L'installation est simple :
pip install engram-memory-sdkLa configuration nécessite un fichier .env avec ces variables :
LLM_MODEL=ollama/llama3 # ou tout modèle local pris en charge par LiteLLM
NEO4J_URI=bolt://localhost:7687Le système prend en charge n'importe quel modèle via LiteLLM, y compris les déploiements locaux via Ollama, vLLM et text-generation-webui. L'avantage clé est l'efficacité des coûts : avec un petit modèle local gérant l'extraction, les opérations de récupération en cours ont littéralement un coût de 0 $ puisqu'elles ne consomment pas de tokens LLM.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Zora : Agent IA Offline-First avec Sécurité par Défaut Refusée et Mémoire Locale
Zora est un agent IA qui fonctionne entièrement hors ligne par défaut via Ollama, démarre avec zéro autorisation d'accès et conserve une mémoire persistante entre les sessions. Il résout les problèmes de sécurité et de coût observés chez d'autres agents.

Système de développement de produits open-source à 31 agents pour Claude, avec plus de 12 000 lignes de contenu
Une compétence Claude open source fournit 31 agents IA spécialisés et 20 cadres stratégiques couvrant tous les départements de l'entreprise, du produit à la conformité. Le système sous licence MIT comprend 62 fichiers avec plus de 12 000 lignes de contenu actionnable, une conformité spécifique par pays pour plusieurs régions, et un système de chargement intelligent qui achemine les demandes efficacement.

Framework Open-Source Utilise Claude Code CLI pour la Surveillance Automatisée des Dépôts GitHub
Un développeur a open-sourcé un framework qui exécute Claude Code CLI selon un planning cron pour trier l'activité GitHub sur plusieurs dépôts. L'outil inclut le suivi d'état, la déduplication, les notifications Discord et un système de pré-vérification qui évite les coûts d'API quand rien n'a changé.

Votre outil de part équitable : Calculez votre part égale des bénéfices de l'entreprise
Un développeur a créé un outil web utilisant Claude Code et Vercel qui calcule quelle serait votre part égale des bénéfices annuels de votre employeur sur la base des déclarations SEC 10-K. L'outil montre des chiffres spécifiques comme les 747 000 $ par employé d'Apple et les 2,8 millions de dollars par employé de NVIDIA.