Memora v0.2.25 Serveur MCP : Écritures 5 fois plus rapides sur la base de données D1

Améliorations des performances dans Memora v0.2.25
Memora v0.2.25 est un serveur MCP (Model Context Protocol) léger qui fournit à Claude des capacités de mémoire persistante, incluant la recherche sémantique, des fonctionnalités de graphe de connaissances et la récupération entre sessions. Le serveur prend en charge SQLite pour le stockage local ou Cloudflare D1, S3 et R2 pour le stockage distant.
La dernière version se concentre sur des améliorations significatives des performances pour les opérations sur la base de données D1. Le changement principal est que les opérations memory_create et memory_update sur D1 ont été réduites de plus de 10 secondes à environ 2 secondes par appel.
Ce qui était lent
ensure_schema()effectuait 7 à 9 allers-retours D1 à chaque appel d'outil, gaspillant ~4-8s à chaque fois- Le scan de références croisées utilisait un modèle en deux étapes
list + get_embeddingsqui nécessitait ~10 allers-retours sur un stockage de 500 mémoires - Le jeton de session D1 était stocké au niveau de la classe et pouvait être écrasé par des threads en arrière-plan
Ce qui a changé
- Le schéma est maintenant mis en cache par instance de backend, payé une fois au moment de la connexion
- Le scan de références croisées a été réécrit en une seule opération paginée
LEFT JOIN - Le jeton de session a été déplacé vers un stockage par instance avec une mise en miroir du signet keep-max au niveau du backend
Performances mesurées sur D1 en direct
memory_create: plus de 10s → ~1,8smemory_update: plus de 10s → ~1,1sconnect()à partir du 2ème appel : ~4-8s → ~0ms (cache atteint)
Les améliorations supplémentaires incluent une réduction des requêtes aux objets durables (diminuant les coûts Cloudflare), une correction XSS dans l'interface graphique et une correction de la mise en cache du schéma pour les échanges de fichiers CloudSQLiteBackend. La version ne nécessite aucune migration de schéma et maintient la compatibilité ascendante sans changement d'API. Les 39 tests passent.
Ce type de serveur MCP est utile pour les développeurs qui souhaitent donner à leurs agents d'IA de codage une mémoire persistante entre les sessions, permettant des interactions plus contextuelles et cohérentes.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Qwen 3.6 27B avec MTP sur V100 32GB : 54 t/s via la branche llama.cpp
La branche MTP d'am17an de llama.cc fait tourner Qwen 3.6 27B à 54 t/s sur V100 32GB via adaptateur PCIe, tombant à 29-30 t/s sans MTP.

AskAlf : Plateforme d'orchestration multi-agent open source pour les flux de travail d'IA auto-hébergés
AskAlf est une plateforme d'orchestration multi-agents open-source qui s'exécute sur votre propre matériel, créant dynamiquement des travailleurs spécialisés qui se coordonnent via un système autonome avec une mémoire cognitive à 10 couches stockée dans pgvector.

OnPrem.LLM AgentExecutor : Lancez des Agents IA Sandboxés avec des Outils Intégrés
L'AgentExecutor d'OnPrem.LLM permet de créer des agents IA autonomes qui exécutent des tâches complexes en utilisant des modèles cloud ou locaux, avec neuf outils intégrés incluant les opérations sur fichiers, les commandes shell et la recherche web. Vous pouvez exécuter les agents dans des conteneurs isolés pour la sécurité.

Le Framework AutoAgents Rust Ajoute des Liaisons Python pour le Prototypage
AutoAgents, un framework multi-agent basé sur Rust, dispose désormais de liaisons Python qui permettent aux développeurs de prototyper en Python tout en conservant le même runtime central Rust, les interfaces de fournisseurs, le modèle de pipeline et la sémantique des agents. Les liaisons permettent d'expérimenter avec des modèles d'IA locaux sans systèmes externes.