Serveur MCP memv : Mémoire structurée persistante pour agents IA

memv (open-source, Python) a publié un serveur MCP, rendant sa couche mémoire persistante et structurée utilisable depuis n'importe quel client MCP — y compris Claude Desktop, Code, Cursor ou des hôtes personnalisés.
Installation rapide
Installez via pip et lancez le serveur avec une seule commande :
pip install "memvee[mcp]" memv-mcp --db-url memory.db --llm-model openai:gpt-4o-mini
Vous pouvez aussi intégrer le serveur dans votre propre processus Python :
from memv.mcp.server import create_serverserver = create_server( db_url="memory.db", default_user_id="alice", embedding_client=my_embedder, llm_client=my_llm, ) server.run(transport="streamable-http")
Cinq outils MCP
search_memory— recherche hybride (vectoriel + BM25 + RRF)add_memory— insérer directement une mémoire structuréeadd_conversation— extraire et stocker des mémoires à partir d'une conversation (nécessite un LLM)list_memories— lister les mémoires stockées pour un utilisateurdelete_memory— supprimer avec vérification de propriété
Fonctionnalités clés
- LLM optionnel : la recherche et
add_memorydirecte fonctionnent sans LLM ; seule l'extraction viaadd_conversationen a besoin. - Isolation par utilisateur : chaque outil respecte les limites des utilisateurs, y compris la vérification de propriété sur
delete_memory. - Fusion concurrente : plusieurs extractions pour un même utilisateur sont fusionnées en une seule tâche.
- Extraction prédictive-calibrée : inspirée de Nemori, évite de tout stocker.
- Modèle bitemporel : les contradictions expirent plutôt que de se remplacer.
- Recherche hybride : combine recherche vectorielle, BM25 et fusion de rangs réciproques (RRF).
Documentation : https://vstorm-co.github.io/memv/advanced/mcp-server/
GitHub : https://github.com/vstorm-co/memv
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Qwen 3.6 27B avec MTP sur V100 32GB : 54 t/s via la branche llama.cpp
La branche MTP d'am17an de llama.cc fait tourner Qwen 3.6 27B à 54 t/s sur V100 32GB via adaptateur PCIe, tombant à 29-30 t/s sans MTP.

MCP Slim : La recherche par intégration locale pour les outils MCP réduit l'encombrement du contexte
MCP Slim est un proxy qui remplace les catalogues complets d'outils MCP par trois méta-outils (recherche, description, appel), utilisant des embeddings MiniLM locaux pour la recherche sémantique. Il permet une réduction de 96% de la fenêtre contextuelle et fonctionne hors ligne sans clés API.

Résultats de Benchmark : 331 Modèles GGUF Testés sur Mac Mini M4 16 Go
Un benchmark de 331 modèles GGUF sur un Mac Mini M4 avec 16 Go de RAM révèle seulement 11 modèles Pareto-optimaux, tous des architectures Mixture-of-Experts. Les modèles Mixture-of-Experts dominent les performances avec une médiane de 20,0 tokens/seconde contre 4,4 pour les modèles denses.

Claude Code a construit Treelo : un outil gratuit de transcription vidéo
Un monteur vidéo a utilisé Claude Code pour créer Treelo, un outil gratuit qui transcrit les fichiers vidéo/audio, supprime les mots de remplissage, permet le placement d'effets sonores à des horodatages précis et exporte des fichiers SRT pour Premiere ou ASS pour DaVinci Resolve.