Serveur MCP pour la Recherche Sémantique dans les Vaults Obsidian

Un développeur a créé un serveur MCP qui offre des capacités de recherche sémantique pour les coffres Obsidian, résolvant le problème des agents qui manquent des documents pertinents en raison des limitations de la correspondance par mots-clés.
Fonctionnalités Clés
- Indexe les coffres Obsidian dans la base de données vectorielle Qdrant avec des embeddings locaux
- Utilise le modèle d'embedding BAAI/bge-small-en-v1.5 (384 dimensions, aucune clé API requise)
- Segmente le markdown par titres sans casser les tableaux ou les blocs de code
- Démarre automatiquement Qdrant via Docker s'il n'est pas déjà en cours d'exécution
- Prend en charge le filtrage par projet, type de document ou étiquettes de frontmatter
- Met en œuvre une indexation incrémentielle - ne ré-embarque que les fichiers modifiés
- Retourne uniquement les segments pertinents plutôt que des fichiers entiers
- Maintient des performances rapides même avec de grands coffres contenant des centaines de fichiers
Compatibilité et Disponibilité
Le serveur fonctionne avec Claude Code, Cursor, Windsurf, ou tout agent compatible MCP. Il est disponible sur GitHub et PyPI :
- GitHub : https://github.com/Marco-O94/obsidian-qdrant-search
- PyPI : https://pypi.org/project/obsidian-qdrant-search/
Le développeur sollicite des retours sur les stratégies de segmentation, les choix de modèles d'embedding et les rapports de bogues, notant que certains cas particuliers pourraient ne pas encore être couverts.
📖 Read the full source: r/ClaudeAI
👀 See Also
MTP + Mémoire Unifiée améliore l'inférence de llama.cpp de 30% sur RTX 5090
L'activation de la spéculation MTP avec GGML_CUDA_ENABLE_UNIFIED_MEMORY=1 fait passer Qwen3.6-27B Q8_0 de 49 à 64 tok/s sur une RTX 5090 avec 128 Go de RAM système.

Expérience Utilisateur : Passer d'OpenClaw à l'Agent Hermes sur un LLM Local
Un développeur rapporte avoir basculé d'OpenClaw à Hermes Agent en utilisant Qwen3.5-9B sur une RX 9070 XT avec 16 Go de VRAM. Hermes a accompli une tâche complexe avec 5 appels d'outils corrects contre plus de 50 étapes pour OpenClaw, terminant 2 minutes 30 plus rapidement tout en conservant les fonctionnalités de RAG, d'appel d'outils et de mémoire persistante.

Encre : Une plateforme de déploiement où les agents IA Claude sont les utilisateurs principaux
Ink (ml.ink) est une plateforme de déploiement conçue pour les agents d'IA comme Claude, offrant un déploiement par simple appel d'outil, une détection automatique des frameworks, et des services intégrés incluant le calcul, les bases de données, le DNS, les secrets, les domaines, les métriques et les journaux.
Interné en physique chez Hugging Face : Un cadre multi-agent double les performances de Gemini sur le benchmark CritPt
Hugging Face a publié physics-intern, un framework multi-agents pour la recherche en physique théorique qui double les performances des modèles Gemini sur le benchmark CritPt et établit un nouveau SOTA face à GPT-5.5 Pro à moindre coût.