Cerveau Ouvert : Le serveur MCP open-source ajoute une mémoire persistante avec auto-graph et recherche sémantique à Claude

✍️ OpenClawRadar📅 Publié: April 15, 2026🔗 Source
Cerveau Ouvert : Le serveur MCP open-source ajoute une mémoire persistante avec auto-graph et recherche sémantique à Claude
Ad

Ce que fait Open Brain

Open Brain est un serveur MCP qui fournit à Claude (Code, Desktop ou tout client MCP) une mémoire persistante entre les sessions. Lorsque vous demandez à Claude de "se souvenir de cela", il capture la pensée en l'intégrant, en extrayant les entités (personnes, outils, projets, organisations), en évaluant sa qualité, en vérifiant les doublons sémantiques et en créant automatiquement des liens vers des pensées associées. Les recherches ultérieures fonctionnent par signification plutôt que par mots-clés.

Fonctionnalités différenciantes clés

  • Graphe automatique : Les connexions entre les pensées sont créées automatiquement lors de la capture avec des liens typés (étend, contredit, est une preuve pour) à des seuils de similarité de 0,80+
  • Déduplication sémantique : Les captures à une similarité de 0,92+ fusionnent automatiquement au lieu de créer des doublons
  • Évaluation de la pertinence : Système de classement à 6 facteurs (récence, fréquence d'accès, connexions, fusions, poids de la source, épinglé) qui met en avant les pensées fréquemment utilisées au fil du temps
  • Recherche hybride : Texte intégral BM25 + similarité cosinus pgvector avec fusion de rang réciproque
  • 16 outils MCP : Inclut le parcours de graphes, la navigation dans les entités, la synthèse des revues hebdomadaires, l'élagage des éléments obsolètes, la revue des doublons et l'analyse de densité
  • Élagage des éléments obsolètes : Les pensées non pertinentes se dégradent et sont automatiquement archivées de manière douce avec confirmation par LLM et protection des entités uniques
Ad

Stack technique et configuration

Construit sur Supabase (Postgres + pgvector) + Deno Edge Functions + OpenRouter. Le système est auto-hébergeable — vous possédez vos données et l'exécutez sur votre propre projet Supabase.

La configuration prend environ 10 minutes :

  1. Cloner le dépôt
  2. Exécuter le bootstrap (configuration interactive des secrets)
  3. Exécuter le déploiement (schéma + fonctions)
  4. Exécuter la validation (vérification en 8 étapes)

Le script de déploiement affiche une commande claude mcp add prête à coller pour une intégration immédiate.

Compatibilité et licence

Fonctionne avec Claude Code, Claude Desktop, ChatGPT et tout client compatible MCP. Le projet est sous licence MIT avec 40 migrations SQL, 5 Edge Functions et 138 tests.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

La bifurcation vllm-mlx ajoute l'appel d'outils et le cache de prompts pour les agents d'IA de codage locaux.
Tools

La bifurcation vllm-mlx ajoute l'appel d'outils et le cache de prompts pour les agents d'IA de codage locaux.

Un développeur a modifié vllm-mlx pour corriger les problèmes d'appel d'outils et ajouter la mise en cache des invites, réduisant le TTFT de 28s à 0,3s pour OpenClaw sur Apple Silicon. Le fork prend en charge Qwen3-Coder-Next à 65 tok/s sur M3 Ultra avec un appel de fonction fonctionnel.

OpenClawRadar
Affinage de Qwen 14B pour l'Autocomplétion Discord
Tools

Affinage de Qwen 14B pour l'Autocomplétion Discord

Un développeur a affiné le modèle Qwen 14B en utilisant son jeu de données de messages Discord pour créer un outil de saisie automatique.

OpenClawRadar
Utilisateur de Reddit mesure la surcharge des tokens MCP : 67 000 tokens consommés avant toute question
Tools

Utilisateur de Reddit mesure la surcharge des tokens MCP : 67 000 tokens consommés avant toute question

Un développeur a mesuré la surcharge de jetons de son serveur MCP à 67 000 jetons consommés avant même de poser une seule question, avec Playwright MCP utilisant 13 600 jetons et GitHub MCP utilisant 18 000 jetons en veille. Il a remplacé MCP par des compétences et des outils CLI pour réduire les coûts de contexte.

OpenClawRadar
Évaluation de Nemotron 3 Super 120B avec un contexte de 1 million de tokens sur M1 Ultra
Tools

Évaluation de Nemotron 3 Super 120B avec un contexte de 1 million de tokens sur M1 Ultra

Un utilisateur a testé Nemotron 3 Super 120B avec un modèle quantifié Q4_K_M en utilisant llama.cpp sur un M1 Ultra, atteignant une fenêtre de contexte d'un million de tokens qui a consommé environ 90 Go de VRAM. Les benchmarks de performance montrent des vitesses de génération de tokens allant de 255 t/s pour un traitement de prompt de 512 tokens jusqu'à 22,37 t/s pour un contexte de 100 000 tokens.

OpenClawRadar