ReasonDB : Base de données documentaire open-source utilisant la navigation arborescente guidée par LLM au lieu de la recherche vectorielle

✍️ OpenClawRadar📅 Publié: February 27, 2026🔗 Source
ReasonDB : Base de données documentaire open-source utilisant la navigation arborescente guidée par LLM au lieu de la recherche vectorielle
Ad

Ce que fait ReasonDB

ReasonDB est une base de données documentaire open-source qui adopte une approche différente pour la récupération de connaissances en préservant la structure des documents sous forme de hiérarchie (titres → sections → paragraphes) et en laissant le LLM naviguer dans cet arbre pour trouver des réponses. Cela résout le problème courant où les échecs de récupération dans les bases de données vectorielles et les pipelines RAG deviennent des boîtes noires de débogage.

Comment cela fonctionne

Processus d'ingestion : Les documents sont convertis en markdown, découpés par structure, construits en arbre, et chaque nœud est résumé par un LLM (de bas en haut).

Processus de requête : BM25 réduit les nœuds candidats → tree-grep filtre par structure → le LLM classe par résumés → un parcours par faisceau sur l'arbre extrait la réponse. Le LLM visite environ 25 nœuds sur des millions au lieu de parcourir un index vectoriel plat.

Ad

Langage de requête et pile technique

ReasonDB utilise RQL, un langage de requête de type SQL :

SELECT * FROM contracts SEARCH 'payment terms' REASON 'What are the late payment penalties?' LIMIT 5;

SEARCH = BM25 et REASON = parcours d'arbre guidé par LLM.

La pile technique est construite en Rust avec redb, tantivy, axum et tokio. C'est un binaire unique qui fonctionne avec OpenAI, Anthropic, Gemini, Cohere et les API compatibles (y compris les points de terminaison locaux ou compatibles OpenAI).

Applications pratiques

Cette approche est particulièrement utile pour les développeurs qui ont eu des difficultés avec la qualité de récupération RAG ou qui souhaitent essayer une récupération basée sur la structure plutôt qu'une recherche vectorielle pure. L'outil a été construit après 3 ans d'expérience avec la récupération de connaissances chez Brainfish, où les bases de données vectorielles, les bases de données graphiques et les pipelines RAG personnalisés présentaient systématiquement les mêmes défis de débogage.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Markdown en tant que protocole pour les interfaces agentiques avec exécution en flux continu
Tools

Markdown en tant que protocole pour les interfaces agentiques avec exécution en flux continu

Un prototype utilise Markdown comme protocole unifié permettant aux agents d'IA de diffuser du texte, du code exécutable et des données dans une seule réponse. Il propose une exécution en flux où le code s'exécute instruction par instruction à mesure qu'il arrive et une primitive mount() pour créer des interfaces React avec un flux de données entre le client, le serveur et le LLM.

OpenClawRadar
Mia : Démon d'espace de travail IA local avec application Android native et diffusion P2P
Tools

Mia : Démon d'espace de travail IA local avec application Android native et diffusion P2P

Mia est un démon qui s'exécute sur votre machine et s'associe à une application Android native via P2P, vous permettant de lancer et de surveiller des tâches de codage IA de longue durée depuis votre téléphone. Il prend en charge les agents OpenCode, Claude Code, Gemini CLI et Codex, diffusant la sortie directement sur votre appareil en temps réel.

OpenClawRadar
Explorer l'IA avec des Micro-robots : Comprendre les Agents IA grâce au Tuteur Nanorobot
Tools

Explorer l'IA avec des Micro-robots : Comprendre les Agents IA grâce au Tuteur Nanorobot

Un membre de la communauté OpenClaw partage ses réflexions avec le 'Nanobot Tutor', un mini-cadre visant à démystifier le fonctionnement des agents d'IA. Découvrez comment plonger dans cet environnement d'apprentissage compact révèle les mécanismes des agents intelligents.

OpenClawRadar
Résultats de Benchmark : 15 LLM Testés sur 38 Tâches de Flux de Travail Réelles
Tools

Résultats de Benchmark : 15 LLM Testés sur 38 Tâches de Flux de Travail Réelles

Un développeur a évalué 15 LLMs cloud et locaux sur 38 tâches issues de son flux de travail réel, incluant des transformations CSV, des comptages de lettres, de l'arithmétique modulaire et de la conformité de format. Claude 3.5 Sonnet et Opus ont tous deux obtenu 100 %, mais Sonnet coûte 3,5 fois moins par appel.

OpenClawRadar