ReasonDB: Open-Source-Dokumentendatenbank mit LLM-gesteuerter Baumnavigation anstelle von Vektorsuche

Was ReasonDB macht
ReasonDB ist eine Open-Source-Dokumentendatenbank, die einen anderen Ansatz für die Wissensabfrage verfolgt, indem sie die Dokumentenstruktur als Hierarchie beibehält (Überschriften → Abschnitte → Absätze) und es dem LLM ermöglicht, diesen Baum zu durchlaufen, um Antworten zu finden. Dies behebt das häufige Problem, bei dem Abfragefehler in Vektor-DBs und RAG-Pipelines zu undurchsichtigen Debugging-Blackboxen werden.
Wie es funktioniert
Erfassungsprozess: Dokumente werden in Markdown konvertiert, nach Struktur segmentiert, zu einem Baum aufgebaut und jeder Knoten wird von einem LLM zusammengefasst (von unten nach oben).
Abfrageprozess: BM25 reduziert Kandidatenknoten → tree-grep filtert nach Struktur → LLM bewertet nach Zusammenfassungen → Beam-Search-Traversierung über den Baum extrahiert die Antwort. Das LLM besucht etwa 25 Knoten von Millionen, anstatt einen flachen Vektorindex zu durchsuchen.
Abfragesprache und Stack
ReasonDB verwendet RQL, eine SQL-ähnliche Abfragesprache:
SELECT * FROM contracts SEARCH 'payment terms' REASON 'What are the late payment penalties?' LIMIT 5;Wobei SEARCH = BM25 und REASON = LLM-gesteuerte Baumtraversierung.
Der Stack ist in Rust mit redb, tantivy, axum und tokio aufgebaut. Es handelt sich um eine einzelne Binärdatei, die mit OpenAI, Anthropic, Gemini, Cohere und kompatiblen APIs (einschließlich lokaler oder OpenAI-kompatibler Endpunkte) funktioniert.
Praktische Anwendungen
Dieser Ansatz ist besonders nützlich für Entwickler, die mit der RAG-Abfragequalität kämpfen oder strukturierte Abfrage anstelle reiner Vektorsuche ausprobieren möchten. Das Tool wurde nach 3 Jahren Erfahrung mit Wissensabfrage bei Brainfish entwickelt, wo Vektor-DBs, Graph-DBs und benutzerdefinierte RAG-Pipelines stets dieselben Debugging-Herausforderungen darstellten.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

ModelFitAI: KI-Agenten ohne VPS-Einrichtung bereitstellen, erstellt mit Claude Code
ModelFitAI ist eine Plattform, die es Entwicklern ermöglicht, KI-Agenten direkt auf ihrer Infrastruktur zu deployen, ohne VPS-Einrichtung, Docker-Konfiguration und SSH-Sitzungen. Die gesamte Plattform wurde von einem Einzelgründer mit Claude Code erstellt.

Lobster Cage: Dockerisierte Sicherheitsumgebung für Self-Hosting von OpenClaw auf Raspberry Pi
Ein Entwickler hat Lobster Cage erstellt, eine Docker Compose-Umgebung mit eingeschränktem ausgehendem Zugriff und Proxy-basiertem Routing, um OpenClaw sicher auf einem Raspberry Pi für Experimente auszuführen.

Hybride Suche mit RRF verbessert KI-Gedächtnissystem im Vergleich zu reiner Vektorsuche
Ein Open-Source-AI-Gedächtnissystem mit PostgreSQL und pgvector stellte fest, dass reine Vektorsuche für exakte Übereinstimmungen unzureichend ist, fügte daher Volltextsuche hinzu und fusionierte Ergebnisse mittels Reciprocal Rank Fusion (RRF) mit k=60 sowie Abfrageanreicherung via Tokenizer.

Relay: Ein Tool zur Übergabe von Claude-Code-Sitzungen an andere KI-Agenten
Relay ist ein Rust-Binary, das den Sitzungskontext von Claude Code extrahiert – einschließlich Gesprächsverlauf, Tool-Aufrufe, Fehler und Git-Status – und ihn an andere KI-Agenten wie Codex oder Gemini weitergibt, wenn Ratenlimits erreicht werden. Es unterstützt 8 Agenten und kann über GitHub oder npm installiert werden.