llmLibrarian: Motor de RAG Local con Integración MCP para Búsqueda de IA Basada en Archivos

✍️ OpenClawRadar📅 Publicado: 30 de marzo de 2026🔗 Source
llmLibrarian: Motor de RAG Local con Integración MCP para Búsqueda de IA Basada en Archivos
Ad

Qué es Esto

llmLibrarian es un motor RAG (Generación Aumentada por Recuperación) local que expone capacidades de recuperación a través del Model Context Protocol (MCP). Te permite indexar carpetas en silos (colecciones de ChromaDB), luego consultarlos desde cualquier cliente MCP—incluyendo Claude—para obtener respuestas fundamentadas y citadas.

Características Clave y Arquitectura

La herramienta indexa carpetas en silos, que son colecciones de ChromaDB. Cuando quieres respuestas directas en lugar de fragmentos crudos, Ollama maneja la capa de síntesis. Todo se ejecuta localmente en tu máquina.

El desarrollador destaca la capacidad multi-silo como particularmente poderosa: combinar silos permite que surjan patrones entre dominios que serían difíciles de detectar manualmente. Por ejemplo, una carpeta de diario se convierte en un compañero de pensamiento que recuerda lo que has escrito, y una base de código se convierte en un agente que conoce tus archivos reales.

Ad

Herramientas MCP Expuestas

  • retrieve — búsqueda vectorial híbrida RRF que devuelve fragmentos crudos con puntuaciones de confianza para que Claude razone sobre ellos
  • retrieve_bulk — consultas multi-ángulo en una llamada, útil al agregar entre tipos de documentos
  • ask — respuesta sintetizada por Ollama directamente del contexto recuperado (por defecto usa llama3.1:8b, pero puedes cambiar al modelo que tengas descargado)
  • list_silos, inspect_silo, trigger_reindex — herramientas de gestión de índices

Pila Técnica

  • ChromaDB para almacenamiento vectorial
  • Ollama para síntesis de modelos
  • sentence-transformers (all-mpnet-base-v2, acelerado por MPS) para incrustaciones
  • fastmcp para la capa MCP

El desarrollador menciona que el etiquetado de metadatos multi-silo en ChromaDB tomó varias iteraciones para lograrlo correctamente y está abierto a discutir la arquitectura.

Este tipo de herramienta es útil para desarrolladores que quieren construir agentes de IA que puedan referenciar y razonar sobre sus archivos locales sin enviar datos a servicios externos.

📖 Leer la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Construyendo un agente de codificación para contexto de 8k: División planificador/ejecutor, presupuesto de tokens y ejecución paralela
Herramientas

Construyendo un agente de codificación para contexto de 8k: División planificador/ejecutor, presupuesto de tokens y ejecución paralela

Una explicación detallada de cómo construir un agente de programación CLI diseñado para límites de 8k tokens, utilizando una arquitectura de planificador/ejecutor, presupuesto estricto de tokens y ejecución paralela de tareas.

OpenClawRadar
Ktx: Una Capa de Contexto Ejecutable para Corregir la Precisión del Agente de Datos
Herramientas

Ktx: Una Capa de Contexto Ejecutable para Corregir la Precisión del Agente de Datos

Ktx es una capa de contexto ejecutable de código abierto que hace que los agentes sean confiables en tu stack de datos al combinar la ingesta de wikis Markdown con definiciones semánticas YAML.

OpenClawRadar
Benchmark Muestra que la Herramienta CLI Reduce los Costos de Tokens de Código de Claude en un 32% Mediante Navegación Estructural
Herramientas

Benchmark Muestra que la Herramienta CLI Reduce los Costos de Tokens de Código de Claude en un 32% Mediante Navegación Estructural

Un desarrollador creó una herramienta CLI en Rust que proporciona a los agentes Claude Code comandos de navegación estructural como 'muéstrame un resumen de 180 tokens de esta clase de 6,000 tokens'. La evaluación comparativa en Sonnet 4.6 a lo largo de 54 ejecuciones automatizadas mostró un 32% menos de costo por tarea y un 67% más de ediciones de código por sesión.

OpenClawRadar
Integración de OpenClaw para los Mercados Bursátiles Indios: Terminal de Análisis y Negociación Multiagente
Herramientas

Integración de OpenClaw para los Mercados Bursátiles Indios: Terminal de Análisis y Negociación Multiagente

Una terminal de trading de código abierto para los mercados indios se ha conectado como un servidor de habilidades de OpenClaw, permitiendo que cualquier agente de OpenClaw obtenga datos del mercado de valores indio y ejecute análisis completos a través de HTTP sin instalación local. El sistema utiliza siete agentes especialistas trabajando en paralelo para generar análisis estructurado con planes de trading.

OpenClawRadar