llmLibrarian: Motor de RAG Local con Integración MCP para Búsqueda de IA Basada en Archivos

Qué es Esto
llmLibrarian es un motor RAG (Generación Aumentada por Recuperación) local que expone capacidades de recuperación a través del Model Context Protocol (MCP). Te permite indexar carpetas en silos (colecciones de ChromaDB), luego consultarlos desde cualquier cliente MCP—incluyendo Claude—para obtener respuestas fundamentadas y citadas.
Características Clave y Arquitectura
La herramienta indexa carpetas en silos, que son colecciones de ChromaDB. Cuando quieres respuestas directas en lugar de fragmentos crudos, Ollama maneja la capa de síntesis. Todo se ejecuta localmente en tu máquina.
El desarrollador destaca la capacidad multi-silo como particularmente poderosa: combinar silos permite que surjan patrones entre dominios que serían difíciles de detectar manualmente. Por ejemplo, una carpeta de diario se convierte en un compañero de pensamiento que recuerda lo que has escrito, y una base de código se convierte en un agente que conoce tus archivos reales.
Herramientas MCP Expuestas
retrieve— búsqueda vectorial híbrida RRF que devuelve fragmentos crudos con puntuaciones de confianza para que Claude razone sobre ellosretrieve_bulk— consultas multi-ángulo en una llamada, útil al agregar entre tipos de documentosask— respuesta sintetizada por Ollama directamente del contexto recuperado (por defecto usa llama3.1:8b, pero puedes cambiar al modelo que tengas descargado)list_silos,inspect_silo,trigger_reindex— herramientas de gestión de índices
Pila Técnica
- ChromaDB para almacenamiento vectorial
- Ollama para síntesis de modelos
- sentence-transformers (all-mpnet-base-v2, acelerado por MPS) para incrustaciones
- fastmcp para la capa MCP
El desarrollador menciona que el etiquetado de metadatos multi-silo en ChromaDB tomó varias iteraciones para lograrlo correctamente y está abierto a discutir la arquitectura.
Este tipo de herramienta es útil para desarrolladores que quieren construir agentes de IA que puedan referenciar y razonar sobre sus archivos locales sin enviar datos a servicios externos.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Storybloq: Un rastreador de proyectos para Claude Code con aplicación Mac, CLI y MCP
Storybloq es un rastreador de proyectos gratuito y de código abierto que vive en .story/ dentro de tu repositorio. Incluye una aplicación para Mac (App Store), una CLI y un servidor MCP para exponer tickets, incidencias y transferencias de sesión a Claude Code.

AgentWorkingMemory: Un Sistema de Memoria Local para Agentes de Codificación de IA
AgentWorkingMemory (AWM) es un sistema de memoria local que resuelve el problema de amnesia entre sesiones en agentes de codificación con IA. Utiliza una base de datos SQLite, tres modelos de ML locales (~124MB en total) y se integra automáticamente mediante MCP para proporcionar memoria persistente y consciente del contexto a través de las sesiones de Claude Code.

PhantomCrowd: Simulador de Audiencia Multiagente Utilizando Claude Code
PhantomCrowd es un motor de predicción multiagente centrado en marketing que simula cómo reaccionan audiencias reales al contenido antes de publicarlo. Genera 10-500 personas con datos demográficos y personalidades únicas, cada una reaccionando de forma independiente a contenido como textos publicitarios o publicaciones sociales.

Runner de Benchmark de Código Abierto para Probar Agentes OpenClaw en Flujos de Trabajo Reales
Un nuevo proyecto de código abierto te permite evaluar agentes OpenClaw con tus propias tareas privadas del mundo real, definidas en YAML, con soporte para importar espacios de trabajo reales de agentes.