TinySearch v0.2.0: Búsqueda web ligera para LLMs locales ahora respaldada por SearXNG

TinySearch v0.2.0 es una herramienta ligera de código abierto MCP/FastAPI para búsqueda web en LLMs locales pequeños. Busca en la web, rastrea algunas páginas, divide/recupera/reordena partes útiles y genera un blob de contexto compacto limitado a 8k tokens — ya no más volcados de 30k tokens de contenido sin sentido en los prompts del agente.
Cambios principales en v0.2.0
- SearXNG es ahora el backend de búsqueda predeterminado (reemplaza DuckDuckGo)
- Puedes apuntar TinySearch a tu propia instancia de SearXNG
- Más flexible y menos dependiente de un solo proveedor
- La salida sigue limitada a 8k tokens, optimizada para agentes LLM
DuckDuckGo comenzó a imponer límites y CAPTCHAs con más frecuencia en las últimas semanas. Para una herramienta MCP de la que dependen los agentes, eso no era aceptable. SearXNG añade algo de sobrecarga — las llamadas ahora toman entre 10 y 15 segundos — pero el autor dice que vale la pena por la conveniencia.
Para quién es
Desarrolladores que usan modelos locales más pequeños con Cline, Roo, OpenCode, agentes MCP, o cualquier configuración donde los presupuestos de contexto sean ajustados. El autor usa TinySearch a diario con Qwen3.5-9B para preguntas sobre versiones de librerías, llamadas a funciones y detalles específicos de las API de Azure/GCP.
Repositorio: github.com/MarcellM01/TinySearch
📖 Lee la fuente completa: r/LocalLLaMA
👀 Ver también

La Nueva API de Datos Estructurados Ofrece Precios por Suscripción para Agentes de LLM
Un desarrollador ha lanzado una API de datos estructurados que normaliza los precios de suscripción en plataformas de streaming, servicios de transporte compartido, aplicaciones de citas y otras plataformas basadas en suscripción. La API proporciona esquemas JSON consistentes, precios conscientes de la región cuando están disponibles y endpoints compatibles con MCP para que los agentes de LLM los consuman sin necesidad de scraping.

Desarrollador Logra Latencia de STT/TTS en Menos de un Segundo con Servidores Locales de Whisper y Coqui-TTS
Un desarrollador ha publicado implementaciones de servidor local de código abierto para Whisper STT y Coqui TTS que logran una latencia de ~0.2s de voz a texto y ~250ms de texto a voz, permitiendo agentes de IA conversacionales sin dependencias en la nube.

ArayCode: Cliente CLI de escritorio para OpenClaw con Voz, Atajos Multiagente e Interfaz Markdown
ArayCode convierte OpenClaw en una aplicación CLI de escritorio con E/S por voz, atajos multi-agente, temas y una interfaz de usuario basada en Markdown sobre Spectre.Console. Admite proveedores de STT/TTS en la nube y locales.

Resultados de Referencia: 15 LLMs Evaluados en 38 Tareas de Flujo de Trabajo Real
Un desarrollador comparó 15 LLMs en la nube y locales en 38 tareas de su flujo de trabajo real, incluyendo transformaciones CSV, conteo de letras, aritmética modular y cumplimiento de formato. Claude 3.5 Sonnet y Opus obtuvieron ambos un 100%, pero Sonnet cuesta 3.5 veces menos por llamada.