Semble: Un servidor MCP local para Claude Code con una reducción del 98% en tokens

Semble es un servidor MCP que permite a Claude Code buscar bases de código locales de manera eficiente, devolviendo solo fragmentos de código relevantes en lugar de archivos completos. Utiliza un híbrido de embeddings estáticos, BM25 y un stack de reranking optimizado para código, todo ejecutándose localmente en CPU — sin claves API, sin GPU, sin dependencias pesadas.
Instalación
Instala mediante uvx:
claude mcp add semble -s user -- uvx --from "semble[mcp]" semble
Una vez instalado, Claude Code puede buscar en cualquier repositorio — local o remoto — directamente.
Detalles clave
- Reducción de tokens: Utiliza aproximadamente un 98% menos de tokens que el enfoque típico de grep+read.
- Rendimiento: Indexa cualquier repositorio en unos 250ms, responde consultas en aproximadamente 1.5ms (todo en CPU).
- Calidad: Alcanza un NDCG@10 de 0.854 — el 99% del mejor híbrido de transformers probado, siendo aproximadamente 200 veces más rápido.
- Evaluado frente a: grepai, probe, colgrep y otros métodos existentes.
- Código abierto: Disponible en GitHub bajo la organización MinishLab.
Para quién es
Desarrolladores que usan Claude Code en bases de código grandes y quieren reducir el consumo de tokens y la latencia mientras obtienen resultados de búsqueda de código de alta calidad sin llamadas a API externas.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

Aplicación Móvil Fuera de la Red Incorpora Uso de Herramientas de IA en Dispositivo con una Mejora de Velocidad de 3 Veces
La aplicación móvil Off Grid ahora permite que los modelos de IA utilicen herramientas como búsqueda web, calculadora, fecha/hora e información del dispositivo completamente sin conexión, con opciones de caché KV configurables que ofrecen hasta 30 tokens/segundo en teléfonos.

Cull: Motor de código abierto para la curación de conjuntos de datos en pipelines de imágenes de IA
Cull extrae imágenes de más de 340 fuentes, incluyendo Civitai, X/Twitter, Reddit, Discord y sitios booru, las clasifica con un modelo de lenguaje visual a través de LM Studio local o Groq, y las organiza en carpetas por categoría con prompts de SD y registros de auditoría.

AgentLens: Herramienta de Observabilidad para Flujos de Trabajo de IA Multi-Agente
AgentLens proporciona trazabilidad unificada en Ollama, vLLM, Anthropic y OpenAI, con seguimiento de costos, un servidor MCP para consultar estadísticas desde Claude Code y una CLI para verificaciones en línea. Es autoalojado y se ejecuta localmente mediante Docker.

La aplicación ClawTalk para iOS permite chatear por voz con agentes de IA OpenClaw autoalojados.
ClawTalk es una aplicación nativa para iOS que proporciona chat de voz push-to-talk para configuraciones de LLM autohospedadas de OpenClaw. Cuenta con conversión de voz a texto en el dispositivo usando WhisperKit, respuestas en tiempo real con renderizado de markdown, y soporta múltiples opciones de TTS incluyendo ElevenLabs, OpenAI y las voces integradas de Apple.