mcp-optimizer reduce el desperdicio de tokens de servidores MCP inactivos en Claude Code

mcp-optimizer es un complemento que aborda el desperdicio de tokens en Claude Code al usar servidores del Protocolo de Contexto de Modelo (MCP). El problema: cada servidor MCP conectado carga su esquema completo de herramientas en cada conversación, incluso si las herramientas nunca se usan. Con tres servidores, esto puede desperdiciar aproximadamente 6,500+ tokens por sesión.
Características principales
mcp-doctor– verifica el estado de tus servidores MCPmcp-audit– observa qué herramientas usas realmente versus cuáles desperdician tokensmcp-optimize– genera una configuración local del proyecto con solo lo que necesitasmcp-to-skills– convierte herramientas MCP en Skills locales bajo demanda (costo cero en reposo)
El concepto central: los Skills solo se cargan cuando se invocan, mientras que los esquemas MCP se cargan cada vez. Esta optimización reduce el consumo innecesario de tokens.
Instalación
Instala a través del mercado de complementos:
/plugin marketplace add choam2426/mcp-optimizer
/plugin install mcp-optimizerEl complemento está disponible en GitHub en https://github.com/choam2426/mcp-optimizer.
📖 Read the full source: r/ClaudeAI
👀 Ver también

SmallClaw v1.0.2 añade un sistema de tareas en segundo plano para LLMs locales.
SmallClaw v1.0.2 introduce un motor de tareas en segundo plano que ejecuta flujos de trabajo de múltiples pasos de forma autónoma, con verificación de pasos para abordar los problemas de confiabilidad de los modelos pequeños. La actualización ha sido probada en modelos de clase 4B como qwen3:4b en máquinas de 8GB.

Habilidad de Escritura de Libros Multi-Agente OpenClaw Lanzada
Se ha lanzado como habilidad un sistema de escritura de libros multiagente basado en OpenClaw, que incluye conexión DeepWiki MCP, generación de imágenes GLM para ilustraciones, estimación de presupuesto y revisión a nivel de capítulo. Dos capítulos del Libro del Paradigma OpenClaw se han actualizado utilizando esta herramienta.

Claude Code carga perezosamente esquemas de herramientas mediante ToolSearch para ahorrar tokens
Claude Code difiere la carga de esquemas de herramientas enviando solo los nombres de las herramientas por adelantado y requiriendo una llamada ToolSearch para obtener los esquemas antes de su uso. Esta arquitectura reduce significativamente el consumo de tokens.

NexQuant: Motor de caché KV de 3 bits nativo en Rust para implementación en el edge
NexQuant es un motor Rust optimizado para producción que permite ejecutar modelos de alto contexto en hardware de consumo con una reducción de memoria de 3-5x. Soporta backends Metal, CUDA, Vulkan y CPU.