Reduciendo el uso de tokens MCP al reemplazar servidores con alternativas CLI

Optimización de tokens mediante reducción de servidores MCP
Un desarrollador descubrió que cada servidor MCP agregado a su configuración volcaba todo su esquema de herramientas en la ventana de contexto con cada mensaje, consumiendo entre el 30 y el 40% de su contexto disponible. Esto hacía que alcanzara los límites de contexto más rápido de lo esperado.
Reemplazos específicos de MCP a CLI
Después de auditar su configuración, identificaron varios servidores MCP que tenían equivalentes CLI e hicieron estos reemplazos:
agentmail mcp → agentmail cli(instalado mediantenpm install -g agentmail-cli) - permite que Claude gestione el buzón, envíe correos y verifique mensajes a través de bashgithub mcp → gh cli- usando comandos comogh issue createygh pr listpostgres mcp → psql- usando comandos comopsql -c "select * from users"
Servidores MCP mantenidos en la configuración
Se conservaron dos servidores MCP porque carecían de buenas alternativas CLI:
- playwright mcp - para tareas de automatización del navegador
- memory mcp - para funcionalidad de memoria persistente
Configuración resultante y regla
El desarrollador redujo su cantidad de servidores MCP de 6 a 2 mientras mantenía toda la funcionalidad anterior. Estableció una nueva regla: "si hay una CLI, omite el MCP. Solo agrega MCPs para cosas que genuinamente no tienen una opción de línea de comandos". Este cambio hizo que su ventana de contexto se sintiera más grande y redujo la frecuencia con la que alcanzaba los límites.
📖 Read the full source: r/ClaudeAI
👀 Ver también

Claude CLI v2.1.154 rompe vLLM local — Un parche de una línea lo soluciona
Claude CLI ≥2.1.154 añade tres nuevos roles de API (ctx, msg, system) que rompen la compatibilidad local con vLLM. Un parche de una línea en el protocolo Anthropic de vLLM lo restaura.

Cómo se inyectan las instrucciones del Proyecto Claude — Y por qué cambiarlas a mitad de conversación rompe el historial
Las Instrucciones del Proyecto y las Preferencias del Usuario se cargan en el prompt del sistema al inicio de la conversación, no se reinyectan en cada turno. Cambiarlas a mitad de la conversación hace que Claude sobrescriba su memoria de las instrucciones anteriores, lo que genera recuerdos falsos.

Éxito silencioso: el enfoque de un desarrollador para las alertas de cron jobs
Un desarrollador en r/openclaw deja de enviar notificaciones de éxito para ejecuciones de cron saludables, alertando solo sobre fallos de autenticación, corrupción de estado o fallos repetidos.

Detén los guiones largos de Claude con una línea en Preferencias o Claude.md
Agrega una oración específica a las preferencias de tu perfil de Claude.ai o a Claude.md para reducir los guiones largos (~98%). Este es un ajuste práctico probado por la comunidad.