Carregar todo servidor MCP em todo prompt silenciosamente destrói o orçamento de tokens

Um post no r/ClaudeAI relata um problema sutil, porém custoso: quando vários servidores MCP estão configurados, cada prompt carrega todos eles por padrão, até mesmo consultas triviais. O usuário tinha de 5 a 6 servidores e não percebeu até verificar o uso de tokens — os prompts estavam queimando tokens ao carregar definições de servidores irrelevantes a cada vez.
Detalhes Principais
- Cada prompt carregava o conjunto completo de servidores MCP (5 a 6 servidores).
- Até prompts simples (ex.: "Que horas são?") acionavam todas as definições de servidores.
- Solução: uma camada de roteamento personalizada que seleciona apenas os servidores relevantes para o prompt.
- Resultado: o uso de tokens caiu significativamente e os tempos de resposta melhoraram.
- O OP admitiu que "não acredita que deixou isso passar por tanto tempo sem verificar".
Contexto Técnico
Servidores MCP (Model Context Protocol) são ferramentas que estendem as capacidades do Claude (ex.: acesso ao sistema de arquivos, consultas a banco de dados, web scraping). O comportamento padrão em muitas configurações — incluindo clientes forkados e configs manuais — é enviar a lista completa de definições de servidores a cada mensagem. Isso significa que ferramentas para acesso a banco de dados, E/S de arquivos, navegação na web, etc., são todas despejadas no contexto antes que a entrada real do usuário seja processada.
Uma camada de roteamento pode inspecionar a mensagem do usuário (ou o prompt do sistema) e incluir condicionalmente apenas os servidores MCP cujas descrições ou ferramentas correspondam à intenção. Por exemplo, um prompt mencionando um caminho de arquivo ativaria ferramentas de arquivo; uma pergunta sobre preços de ações carregaria apenas o servidor financeiro. Isso evita a sobrecarga de tokens de metadados de servidores irrelevantes.
Para Quem é Isso
Desenvolvedores que executam Claude com múltiplos servidores MCP, especialmente em pipelines automatizados ou frontends personalizados onde a eficiência de tokens é importante.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Camada de Governança para Agentes Claude: Limites de Segurança Rígidos e Rastreios ao Vivo em Produção
Um usuário da API Claude construiu uma camada de governança leve abaixo do agente para adicionar limites rígidos de segurança, rastreamentos em tempo real, controle humano-no-loop via Telegram e checkpoint automático — resolvendo falhas silenciosas e custos de token descontrolados em loops de agentes de longa duração.

Traduzir para pt: Gancho de Ferramenta de Postagem Personalizada para Carregamento Sob Demanda de CLAUDE.md Fora da Árvore do Projeto
Um desenvolvedor compartilha uma solução personalizada de hook PostToolUse que permite ao Claude Code ler arquivos CLAUDE.md de diretórios fora da árvore do projeto atual sob demanda, abordando limitações no comportamento de carregamento integrado.

Como eu interajo com modelos de IA em 2026 versus há um ano: 3 mudanças principais
Um desenvolvedor compartilha três mudanças concretas: trocar templates de prompt por habilidades reutilizáveis, escrever metas em vez de instruções passo a passo e usar comandos /loop para projetos de longa duração no Claude Code e Codex.

Oito Técnicas de Prompt que Melhoram a Qualidade da Saída do Claude
Um usuário do Reddit compartilha oito técnicas específicas de prompt que melhoraram consistentemente a qualidade da saída do Claude, incluindo comandos como "Pense em cada camada antes de responder" e "Encontre os 20% das ações que geram 80% dos resultados".