Carregar todo servidor MCP em todo prompt silenciosamente destrói o orçamento de tokens

Um post no r/ClaudeAI relata um problema sutil, porém custoso: quando vários servidores MCP estão configurados, cada prompt carrega todos eles por padrão, até mesmo consultas triviais. O usuário tinha de 5 a 6 servidores e não percebeu até verificar o uso de tokens — os prompts estavam queimando tokens ao carregar definições de servidores irrelevantes a cada vez.
Detalhes Principais
- Cada prompt carregava o conjunto completo de servidores MCP (5 a 6 servidores).
- Até prompts simples (ex.: "Que horas são?") acionavam todas as definições de servidores.
- Solução: uma camada de roteamento personalizada que seleciona apenas os servidores relevantes para o prompt.
- Resultado: o uso de tokens caiu significativamente e os tempos de resposta melhoraram.
- O OP admitiu que "não acredita que deixou isso passar por tanto tempo sem verificar".
Contexto Técnico
Servidores MCP (Model Context Protocol) são ferramentas que estendem as capacidades do Claude (ex.: acesso ao sistema de arquivos, consultas a banco de dados, web scraping). O comportamento padrão em muitas configurações — incluindo clientes forkados e configs manuais — é enviar a lista completa de definições de servidores a cada mensagem. Isso significa que ferramentas para acesso a banco de dados, E/S de arquivos, navegação na web, etc., são todas despejadas no contexto antes que a entrada real do usuário seja processada.
Uma camada de roteamento pode inspecionar a mensagem do usuário (ou o prompt do sistema) e incluir condicionalmente apenas os servidores MCP cujas descrições ou ferramentas correspondam à intenção. Por exemplo, um prompt mencionando um caminho de arquivo ativaria ferramentas de arquivo; uma pergunta sobre preços de ações carregaria apenas o servidor financeiro. Isso evita a sobrecarga de tokens de metadados de servidores irrelevantes.
Para Quem é Isso
Desenvolvedores que executam Claude com múltiplos servidores MCP, especialmente em pipelines automatizados ou frontends personalizados onde a eficiência de tokens é importante.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Usuário do Reddit Adverte: Ao Usar Claude para Projetos Complexos, Enfrente a Parte Mais Difícil Primeiro
Um desenvolvedor no r/ClaudeAI relata que permitir que a IA planeje incrementalmente para um editor de documentos complexo levou a uma 'sopa de complexidade' e falhas. O usuário aconselha forçar o modelo a resolver o caso de uso mais complicado primeiro, pois seu desempenho se degrada com mais contexto.

Corrigindo as Alucinações Temporais do Claude no Código do Claude com Hooks
Um usuário descobriu que o Claude Code não tem acesso ao relógio em tempo real, fazendo com que ele sugira incorretamente ações como 'descanse um pouco' em momentos inadequados. A correção envolve adicionar um hook de uma linha ao arquivo ~/.claude/settings.json que injeta o horário atual no contexto do Claude em cada mensagem.

Bases de Código Prontas para Agentes: Regras Negativas, Nomes Precisos, READMEs de Diretório
Um desenvolvedor compartilha como regras CLAUDE.md, instruções negativas e nomes precisos reduziram o desperdício de tokens e impediram que o Claude Code inflasse classes como UserManager.

Instruções Personalizadas Essenciais para o Claude para Evitar Aborrecimentos Comuns
Um usuário do Reddit compartilha três instruções personalizadas específicas para lidar com irritações comuns do Claude: exigir avisos antes de comandos destrutivos, evitar mudanças de plano no meio das respostas e manter blocos de código exclusivamente para código funcional.