Carregar todo servidor MCP em todo prompt silenciosamente destrói o orçamento de tokens

✍️ OpenClawRadar📅 Publicado: May 2, 2026🔗 Source
Carregar todo servidor MCP em todo prompt silenciosamente destrói o orçamento de tokens
Ad

Um post no r/ClaudeAI relata um problema sutil, porém custoso: quando vários servidores MCP estão configurados, cada prompt carrega todos eles por padrão, até mesmo consultas triviais. O usuário tinha de 5 a 6 servidores e não percebeu até verificar o uso de tokens — os prompts estavam queimando tokens ao carregar definições de servidores irrelevantes a cada vez.

Detalhes Principais

  • Cada prompt carregava o conjunto completo de servidores MCP (5 a 6 servidores).
  • Até prompts simples (ex.: "Que horas são?") acionavam todas as definições de servidores.
  • Solução: uma camada de roteamento personalizada que seleciona apenas os servidores relevantes para o prompt.
  • Resultado: o uso de tokens caiu significativamente e os tempos de resposta melhoraram.
  • O OP admitiu que "não acredita que deixou isso passar por tanto tempo sem verificar".
Ad

Contexto Técnico

Servidores MCP (Model Context Protocol) são ferramentas que estendem as capacidades do Claude (ex.: acesso ao sistema de arquivos, consultas a banco de dados, web scraping). O comportamento padrão em muitas configurações — incluindo clientes forkados e configs manuais — é enviar a lista completa de definições de servidores a cada mensagem. Isso significa que ferramentas para acesso a banco de dados, E/S de arquivos, navegação na web, etc., são todas despejadas no contexto antes que a entrada real do usuário seja processada.

Uma camada de roteamento pode inspecionar a mensagem do usuário (ou o prompt do sistema) e incluir condicionalmente apenas os servidores MCP cujas descrições ou ferramentas correspondam à intenção. Por exemplo, um prompt mencionando um caminho de arquivo ativaria ferramentas de arquivo; uma pergunta sobre preços de ações carregaria apenas o servidor financeiro. Isso evita a sobrecarga de tokens de metadados de servidores irrelevantes.

Para Quem é Isso

Desenvolvedores que executam Claude com múltiplos servidores MCP, especialmente em pipelines automatizados ou frontends personalizados onde a eficiência de tokens é importante.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Usuário do Reddit Adverte: Ao Usar Claude para Projetos Complexos, Enfrente a Parte Mais Difícil Primeiro
Tips

Usuário do Reddit Adverte: Ao Usar Claude para Projetos Complexos, Enfrente a Parte Mais Difícil Primeiro

Um desenvolvedor no r/ClaudeAI relata que permitir que a IA planeje incrementalmente para um editor de documentos complexo levou a uma 'sopa de complexidade' e falhas. O usuário aconselha forçar o modelo a resolver o caso de uso mais complicado primeiro, pois seu desempenho se degrada com mais contexto.

OpenClawRadar
Corrigindo as Alucinações Temporais do Claude no Código do Claude com Hooks
Tips

Corrigindo as Alucinações Temporais do Claude no Código do Claude com Hooks

Um usuário descobriu que o Claude Code não tem acesso ao relógio em tempo real, fazendo com que ele sugira incorretamente ações como 'descanse um pouco' em momentos inadequados. A correção envolve adicionar um hook de uma linha ao arquivo ~/.claude/settings.json que injeta o horário atual no contexto do Claude em cada mensagem.

OpenClawRadar
Bases de Código Prontas para Agentes: Regras Negativas, Nomes Precisos, READMEs de Diretório
Tips

Bases de Código Prontas para Agentes: Regras Negativas, Nomes Precisos, READMEs de Diretório

Um desenvolvedor compartilha como regras CLAUDE.md, instruções negativas e nomes precisos reduziram o desperdício de tokens e impediram que o Claude Code inflasse classes como UserManager.

OpenClawRadar
Instruções Personalizadas Essenciais para o Claude para Evitar Aborrecimentos Comuns
Tips

Instruções Personalizadas Essenciais para o Claude para Evitar Aborrecimentos Comuns

Um usuário do Reddit compartilha três instruções personalizadas específicas para lidar com irritações comuns do Claude: exigir avisos antes de comandos destrutivos, evitar mudanças de plano no meio das respostas e manter blocos de código exclusivamente para código funcional.

OpenClawRadar