MCP Context Bloat: Custos Reais e uma Solução Prática para Usuários do Claude Code

✍️ OpenClawRadar📅 Publicado: May 19, 2026🔗 Source
MCP Context Bloat: Custos Reais e uma Solução Prática para Usuários do Claude Code
Ad

Um usuário do Reddit que executou 9 servidores MCP no Claude Code por quatro meses detalhou os custos ocultos e a degradação de desempenho que enfrentou, juntamente com uma solução concreta. O post é leitura obrigatória para quem usa MCP em produção.

A Matemática

Com 9 servidores (filesystem, GitHub, Stripe, Linear, Notion, Postgres, Sentry, AWS e customizados) expondo 142 ferramentas no total, a inicialização a frio consome 38k tokens de prompt do sistema + esquemas de ferramentas a cada turno. A 200 turnos/dia, são 7,6M de tokens de entrada/dia. Com preços do Sonnet (~$15/M saída, ~$3/M entrada), isso dá ~$23/dia ou ~$700/mês apenas nas definições das ferramentas MCP — antes de qualquer trabalho real. O cache só ajuda em prefixos idênticos; rodar um servidor MCP invalida o cache.

O Que Quebra

  • A seleção de ferramentas degrada: Com 142 ferramentas no contexto, Claude começou a escolher a ferramenta errada para consultas óbvias (ex.: usar linear_search_issues quando pedia para ler um arquivo).
  • Enumeração lenta: Servidores com muitos esquemas, como AWS, levam de 4 a 6 segundos para listar ferramentas.
  • Propagação silenciosa de erros: Uma ferramenta mal descrita pode contaminar a classificação de todas as consultas relacionadas.
Ad

A Solução: Padrão de Gateway com BM25

O usuário migrou para um padrão de gateway usando Ratel, uma biblioteca Rust de código aberto e em processo com classificação BM25. Claude agora vê apenas três ferramentas: search_tools, invoke_tool e auth. Todo o resto é classificado sob demanda. Resultados:

  • A inicialização a frio caiu de 38k para ~4k tokens.
  • A seleção de ferramentas erradas foi quase eliminada porque o modelo só vê as 5 melhores classificadas pela consulta.
  • A configuração levou 10 minutos (um comando faz a importação do Claude Code).

O autor observa que a maioria das startups de "otimizador MCP" é apenas busca BM25 disfarçada. As descrições de ferramentas são curtas, estruturadas e cheias de correspondências de palavras-chave — sem necessidade de vetor DB ou LLM no loop. BM25 sobre uma projeção plana de nome + descrição obtém 90% do ganho deterministicamente em microssegundos, offline.

Lição fundamental: "substituir" é melhor que "sugerir". Se seu gateway entrega 5 ferramentas ao modelo em vez de 142, a matemática funciona. Se sugere 5 junto com 142, o modelo ainda carrega 142 e você não economizou nada.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Os ganchos de código do Claude impedem a interferência entre abas do Chrome em múltiplas sessões.
Tools

Os ganchos de código do Claude impedem a interferência entre abas do Chrome em múltiplas sessões.

Um desenvolvedor criou três hooks (session-start, capture-tab-id, enforce-tab-id) que fixam cada sessão do Claude Code em sua própria aba do Chrome, impedindo que as sessões acessem acidentalmente as abas de outras sessões durante execuções de teste e preenchimentos de formulário.

OpenClawRadar
PACT 0.4.0 adiciona inteligência composta para agentes de codificação de IA
Tools

PACT 0.4.0 adiciona inteligência composta para agentes de codificação de IA

O PACT (Programmatic Agent Constraint Toolkit) versão 0.4.0 introduz recursos de inteligência composta que ajudam os agentes de programação de IA a reter conhecimento entre sessões. A atualização inclui síntese de pesquisa, um diretório de conhecimento e sistemas de autoconsciência de capacidades.

OpenClawRadar
Habilidade Local de Redação de PII para OpenClaw Utiliza o Modelo GLiNER
Tools

Habilidade Local de Redação de PII para OpenClaw Utiliza o Modelo GLiNER

Uma nova habilidade do OpenClaw intercepta respostas de saída e as processa através do modelo local nvidia/gliner-PII para detectar e redigir informações sensíveis como chaves de API e PII, substituindo-as por rótulos como [API_KEY] e adicionando avisos de remoção.

OpenClawRadar
Gargalo de Verificação de Código do Claude e Solução de Plugin de Automação de Navegador
Tools

Gargalo de Verificação de Código do Claude e Solução de Plugin de Automação de Navegador

Um desenvolvedor relata que a verificação continua sendo a parte mais lenta do uso do Claude Code, exigindo testes manuais de recursos. Eles encontraram um plugin de automação de navegador que permite ao agente verificar fluxos reais do produto antes de marcar tarefas como concluídas.

OpenClawRadar