O pipeline MCP de chamada única reduz o uso de tokens do Claude Code em 74%.

✍️ OpenClawRadar📅 Publicado: March 1, 2026🔗 Source
O pipeline MCP de chamada única reduz o uso de tokens do Claude Code em 74%.
Ad

Um desenvolvedor compartilhou sua experiência construindo um motor de contexto (servidor MCP) que dá ao Claude Code um grafo de dependência de bases de código, permitindo que ele leia apenas o código relevante em vez de arquivos inteiros. A ferramenta reduz significativamente o uso de tokens ao servir grafos de dependência e esqueletos em vez de arquivos brutos.

Problema original e solução inicial

O Claude Code normalmente lê arquivos inteiros e despeja tudo no contexto, consumindo tokens rapidamente. A abordagem inicial envolvia servir apenas código relevante via MCP usando grafos de dependência e esqueletos em vez de arquivos brutos, o que por si só reduziu o uso de tokens em 65%.

Ineficiência identificada e solução

Usuários apontaram que o fluxo de trabalho do MCP em si era desperdiçador, com agentes fazendo múltiplas idas e voltas: chamando get_context_capsule, lendo o resultado, depois chamando get_impact_graph, lendo esse resultado, seguido por search_memory, e lendo esse resultado. Isso criava três idas e voltas com resultados sobrepostos no contexto.

A correção do run_pipeline

O desenvolvedor lançou uma ferramenta MCP de chamada única chamada run_pipeline que substitui o fluxo de trabalho de múltiplas etapas. A ferramenta detecta automaticamente a intenção (depurar/modificar/refatorar/explorar) e executa a combinação apropriada de busca de contexto, análise de impacto e recuperação de memória no lado do servidor.

run_pipeline({
  task: "corrigir bug de validação JWT",
  preset: "auto",
  max_tokens: 10000,
  observation: "JWT usa Ed25519" // salva insight na mesma chamada
})

Esta única chamada substitui 3-4 chamadas individuais. Os resultados são deduplicados e mesclados dentro de um orçamento de tokens antes de chegar à janela de contexto, resultando em aproximadamente 60% menos tokens de contexto em comparação com chamar ferramentas individualmente. O parâmetro observation permite que agentes salvem informações aprendidas na mesma chamada sem uma etapa separada de save_observation. A memória está vinculada a nós do grafo de código, então quando o código muda, as observações são automaticamente marcadas como desatualizadas.

Ad

Recursos adicionais lançados

  • Pipeline de observação passiva: observador de arquivos → diff de hash blake3 → diffs estruturais em nível AST → autocorrelação com chamadas de ferramentas → observações de configuração zero
  • CLI que funciona sem VS Code: npm install -g vexp-cli
  • Ganchos do Git que não sobrescrevem os existentes (blocos delimitados por marcadores)
  • Exibição de economia de tokens na barra lateral do VS Code mostrando números reais com uma janela rolante de 24 horas

Disponibilidade

A ferramenta é gratuita para experimentar com um nível gratuito generoso oferecendo 2.000 nós, funcionalidade básica de pipeline e memória completa de sessão. Nenhuma conta ou chave de API é necessária, e ela não faz nenhuma chamada de rede. A arquitetura principal inclui um motor de gráfico em Rust e analisadores tree-sitter construídos pelo desenvolvedor, com o Claude Code auxiliando na camada de protocolo MCP, migrações de esquema SQLite e modelos de instrução de agentes.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Open Swarm: Sistema de Código Aberto para Executar Milhares de Agentes de IA em Paralelo
Tools

Open Swarm: Sistema de Código Aberto para Executar Milhares de Agentes de IA em Paralelo

Open Swarm é um sistema de código aberto que gera milhares de agentes de IA paralelos com acesso completo a mais de 150 ferramentas da internet, incluindo e-mail, mídias sociais, Google Workspace, pesquisa na web, execução de código e agendamento cron.

OpenClawRadar
dead-letter: Conversor Local de .eml para .md com CLI, Web UI e Servidor MCP
Tools

dead-letter: Conversor Local de .eml para .md com CLI, Web UI e Servidor MCP

dead-letter normaliza exportações de e-mail para Markdown com front matter YAML, personalizável. Oferece quatro modos de acesso: CLI, biblioteca Python, interface web e um servidor MCP para integração direta com Claude Desktop, Claude Code e Codex.

OpenClawRadar
bunx ccusage mostra US$ 18.450 em créditos queimados — Planos fixos absorvem o custo
Tools

bunx ccusage mostra US$ 18.450 em créditos queimados — Planos fixos absorvem o custo

Um usuário no r/ClaudeAI executou bunx ccusage e descobriu que consumiu US$ 18.450 em créditos em maio — 248 milhões de tokens de entrada, 42 milhões de tokens de saída, 21,7 bilhões com leituras de cache — pagando apenas €400/mês no plano fixo para Claude Code e Codex.

OpenClawRadar
Otimizador Gratuito de Sessão Claude: Estimador de Tokens, Compressor de Prompts e Planejador de Sessões
Tools

Otimizador Gratuito de Sessão Claude: Estimador de Tokens, Compressor de Prompts e Planejador de Sessões

Um desenvolvedor criou uma ferramenta gratuita e sem necessidade de cadastro para ajudar a gerenciar os limites de uso do Claude com três funcionalidades: um estimador de tokens para visualizar o consumo de prompts, um compressor de prompts que reduz prompts em 40-60% removendo frases desnecessárias, e um planejador de sessões que agrupa tarefas para minimizar o recarregamento de contexto.

OpenClawRadar