O pipeline MCP de chamada única reduz o uso de tokens do Claude Code em 74%.

✍️ OpenClawRadar📅 Publicado: March 1, 2026🔗 Source
O pipeline MCP de chamada única reduz o uso de tokens do Claude Code em 74%.
Ad

Um desenvolvedor compartilhou sua experiência construindo um motor de contexto (servidor MCP) que dá ao Claude Code um grafo de dependência de bases de código, permitindo que ele leia apenas o código relevante em vez de arquivos inteiros. A ferramenta reduz significativamente o uso de tokens ao servir grafos de dependência e esqueletos em vez de arquivos brutos.

Problema original e solução inicial

O Claude Code normalmente lê arquivos inteiros e despeja tudo no contexto, consumindo tokens rapidamente. A abordagem inicial envolvia servir apenas código relevante via MCP usando grafos de dependência e esqueletos em vez de arquivos brutos, o que por si só reduziu o uso de tokens em 65%.

Ineficiência identificada e solução

Usuários apontaram que o fluxo de trabalho do MCP em si era desperdiçador, com agentes fazendo múltiplas idas e voltas: chamando get_context_capsule, lendo o resultado, depois chamando get_impact_graph, lendo esse resultado, seguido por search_memory, e lendo esse resultado. Isso criava três idas e voltas com resultados sobrepostos no contexto.

A correção do run_pipeline

O desenvolvedor lançou uma ferramenta MCP de chamada única chamada run_pipeline que substitui o fluxo de trabalho de múltiplas etapas. A ferramenta detecta automaticamente a intenção (depurar/modificar/refatorar/explorar) e executa a combinação apropriada de busca de contexto, análise de impacto e recuperação de memória no lado do servidor.

run_pipeline({
  task: "corrigir bug de validação JWT",
  preset: "auto",
  max_tokens: 10000,
  observation: "JWT usa Ed25519" // salva insight na mesma chamada
})

Esta única chamada substitui 3-4 chamadas individuais. Os resultados são deduplicados e mesclados dentro de um orçamento de tokens antes de chegar à janela de contexto, resultando em aproximadamente 60% menos tokens de contexto em comparação com chamar ferramentas individualmente. O parâmetro observation permite que agentes salvem informações aprendidas na mesma chamada sem uma etapa separada de save_observation. A memória está vinculada a nós do grafo de código, então quando o código muda, as observações são automaticamente marcadas como desatualizadas.

Ad

Recursos adicionais lançados

  • Pipeline de observação passiva: observador de arquivos → diff de hash blake3 → diffs estruturais em nível AST → autocorrelação com chamadas de ferramentas → observações de configuração zero
  • CLI que funciona sem VS Code: npm install -g vexp-cli
  • Ganchos do Git que não sobrescrevem os existentes (blocos delimitados por marcadores)
  • Exibição de economia de tokens na barra lateral do VS Code mostrando números reais com uma janela rolante de 24 horas

Disponibilidade

A ferramenta é gratuita para experimentar com um nível gratuito generoso oferecendo 2.000 nós, funcionalidade básica de pipeline e memória completa de sessão. Nenhuma conta ou chave de API é necessária, e ela não faz nenhuma chamada de rede. A arquitetura principal inclui um motor de gráfico em Rust e analisadores tree-sitter construídos pelo desenvolvedor, com o Claude Code auxiliando na camada de protocolo MCP, migrações de esquema SQLite e modelos de instrução de agentes.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Arquitetura de Memória do Vektori: Princípios do Sistema Vazado do Claude
Tools

Arquitetura de Memória do Vektori: Princípios do Sistema Vazado do Claude

O Vektori implementa um grafo hierárquico de sentenças em três camadas para a memória de IA, inspirado nos princípios vazados da arquitetura do Claude. O sistema usa filtros de qualidade rigorosos, recuperação cética com uma pontuação mínima de 0,3 e mantém o histórico de correções entre sessões.

OpenClawRadar
cq: Um Sistema de Compartilhamento de Conhecimento Local-First para Agentes de Codificação de IA
Tools

cq: Um Sistema de Compartilhamento de Conhecimento Local-First para Agentes de Codificação de IA

O cq da Mozilla.ai é uma ferramenta de código aberto que permite que agentes de IA de programação compartilhem 'unidades de conhecimento' sobre armadilhas comuns por meio de um armazenamento SQLite local, com opção de compartilhamento em equipe através de uma API Docker. Ele é instalado como um plugin do Claude Code ou servidor MCP do OpenCode.

OpenClawRadar
Krasis: Runtime Híbrido CPU/GPU para Grandes Modelos MoE Alcança 3.324 tok/s de Preenchimento no RTX 5080
Tools

Krasis: Runtime Híbrido CPU/GPU para Grandes Modelos MoE Alcança 3.324 tok/s de Preenchimento no RTX 5080

Krasis é um runtime híbrido CPU/GPU que executa grandes modelos MoE processando o preenchimento na GPU e a decodificação na CPU, alcançando 3.324 tokens/segundo no preenchimento em uma RTX 5080 com Qwen3-Coder-Next 80B Q4. Ele requer aproximadamente 2,5x o tamanho do modelo em RAM do sistema, mas permite executar modelos grandes demais para a VRAM.

OpenClawRadar
ExposureGuard MCP Server Adiciona Varredura de Segurança de Domínio ao Claude Desktop
Tools

ExposureGuard MCP Server Adiciona Varredura de Segurança de Domínio ao Claude Desktop

Um desenvolvedor criou um servidor MCP para verificação de segurança de domínios usando o Claude Code, expondo quatro ferramentas que verificam SPF, DMARC, SSL, cabeçalhos de segurança, DNSSEC, portas abertas, MX e HTTPS. O servidor está disponível via pip install exposureguard-mcp com um plano gratuito de 100 chamadas de API por dia.

OpenClawRadar