Modo de Contexto do Servidor MCP Reduz Uso de Contexto de Código do Claude em 98%

Context Mode é um servidor MCP que fica entre o Claude Code e as saídas das ferramentas, reduzindo o consumo da janela de contexto em 98%. Em vez de despejar dados brutos na janela de contexto de 200K, ele processa as saídas em ambientes isolados.
Como Funciona
O sistema de ambiente isolado cria subprocessos isolados para cada chamada de execução. Os scripts são executados nesses subprocessos com seus próprios limites de processo, e apenas a saída padrão entra no contexto da conversa. Dados brutos como arquivos de log, respostas de API e instantâneos nunca saem do ambiente isolado.
Dez ambientes de execução de linguagens estão disponíveis: JavaScript, TypeScript, Python, Shell, Ruby, Go, Rust, PHP, Perl e R. Bun é detectado automaticamente para execução de JS/TS 3-5x mais rápida. CLIs autenticados (gh, aws, gcloud, kubectl, docker) funcionam através da passagem de credenciais, onde os subprocessos herdam variáveis de ambiente e caminhos de configuração sem expô-los à conversa.
Recursos da Base de Conhecimento
A ferramenta de indexação divide o conteúdo markdown por títulos mantendo os blocos de código intactos, depois os armazena em uma tabela virtual SQLite FTS5. A busca usa classificação BM25 com stemming Porter aplicado no momento da indexação. Quando você chama a busca, ela retorna blocos de código exatos com sua hierarquia de títulos.
A ferramenta fetch_and_index estende isso para URLs: busca, converte HTML para markdown, divide e indexa. A página bruta nunca entra no contexto.
Benchmarks de Desempenho
- Instantâneo do Playwright: 56 KB → 299 B
- Problemas do GitHub (20): 59 KB → 1,1 KB
- Log de acesso (500 requisições): 45 KB → 155 B
- CSV de análise (500 linhas): 85 KB → 222 B
- Log do Git (153 commits): 11,6 KB → 107 B
- Pesquisa de repositório (subagente): 986 KB → 62 KB (5 chamadas vs 37)
Em uma sessão completa: 315 KB de saída bruta se tornam 5,4 KB. O tempo da sessão antes da desaceleração vai de ~30 minutos para ~3 horas. Contexto restante após 45 minutos: 99% em vez de 60%.
Instalação
Dois métodos de instalação:
- Mercado de Plugins:
/plugin marketplace add mksglu/claude-context-modedepois/plugin install context-mode@claude-context-mode - Apenas MCP:
claude mcp add context-mode -- npx -y context-mode
Após a instalação, reinicie o Claude Code. Context Mode inclui um hook PreToolUse que roteia automaticamente as saídas das ferramentas através do ambiente isolado. Subagentes aprendem a usar batch_execute como sua ferramenta principal, e subagentes bash são atualizados para propósito geral para que possam acessar ferramentas MCP.
A ferramenta é de código aberto sob licença MIT em github.com/mksglu/claude-context-mode.
📖 Leia a fonte completa: HN LLM Tools
👀 See Also

Lumia: Sistema de Companheiro de IA Local com Memória Persistente em Um Clique
Lumia é um sistema modular que roda localmente usando Ollama e modelos locais para criar companheiros de IA persistentes com memória episódica, memória emocional, crenças, desejos, identidade, modelagem de relacionamentos e ciclos de reflexão.

Painel Grafana Open Source para Rastrear Custos e Uso do Claude Code com OpenTelemetry
Um SRE desenvolveu um painel Grafana gratuito para visualizar gastos do Claude Code, uso de tokens, taxas de acerto de cache e decisões de edição, extraindo métricas OpenTelemetry para backends compatíveis com Prometheus.

Método de Evolução de Código Triplica o Desempenho do LLM no Benchmark ARC-AGI-2
Pesquisadores alcançaram uma melhoria de 2,8x no benchmark ARC-AGI-2 usando evolução de código com modelos de pesos abertos, atingindo 34% de precisão a US$ 2,67 por tarefa. O mesmo método elevou o Gemini 3.1 Pro para 95% de precisão a US$ 8,71 por tarefa.

Sistema ACO: Pipeline de IA Multiagente do Issue do GitHub ao PR Mesclado
ACO System é um framework open-source multiagente onde seis agentes de IA especializados executam autonomamente todo o pipeline de desenvolvimento, desde a Issue do GitHub até o PR mesclado, com um portão determinístico Arquiteto que rejeita histórias ruins antes que cheguem aos desenvolvedores.