Modo Contexto: Um Servidor MCP que Comprime Saídas de Ferramentas para Claude Code

O que o Context Mode Faz
O Context Mode aborda o problema em que cada chamada de ferramenta MCP no Claude Code despeja dados brutos na janela de contexto de 200K. Exemplos da fonte mostram que um snapshot do Playwright custa 56 KB, vinte issues do GitHub custam 59 KB, e um log de acesso custa 45 KB. Após 30 minutos, 40% do seu contexto pode ter sido consumido.
O servidor MCP fica entre o Claude Code e essas saídas, processando-as em sandboxes para que apenas resumos alcancem o modelo. Ele alcança uma redução de 98% no uso do contexto (315 KB se torna 5,4 KB).
Instalação e Configuração
Instalação com um único comando:
/plugin marketplace add mksglu/claude-context-mode
/plugin install context-mode@claude-context-modeOu via CLI:
claude mcp add context-mode -- npx -y context-modeA instalação inclui uma habilidade de roteamento automático que roteia automaticamente grandes saídas através do Context Mode, além de um hook PreToolUse que injeta roteamento de context-mode em prompts de subagentes. Nenhum prompt é necessário.
Ferramentas Disponíveis
batch_execute: Execute múltiplos comandos + pesquise múltiplas consultas em UMA chamada (986 KB → 62 KB)execute: Execute código em 10 linguagens. Apenas stdout entra no contexto (56 KB → 299 B)execute_file: Processe arquivos em sandbox. O conteúdo bruto nunca sai (45 KB → 155 B)index: Divida markdown em FTS5 com classificação BM25 (60 KB → 40 B)search: Consulte conteúdo indexado com múltiplas consultas em uma chamada (recuperação sob demanda)fetch_and_index: Busque URL, converta para markdown, indexe (60 KB → 40 B)stats: Rastreamento de tokens da sessão com detalhamento por ferramenta
Implementação Técnica
Cada chamada execute gera um subprocesso isolado com seu próprio limite de processo. Scripts não podem acessar a memória ou estado um do outro. O subprocesso executa seu código, captura stdout, e apenas esse stdout entra no contexto da conversação. Os dados brutos — arquivos de log, respostas de API, snapshots — nunca saem da sandbox.
Dez ambientes de execução de linguagem estão disponíveis: JavaScript, TypeScript, Python, Shell, Ruby, Go, Rust, PHP, Perl, R. Bun é detectado automaticamente para execução 3-5x mais rápida de JS/TS.
CLIs autenticados funcionam através de passagem de credenciais — gh, aws, gcloud, kubectl, docker herdam variáveis de ambiente e caminhos de configuração sem expô-los à conversação.
Quando a saída excede 5 KB e uma intenção é fornecida, o Context Mode muda para filtragem baseada em intenção: ele indexa a saída completa na base de conhecimento, pesquisa por seções correspondentes à sua intenção, e retorna apenas as correspondências relevantes com um vocabulário de termos pesquisáveis para consultas de acompanhamento.
A base de conhecimento usa tabelas virtuais SQLite FTS5 (Full-Text Search 5). A ferramenta index divide o conteúdo markdown por cabeçalhos mantendo blocos de código intactos, então os armazena. A pesquisa usa classificação BM25 — um algoritmo de relevância probabilística que pontua documentos com base na frequência do termo, frequência inversa do documento e comprimento do documento.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Slides-grab: Editor Visual para Corrigir Slides HTML Gerados pelo Claude Code
Slides-grab é uma ferramenta que permite arrastar elementos em slides HTML/CSS gerados pelo Claude Code, então envia o XPath e uma captura de tela destacada para o agente de IA para edição precisa. Ela aborda a dificuldade de corrigir pequenos problemas de layout apenas com prompts de texto.
Cue AI usa Gemma 4 para ditado de voz mais rápido: queda de 44% na latência, 30% mais uso
A Cue AI substituiu uma etapa de refinamento de texto baseada em nuvem pelo Gemma 4 E4B do Google DeepMind executado localmente via Ollama, reduzindo a latência mediana de 876ms para 488ms e aumentando o uso de ditado em 30%.

Alternativa do OpenClaw Browser Relay Chrome Extension para Configurações Manuais
Um usuário do Reddit relata sucesso com uma extensão do Chrome para o relé de navegador OpenClaw após tentativas de configuração manual causarem travamentos do sistema e dores de cabeça na depuração.

Controle iPhones reais a partir de agentes OpenClaw — Mão na massa com a configuração de AvaBerry43
Um desenvolvedor criou uma configuração de iPhones controlados por API para agentes de IA, testando funcionalidades como rascunho de iMessages, Atalhos e QA móvel. 70 iPhones estão disponíveis para outros experimentarem.