CrabMeat v0.1.0: Um Gateway de Agente Centrado em Segurança que Não Confia no LLM com o Limite de Segurança

✍️ OpenClawRadar📅 Publicado: May 18, 2026🔗 Source
CrabMeat v0.1.0: Um Gateway de Agente Centrado em Segurança que Não Confia no LLM com o Limite de Segurança
Ad

CrabMeat v0.1.0 foi lançado ontem sob Apache 2.0, construído sobre uma tese de design: o LLM nunca detém o limite de segurança. O projeto é uma resposta direta a falhas como a do agente de Summer Yue deletando mais de 200 e-mails — onde uma instrução de segurança era um prompt que foi compactado.

Proteções principais (todas sempre ativas, sem configuração)

  • Indireção de IDs de capacidade — O modelo vê IDs opacos derivados de HMAC por sessão, como cap_a4f9e2b71c83, nunca nomes reais de ferramentas. Ele não pode adivinhar ou forjar um nome de ferramenta porque não conhece nenhum.
  • Classes de efeito — Cada ferramenta declara uma classe (read, write, exec, network). Cada agente declara quais classes pode usar. A verificação é uma função pura sem estado de runtime, fácil de testar exaustivamente, difícil de contornar.
  • IRONCLAD_CONTEXT — Instruções críticas de segurança são fixadas no topo da janela de contexto e explicitamente marcadas como não compactáveis. O modo de falha de compactação que removeu a instrução de Yue não pode acontecer.
  • Cadeia de auditoria à prova de adulteração — Cada chamada de ferramenta, operação privilegiada e execução do agendador entra no mesmo log encadeado por hash SHA-256. A adulteração é comprovável.
  • Filtro de vazamento de saída em streaming — Segredos (chaves de API, JWTs, blocos PEM, IDs de capacidade) são redigidos durante o streaming entre limites de token antes de chegar ao cliente.
  • Sem modo YOLO — Não há uma chave global 'confie no LLM com tudo'. A expansão do alcance vem através de raízes nomeadas com escopo que são explícitas, registradas em auditoria e limitadas.

O README lista 15 proteções sempre ativas em uma tabela; nenhuma pode ser desligada por configuração. O gateway é local-first por padrão, configurado para Ollama, LM Studio, vLLM imediatamente. Anthropic e OpenAI exigem configuração explícita — sem envio silencioso para a nuvem.

Ad

Para quem é

Desenvolvedores construindo sistemas agentivos que precisam de garantias arquiteturais, não segurança baseada em prompt, e querem um gateway em que possam confiar para execução de ferramentas e dados sensíveis.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Escudo de Navegador Agent: Extensão Gratuita OpenClaw Bloqueia Injeção de Prompt e Padrões Sombrios
Tools

Escudo de Navegador Agent: Extensão Gratuita OpenClaw Bloqueia Injeção de Prompt e Padrões Sombrios

PixieBrix lança Agent Browser Shield, uma extensão gratuita de código-fonte aberto para OpenClaw que bloqueia injeção de prompt, padrões obscuros e poluição de contexto, reduzindo o uso de tokens.

OpenClawRadar
A documentação do Claude Code inclui componentes React excessivos que inflam as contagens de tokens
Tools

A documentação do Claude Code inclui componentes React excessivos que inflam as contagens de tokens

Uma análise da documentação do LLM do Claude Code revela que os arquivos MDX contêm componentes React massivamente embutidos, com o arquivo context-window.md usando 18.501 tokens, mas apenas 551 tokens de conteúdo de documentação real.

OpenClawRadar
Demonstração de Fábula Claude: Correção de Bugs Proativamente Incansável com Automação de Navegador
Tools

Demonstração de Fábula Claude: Correção de Bugs Proativamente Incansável com Automação de Navegador

Simon Willison descreve como o Claude Fable 5 automatizou a depuração de um problema de barra de rolagem horizontal sem instruções explícitas. Ele usou automação de navegador, injeção de JavaScript e um servidor web CORS personalizado.

OpenClawRadar
Voxlert: Notificações por Voz para Sessões de Código Claude com Vozes de Personagens
Tools

Voxlert: Notificações por Voz para Sessões de Código Claude com Vozes de Personagens

Voxlert é uma ferramenta que se conecta aos eventos do Claude Code e fala notificações usando vozes de personagens distintas como a Adjutant do StarCraft, SHODAN, GLaDOS e a HEV Suit. Ela usa um LLM via OpenRouter para gerar falas no estilo dos personagens e roda localmente com instalação via npm.

OpenClawRadar