KnightClaw: Extensão de Segurança Local para Agentes OpenClaw

✍️ OpenClawRadar📅 Publicado: February 23, 2026🔗 Source
KnightClaw: Extensão de Segurança Local para Agentes OpenClaw
Ad

KnightClaw é uma extensão de segurança projetada para proteger os agentes de codificação OpenClaw AI contra prompts adversariais. A ferramenta aborda um modelo de ameaça específico onde uma única mensagem maliciosa na janela de contexto pode fazer com que um agente siga instruções do atacante em vez dos comandos do usuário.

Funcionalidades Principais

O KnightClaw opera como uma extensão plug-and-play sem necessidade de configuração, sem chaves de API e sem dependência de nuvem. Ele intercepta cada mensagem antes que ela chegue ao agente.

Sistema de Detecção

O guardião utiliza uma abordagem de detecção híbrida de 8 camadas:

  • Padrões de regex
  • Detecção de homóglifos
  • Análise de tokens de limite
  • Pontuação de perplexidade
  • Análise de entropia
  • Heurísticas
  • Incorporamentos semânticos (usando um modelo BGE quantizado local)

Os bloqueios ocorrem em microssegundos.

Ad

Medidas de Segurança Adicionais

  • Redação de saída: Remove segredos das respostas de saída antes que elas deixem o agente
  • Logs de auditoria encadeados por hash: Logs à prova de adulteração, somente para acréscimo, com linha do tempo completa de cada bloqueio, permissão e alteração de configuração
  • Disjuntor de velocidade: 10 bloqueios em 60 segundos acionam bloqueio automático sem intervenção manual
  • Interruptor de emergência: Um comando para tudo: openclaw knight lockdown on

Detalhes Técnicos

A extensão roda completamente localmente, sem telemetria, e é licenciada sob MIT. O código-fonte está disponível para teste e contribuição.

📖 Leia o código-fonte completo: r/openclaw

Ad

👀 See Also

Apps Construídos por IA São Frágeis: Por Que Pequenas Mudanças Quebram o Isolamento de Dados e Permissões
Security

Apps Construídos por IA São Frágeis: Por Que Pequenas Mudanças Quebram o Isolamento de Dados e Permissões

Desenvolvedores relatam que aplicativos gerados por IA (via Claude Code, Cursor) quebram silenciosamente login, permissões e isolamento de dados quando pequenas alterações são feitas, porque os modelos de IA não compreendem a intenção original do sistema, como regras de propriedade.

OpenClawRadar
arifOS: Um Kernel de Governança MCP de US$ 15 para Segurança da Ferramenta OpenClaw
Security

arifOS: Um Kernel de Governança MCP de US$ 15 para Segurança da Ferramenta OpenClaw

arifOS é um servidor MCP leve que intercepta chamadas de ferramentas OpenClaw, pontua-as de 000 a 999 e bloqueia ações inseguras com 13 pisos de segurança rígidos antes que alcancem sistemas de arquivos, APIs ou bancos de dados.

OpenClawRadar
OpenClaw Corrige Escalação Crítica de Privilégios no Caminho /pair Approve
Security

OpenClaw Corrige Escalação Crítica de Privilégios no Caminho /pair Approve

OpenClaw 2026.3.28 corrige uma vulnerabilidade crítica de segurança (GHSA-hc5h-pmr3-3497) onde o comando /pair approve permitia que usuários com privilégios de emparelhamento aprovassem solicitações de dispositivos para escopos mais amplos, incluindo acesso de administrador. As versões afetadas são <= 2026.3.24.

OpenClawRadar
🦀
Security

O falso think tank de Israel ataca chatbots de IA com envenenamento de SEO

Israel criou um think tank falso, o Instituto Hanover, publicando mais de 100 artigos otimizados por IA para influenciar chatbots como Claude e Gemini. Os artigos imitam relatórios de think tanks confiáveis com citações, provavelmente para moldar as respostas da IA sobre o conflito Israel-Palestina.

OpenClawRadar