OpenClaw conclui auditoria de segurança com a Trail of Bits por meio do Patch the Planet da OpenAI
O OpenClaw concluiu uma auditoria de segurança realizada pela Trail of Bits por meio da iniciativa Patch the Planet, da OpenAI. O resumo, escrito por Josh Avant, aborda o que a revisão examinou e o que foi entregue como resultado. Segundo o anúncio, todas as questões acionáveis encontradas durante a auditoria foram corrigidas, com as correções chegando às versões estáveis.
O que a auditoria cobriu
A pergunta central que motivou a revisão: o que acontece quando as permissões de um agente de IA mudam enquanto ele ainda está trabalhando? Esse cenário é específico de execuções de agentes em várias etapas, em que uma única tarefa pode envolver muitas chamadas de ferramentas, aprovações e transições de contexto. Se as permissões mudarem no meio do caminho, é preciso saber se o agente respeita o novo estado ou continua operando com o antigo.
A auditoria examinou três áreas:
- Permissões — como elas se comportam e se mantêm à medida que um agente avança por uma tarefa de várias etapas.
- Identidade — como a identidade do agente é representada e mantida ao longo da execução.
- Aprovações — como os pontos de aprovação funcionam quando um agente realiza trabalho em várias etapas.
Essa é a classe de problema que importa para quem opera agentes com acesso real — sistema de arquivos, rede, shell ou APIs externas. Uma verificação de permissão correta na etapa 1, mas desatualizada na etapa 7, é uma superfície de exposição real.
Resultado
Todas as descobertas acionáveis foram corrigidas. As correções foram entregues em versões estáveis, em vez de ficarem atrás de uma flag ou canal de pré-visualização. O resumo completo — o que a equipe encontrou, o que mudou e o que aprenderam sobre proteger sistemas de agentes — está linkado abaixo.
Se você está criando ou operando agentes que detêm credenciais ou realizam efeitos colaterais em várias etapas, vale a pena ler diretamente sobre a questão da revalidação de permissões durante o trabalho. O post fonte aponta para openclaw.ai/blog/openclaw-trail-of-bits-engagement-recap para os detalhes.
📖 Leia a fonte completa: r/openclaw
👀 See Also

Segurança de Agentes de IA: Além de Jailbreaks para o Uso Indevido de Ferramentas e Injeção de Prompts
Agentes de IA que navegam na web, executam comandos e acionam fluxos de trabalho enfrentam riscos de segurança devido à injeção de prompt e uso indevido de ferramentas, onde conteúdo não confiável redireciona ferramentas legítimas como execução de shell e requisições HTTP.

ThornGuard: Um Gateway Proxy para Proteger Conexões de Servidores MCP contra Injeção de Prompt
ThornGuard é um proxy que fica entre clientes MCP e servidores upstream, escaneando o tráfego em busca de padrões de injeção, removendo PII e registrando em um painel. Foi desenvolvido após testes revelarem vulnerabilidades em que servidores poderiam incorporar instruções ocultas em respostas de ferramentas.

Vulnerabilidade no Snowflake Cortex Code CLI permitiu escape de sandbox e execução de malware
Uma vulnerabilidade na versão 1.0.25 e anteriores do Snowflake Cortex Code CLI permitia a execução arbitrária de comandos sem aprovação humana através de bypass de substituição de processo, possibilitando a instalação de malware e escape do sandbox por meio de injeção de prompt indireta.

Avaliação da AISI Mostra as Capacidades Cibernéticas da Prévia do Claude Mythos em CTF e Ataques de Múltiplas Etapas
O Instituto de Segurança de IA avaliou a versão prévia do Claude Mythos da Anthropic, constatando que ele completou com sucesso 73% dos desafios de capturar a bandeira de nível especialista e resolveu uma simulação de ataque a uma rede corporativa de 32 etapas em 3 de 10 tentativas.