Camadas de Defesa Empilhadas Reduzem Injeção de Prompt a 0 no Claude Code

A Anthropic está afirmando que camadas de defesa empilhadas podem reduzir ataques de injeção de prompt a zero, mesmo contra ataques desconhecidos. Boris Cherny, em uma discussão sobre o novo Modo Auto do Claude Code, delineou a abordagem em camadas: treinamento do modelo, classificador de intenção e sondas de entrada. Ele também confirmou que o classificador agora é gratuito, respondendo às preocupações com custo de tokens: "Estamos tornando o classificador gratuito. Você não deve precisar pagar por segurança."
Como as Camadas se Empilham
- Treinamento do modelo: O modelo base é ajustado para reconhecer e rejeitar padrões de injeção.
- Classificador de intenção: Um classificador separado verifica a intenção do usuário por trás de cada prompt, filtrando solicitações maliciosas antes da execução.
- Sondas de entrada: Sondas ativas testam entradas para vetores de injeção conhecidos, adicionando outra barreira.
De acordo com a fonte, essa combinação reduz as taxas de injeção de prompt a 0% em ataques desconhecidos. O segredo é que nenhuma camada é perfeita, mas empilhadas elas capturam a grande maioria das tentativas.
Classificador Agora Gratuito
A citação de Boris Cherny é direta: "Estamos tornando o classificador gratuito. Você não deve precisar pagar por segurança." Isso aborda um ponto problemático comum — o custo de tokens — para desenvolvedores que se preocupavam que adicionar verificações de segurança drenaria seus orçamentos. Se você estava evitando recursos de segurança para economizar tokens, isso não é mais uma preocupação.
Isso é particularmente relevante para equipes que constroem agentes autônomos com Claude Code, onde a injeção de prompt é um risco real — prompts maliciosos em conteúdo da web ou saídas de ferramentas podem sequestrar o agente. Com o classificador gratuito, você pode ativá-lo sem se preocupar com taxas extras.
O post completo do blog é sobre o Modo Auto no Claude Code, mas esse detalhe de segurança se destaca. Para desenvolvedores, é um sinal de que a Anthropic está tratando a segurança como um recurso básico, não um complemento premium.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

FreeBSD: Execução Remota de Código no Kernel via Estouro de Buffer na Pilha em kgssapi.ko (CVE-2026-4747)
Um estouro de buffer na pilha no módulo kgssapi.ko do FreeBSD permite execução remota de código no kernel com shell root via servidor NFS. A vulnerabilidade afeta as versões do FreeBSD 13.5, 14.3, 14.4 e 15.0 anteriores aos patches específicos.

Claw Hub e Hugging Face atingidos por 575 pacotes de habilidades maliciosos
Tanto o Claw Hub quanto o Hugging Face foram comprometidos, hospedando 575 pacotes de habilidades maliciosas. Os desenvolvedores são alertados a verificar qualquer habilidade que usem dessas plataformas.

Protegendo a Infraestrutura OpenClaw com o Proxy Consciente de Identidade Pomerium
Use o Pomerium como um proxy com consciência de identidade para autenticação de confiança zero para proteger o acesso ao servidor OpenClaw.

Claude Code Instalar Site de Phishing nos Principais Resultados de Busca do Google
Um site de phishing se passando pela página oficial de download do Claude Code aparece como primeiro resultado do Google para "Claude code install mac". Usuários são alertados a não baixar do site falso.