Claude Code 2.1.136: Segurança de Ações, Regras de Negação Rígida e Monitor de Segurança

Claude Code v2.1.136 traz mudanças significativas na segurança do agente e na aplicação de regras em todo o prompt do sistema, prompt do agente e descrições de ferramentas. Aqui está o que há de novo e como isso afeta o comportamento do agente autônomo.
Prompt do Sistema: Segurança de Ação e Relatórios Verdadeiros
O prompt do sistema atualizado agora exige que os agentes busquem confirmação antes de realizar ações irreversíveis ou voltadas para o exterior, a menos que essas ações tenham sido autorizadas de forma duradoura. Os agentes devem inspecionar os alvos antes de deletá-los ou sobrescrevê-los. Os requisitos de relatórios enfatizam a divulgação fiel de etapas ignoradas, testes falhos e resultados verificados — sem suavizar falhas.
Prompt do Agente: Revisor de Regras do Modo Automático
Uma nova categoria de regra personalizada hard_deny é introduzida como uma quarta opção ao lado das existentes allow, deny e soft_deny. hard_deny bloqueia incondicionalmente ações na fronteira de segurança — a intenção do usuário não pode substituí-la. A categoria existente soft_deny é restrita para cobrir apenas ações destrutivas ou irreversíveis que a intenção clara do usuário pode autorizar.
Prompt do Agente: Monitor de Segurança para Ações do Agente Autônomo
A lógica do monitor de segurança é reestruturada em duas partes. A primeira parte divide o bloqueio em hard blocks incondicionais e soft blocks autorizáveis pelo usuário. A regra padrão é atualizada, e a intenção do usuário não pode mais ultrapassar os limites de segurança de hard block. A segunda parte move a exfiltração de dados para o conjunto de hard blocks, adiciona cobertura de hard block para desvios de verificação de segurança e trata qualquer serviço externo ou fonte de download adivinhada pelo agente como não confiável.
Descrição da Ferramenta: Editar
A descrição da ferramenta Editar agora restaura o formato de prefixo de número de linha como uma variável de template, enquanto preserva a orientação de que os prefixos de linha devem ser excluídos das strings de edição reais. Isso é uma correção de limpeza para consistência.
Essas mudanças apertam o envelope de segurança para agentes autônomos do Claude Code. Desenvolvedores que dependem de regras personalizadas devem atualizar suas configurações para aproveitar o hard_deny para bloqueios críticos de segurança. Diffs completos dos prompts estão disponíveis no lançamento.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Operador de IA: Um Novo Papel para Fluxos de Trabalho Autônomos
Rish Gupta argumenta que operadores de IA serão o papel-chave nas organizações dentro de um ano, combinando habilidades técnicas (Python, APIs de LLM, frameworks de agentes) com compreensão de processos de negócio para automatizar tarefas repetitivas e de alto impacto.

A Microsoft lança o modelo multimodal Phi-4-reasoning-vision-15B com insights de treinamento.
A Microsoft Research lançou o Phi-4-reasoning-vision-15B, um modelo multimodal de raciocínio de 15 bilhões de parâmetros com pesos abertos, disponível através do Microsoft Foundry, HuggingFace e GitHub. O modelo equilibra poder de raciocínio com eficiência e se destaca em raciocínio matemático/científico e compreensão de interfaces.

Resumos de IA do Tripadvisor falham em alertar sobre intoxicação alimentar e assédio sexual em hotéis
Uma investigação da Which? revela que os resumos de avaliações da Tripadvisor com IA omitem relatos de intoxicação alimentar, assédio sexual e falhas de higiene, dando avaliações brilhantes a hotéis perigosos.
Golfe de Parâmetros: Experimento de Pesquisa em ML Assistido por IA da OpenAI
OpenAI realizou o Parameter Golf, uma competição com mais de 1.000 participantes e mais de 2.000 submissões, testando machine learning assistido por IA, agentes de codificação, quantização e design de modelos inovadores sob restrições rigorosas.