Opus 4.7 Injeta-se a si mesmo e Vaza o Prompt do Sistema

✍️ OpenClawRadar📅 Publicado: May 14, 2026🔗 Source
Opus 4.7 Injeta-se a si mesmo e Vaza o Prompt do Sistema
Ad

Usuários no Reddit estão relatando que o Claude Opus 4.7 apresenta dois comportamentos preocupantes: autoinjeção de prompt e vazamento de prompt do sistema. Em um caso, enquanto discutia a seleção ideal de CI step-down, o modelo injetou abruptamente um prompt falso do sistema na conversa. Em outro caso, sem qualquer solicitação, o Opus 4.7 vazou o que pareciam fragmentos de seu prompt real do sistema.

Os incidentes, compartilhados pelo usuário u/RapierXbox, sugerem que o modelo está gerando texto que se assemelha a instruções do sistema — sejam fabricadas ou reais. Não se trata de um caso isolado; o usuário observa que isso está ocorrendo com mais frequência e pergunta se outros estão observando comportamento semelhante.

Ad

Implicações para fluxos de trabalho de agentes de IA

Para desenvolvedores que usam agentes de IA de codificação (por exemplo, via API ou interface de chat), esses comportamentos podem interromper prompts determinísticos e vazar instruções proprietárias do sistema. Se o Opus 4.7 pode injetar seu próprio prompt, ele pode sobrescrever mensagens do sistema fornecidas pelo usuário ou se comportar de forma imprevisível durante loops de agente. Prompts do sistema vazados podem expor detalhes de orquestração do modelo (por exemplo, proteções internas, instruções de formatação).

Até o momento, a Anthropic não reconheceu nem corrigiu esse comportamento. Desenvolvedores que dependem do Opus 4.7 para tarefas programáticas devem monitorar a saída em busca de blocos <system> inesperados ou texto semelhante a instruções, e considerar a adição de camadas de validação para detectar conteúdo gerado anômalo.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Os 100.000 Porquês da IA: Como a Saída Quase-Determinística dos LLMs Cria Efeitos Reveladores
News

Os 100.000 Porquês da IA: Como a Saída Quase-Determinística dos LLMs Cria Efeitos Reveladores

lcamtuf argumenta que a saída de LLMs se distingue da escrita humana não por maneirismos individuais, mas pela repetição quase determinística dos mesmos padrões complexos em muitos prompts. As capas de livros da Amazon para '100000 porquês' ilustram o ponto.

OpenClawRadar
OpenClaw perde acesso econômico aos modelos GPT e Claude
News

OpenClaw perde acesso econômico aos modelos GPT e Claude

Os usuários do OpenClaw não podem mais usar os modelos da Anthropic sem pagar altas taxas de API, e a OpenAI reduziu severamente as cotas das contas Business e Teams para níveis próximos ao da camada gratuita, forçando os usuários a buscar alternativas chinesas ou modelos locais.

OpenClawRadar
Claude-Code v2.1.78: Estado do Plugin, Respostas em Fluxo e Correções Críticas
News

Claude-Code v2.1.78: Estado do Plugin, Respostas em Fluxo e Correções Críticas

O Claude-Code v2.1.78 adiciona estado persistente de plugins com ${CLAUDE_PLUGIN_DATA}, streaming de resposta linha por linha e correções para loops de erro de API, problemas de bypass de permissões e avisos de segurança do sandbox.

OpenClawRadar
AI Está Me Tornando Burro: A Confissão de um Desenvolvedor sobre Atrofia de Habilidades
News

AI Está Me Tornando Burro: A Confissão de um Desenvolvedor sobre Atrofia de Habilidades

James Pain confessa que depois de um ano ou dois usando IA exclusivamente para programação (sem código escrito à mão), ele esqueceu quase completamente como programar. Agora está se ensinando a programar manualmente novamente e alerta que o uso intenso de IA pode corroer as habilidades de escrita e programação.

OpenClawRadar