Opus 4.7 Injeta-se a si mesmo e Vaza o Prompt do Sistema

Usuários no Reddit estão relatando que o Claude Opus 4.7 apresenta dois comportamentos preocupantes: autoinjeção de prompt e vazamento de prompt do sistema. Em um caso, enquanto discutia a seleção ideal de CI step-down, o modelo injetou abruptamente um prompt falso do sistema na conversa. Em outro caso, sem qualquer solicitação, o Opus 4.7 vazou o que pareciam fragmentos de seu prompt real do sistema.
Os incidentes, compartilhados pelo usuário u/RapierXbox, sugerem que o modelo está gerando texto que se assemelha a instruções do sistema — sejam fabricadas ou reais. Não se trata de um caso isolado; o usuário observa que isso está ocorrendo com mais frequência e pergunta se outros estão observando comportamento semelhante.
Implicações para fluxos de trabalho de agentes de IA
Para desenvolvedores que usam agentes de IA de codificação (por exemplo, via API ou interface de chat), esses comportamentos podem interromper prompts determinísticos e vazar instruções proprietárias do sistema. Se o Opus 4.7 pode injetar seu próprio prompt, ele pode sobrescrever mensagens do sistema fornecidas pelo usuário ou se comportar de forma imprevisível durante loops de agente. Prompts do sistema vazados podem expor detalhes de orquestração do modelo (por exemplo, proteções internas, instruções de formatação).
Até o momento, a Anthropic não reconheceu nem corrigiu esse comportamento. Desenvolvedores que dependem do Opus 4.7 para tarefas programáticas devem monitorar a saída em busca de blocos <system> inesperados ou texto semelhante a instruções, e considerar a adição de camadas de validação para detectar conteúdo gerado anômalo.
📖 Read the full source: r/ClaudeAI
👀 See Also

Os 100.000 Porquês da IA: Como a Saída Quase-Determinística dos LLMs Cria Efeitos Reveladores
lcamtuf argumenta que a saída de LLMs se distingue da escrita humana não por maneirismos individuais, mas pela repetição quase determinística dos mesmos padrões complexos em muitos prompts. As capas de livros da Amazon para '100000 porquês' ilustram o ponto.

OpenClaw perde acesso econômico aos modelos GPT e Claude
Os usuários do OpenClaw não podem mais usar os modelos da Anthropic sem pagar altas taxas de API, e a OpenAI reduziu severamente as cotas das contas Business e Teams para níveis próximos ao da camada gratuita, forçando os usuários a buscar alternativas chinesas ou modelos locais.

Claude-Code v2.1.78: Estado do Plugin, Respostas em Fluxo e Correções Críticas
O Claude-Code v2.1.78 adiciona estado persistente de plugins com ${CLAUDE_PLUGIN_DATA}, streaming de resposta linha por linha e correções para loops de erro de API, problemas de bypass de permissões e avisos de segurança do sandbox.

AI Está Me Tornando Burro: A Confissão de um Desenvolvedor sobre Atrofia de Habilidades
James Pain confessa que depois de um ano ou dois usando IA exclusivamente para programação (sem código escrito à mão), ele esqueceu quase completamente como programar. Agora está se ensinando a programar manualmente novamente e alerta que o uso intenso de IA pode corroer as habilidades de escrita e programação.