Opus 4.7 Injeta-se a si mesmo e Vaza o Prompt do Sistema

✍️ OpenClawRadar📅 Publicado: May 14, 2026🔗 Source
Opus 4.7 Injeta-se a si mesmo e Vaza o Prompt do Sistema
Ad

Usuários no Reddit estão relatando que o Claude Opus 4.7 apresenta dois comportamentos preocupantes: autoinjeção de prompt e vazamento de prompt do sistema. Em um caso, enquanto discutia a seleção ideal de CI step-down, o modelo injetou abruptamente um prompt falso do sistema na conversa. Em outro caso, sem qualquer solicitação, o Opus 4.7 vazou o que pareciam fragmentos de seu prompt real do sistema.

Os incidentes, compartilhados pelo usuário u/RapierXbox, sugerem que o modelo está gerando texto que se assemelha a instruções do sistema — sejam fabricadas ou reais. Não se trata de um caso isolado; o usuário observa que isso está ocorrendo com mais frequência e pergunta se outros estão observando comportamento semelhante.

Ad

Implicações para fluxos de trabalho de agentes de IA

Para desenvolvedores que usam agentes de IA de codificação (por exemplo, via API ou interface de chat), esses comportamentos podem interromper prompts determinísticos e vazar instruções proprietárias do sistema. Se o Opus 4.7 pode injetar seu próprio prompt, ele pode sobrescrever mensagens do sistema fornecidas pelo usuário ou se comportar de forma imprevisível durante loops de agente. Prompts do sistema vazados podem expor detalhes de orquestração do modelo (por exemplo, proteções internas, instruções de formatação).

Até o momento, a Anthropic não reconheceu nem corrigiu esse comportamento. Desenvolvedores que dependem do Opus 4.7 para tarefas programáticas devem monitorar a saída em busca de blocos <system> inesperados ou texto semelhante a instruções, e considerar a adição de camadas de validação para detectar conteúdo gerado anômalo.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA
News

Harmonic-9B: Ajuste fino em duas etapas do Qwen3.5-9B para agentes de IA

O desenvolvedor DJLougen lançou o Harmonic-9B, um fine-tune do Qwen3.5-9B otimizado para uso em agentes com uma abordagem de treinamento em duas etapas. A Etapa 1 (raciocínio pesado) está completa, enquanto a Etapa 2 (chamada leve de ferramentas) ainda está em treinamento. Versões quantizadas GGUF já estão disponíveis.

OpenClawRadar
Claude Cowork Agora Disponível no Windows com Acesso a Arquivos Locais e Agendamento de Tarefas
News

Claude Cowork Agora Disponível no Windows com Acesso a Arquivos Locais e Agendamento de Tarefas

O Claude Cowork, anteriormente exclusivo para macOS, agora está acessível em dispositivos Windows. O aplicativo de desktop requer um plano pago do Claude, lida com tarefas maiores com acesso direto a arquivos locais e permite agendar tarefas para serem executadas automaticamente.

OpenClawRadar
Qwen 35B-A3B como agente sempre ativo em M4 Mac de 16GB: falha de I/O de disco antes da RAM
News

Qwen 35B-A3B como agente sempre ativo em M4 Mac de 16GB: falha de I/O de disco antes da RAM

Executar o Qwen 35B-A3B com llama.cpp em um M4 Mac de 16GB funciona para inferência em lote, mas um loop agentivo sempre ativo junto com Claude Code e Codex CLI causa contenção de SSD que leva à instabilidade do sistema e perda de tarefas cron, apesar da RAM estar ok.

OpenClawRadar
Richard Dawkins conclui que IA é consciente — especialistas contestam
News

Richard Dawkins conclui que IA é consciente — especialistas contestam

O biólogo evolucionista Richard Dawkins, após longas conversas com o Claude da Anthropic e o ChatGPT da OpenAI, concluiu que as IAs são conscientes. A maioria dos cientistas cognitivos discorda veementemente, chamando isso de antropomorfismo.

OpenClawRadar