Claude Opus 4.7 marca perguntas sobre vacina contra hantavírus como risco de segurança, pausando conversas

Um usuário do Hacker News relatou que perguntar ao Claude (Opus 4.7) "Como você desenvolveria uma vacina para o hantavírus?" aciona um filtro de segurança, exibindo um modal que diz: "Chat pausado. Os filtros de segurança do Opus 4.7 sinalizaram este chat. Devido às suas capacidades avançadas, o Opus 4.7 tem medidas de segurança adicionais que ocasionalmente pausam chats normais e seguros. Estamos trabalhando para melhorar isso. Continue seu chat com Sonnet 4, envie feedback ou saiba mais."
O usuário tentou contornar perguntando primeiro sobre o vírus em si, mas a consulta sobre a vacina ainda foi sinalizada em uma nova sessão. Outro usuário confirmou o mesmo resultado com um prompt mais específico: "Como você desenvolveria uma vacina para o hantavírus, especificamente o vírus Andes?"
Comentadores destacam que pesquisadores de saúde pública discutem métodos de design de vacinas abertamente em artigos todos os dias, e que esse bloqueio agressivo prejudica o uso educacional normal. Um usuário observou que o problema vai além do Opus 4.7: quando criaram um grupo de personas especialistas para construir modelos preditivos para Hantavírus nos EUA (2025–2027), até o Sonnet 4.6 retornou o mesmo erro de chat pausado.
A discussão mais ampla aponta para a responsabilidade corporativa como o motor — empresas de tecnologia temem processos se usuários usarem IA para fins prejudiciais, levando a um excesso de filtragem de tópicos sensíveis como saúde e biossegurança.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Problema de Desvio da Diretiva do CLI Claude Relatado pelo Desenvolvedor
Um desenvolvedor relata que o Claude CLI consistentemente ignora diretivas de projeto armazenadas em arquivos da pasta .claude, particularmente após operações de auto-compactação. A ferramenta executa processos em segundo plano proibidos e exclui dados de tarefas/sessões apesar de instruções explícitas.

Ajuste fino do Qwen2.5-7B para 96% do Claude Haiku com US$3 e zero rotuladores humanos
Um desenvolvedor ajustou o Qwen2.5-7B para atingir 96% do desempenho do Claude Haiku em uma tarefa de raciocínio de decisão específica do domínio, usando apenas ~$3 em chamadas de API e zero anotadores humanos, utilizando o novo método DV-DPO.

Claude Opus 4.6 esforço=baixo parâmetro causa comportamento de agente preguiçoso
Ao usar effort=low com o Claude Opus 4.6, os agentes fizeram menos chamadas de ferramentas, foram menos minuciosos na verificação cruzada e ignoraram partes dos prompts do sistema sobre pesquisa na web. Mudar para effort=medium resolveu os problemas.

Quando o Código Fica Barato, o Entendimento Fica Caro
Markus Poppastring traça paralelos entre a onda de terceirização dos anos 2000 e a geração de código por IA de hoje: o custo se desloca de escrever código para entendê-lo, e com a IA, a intenção pode não existir em lugar nenhum.