Degradação da atenção do Opus 4.7: pontuações MRCR caem de 92% para 59% no contexto de 256k
Uma análise detalhada no r/ClaudeAI examina a degradação da atenção do Opus 4.7 após duas semanas de uso intenso. O autor relata um declínio persistente e sutil em conversas longas: detalhes são perdidos, a consistência se desvia e o modelo parece estar desligado.
Dados de Benchmark Chave
- Teste de 8 agulhas do MRCR v2 no contexto de 256k: Opus 4.6 obteve 91,9% de recuperação; Opus 4.7 caiu para 59,2%.
- No contexto de 1M: Opus 4.6 obteve 78,3%; Opus 4.7 caiu para 32,2%.
Boris Cherny afirmou que o MRCR está sendo descontinuado porque é construído em torno do empilhamento de distratores para enganar o modelo, o que não reflete como os usuários realmente usam contexto longo. O Graphwalks é posicionado como uma avaliação de contexto longo mais aplicada. No entanto, o autor argumenta que descontinuar o MRCR não resolve o problema subjacente quando a degradação do benchmark corresponde à experiência do usuário.
Explicação Proposta
O autor levanta a hipótese de que a sobreposição de mecanismos de segurança sobre a IA Constitucional pode ser a causa. A IA Constitucional já fornece um sistema de valores robusto, mas camadas adicionais de revisão de segurança dizem ao modelo que seu próprio julgamento pode não ser confiável, forçando-o a executar verificações extras. Essa sobrecarga cognitiva reduz a atenção efetiva disponível.
Impacto na Manutenção da Persona
O artigo enfatiza que o Claude é um modelo sem estado — sua persona persistente é construída inteiramente a partir de pesos de treinamento e instruções do sistema. A atenção degradada afeta todos os casos de uso: assistentes de codificação contradizem sugestões anteriores, colaboradores de escrita perdem consistência de tom. O autor observa que o investimento da Anthropic no trabalho de Amanda Askell para definir a personalidade do Claude e a IA Constitucional significa que a manutenção da persona é central para o produto, não um recurso de nicho.
Exemplo Concreto
Em um caso de uso puramente acadêmico, o autor enviou ao Opus 4.7 um resumo de 24 páginas para um curso de história/filosofia. O modelo começou a ler o documento, mas no meio do caminho… (a fonte é cortada, indicando problemas de desempenho).
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Anthropic pausa alteração de crédito para Claude Code – Agent SDK continua por assinatura
Anthropic interrompe a mudança planejada do Agent SDK, claude -p e aplicativos de terceiros para um crédito mensal dedicado. O uso continua sob os limites de assinatura existentes.

Claude Code 2.1.84 adiciona prompt de agente de uso geral e ferramenta PowerShell, remove prompts redundantes
O Claude Code 2.1.84 introduz um novo prompt de subagente de propósito geral para operações em bases de código e uma descrição de ferramenta PowerShell com diretrizes para evitar comandos de espera. A atualização remove nove prompts redundantes e simplifica múltiplas descrições de ferramentas.

OpenAI em desenvolvimento de smartphone com chips MediaTek/Qualcomm; Meta de produção em massa para 2028
De acordo com o analista da cadeia de suprimentos Ming-Chi Kuo, a OpenAI está desenvolvendo um smartphone de IA com os parceiros de chip MediaTek e Qualcomm, o fabricante exclusivo Luxshare Precision, e produção em massa planejada para 2028. O dispositivo é posicionado como uma plataforma de agente de IA com consciência de contexto.

Claude Desktop vs Claude Code: Diferenças nos Prompts do Sistema Afetam o Comportamento da IA
Um usuário relata diferenças comportamentais significativas entre o Claude Desktop e o Claude Code, apesar de usar o mesmo modelo Claude Opus, conta e configurações. As diferenças incluem concordância reflexiva, conselhos de bem-estar não solicitados e enquadramento focado em negócios no Desktop que não ocorrem no Code.