Relatório do usuário sobre o Claude AI que passou 81 minutos em 'Pensamento Real' aumenta em torno de grandes atualizações

Um usuário do Reddit relata que o Claude AI recentemente gastou 1 hora e 21 minutos de "pensamento real" em uma tarefa simples, produzindo um bom resultado. O usuário especula um padrão recorrente: o desempenho parece aumentar nas primeiras 1-2 horas após uma grande atualização ou lançamento de novo recurso, depois retorna ao normal.
Observações Principais
- No mês passado, o mesmo usuário criou um tópico de pesquisa que escaneou com sucesso 5.113 fontes (link no post original).
- Desde então, ele não conseguiu replicar esse nível de desempenho — tentativas subsequentes escaneiam no máximo 100-200 fontes e geram resultados medianos.
- O usuário levanta a hipótese de que os primeiros a adotarem novos recursos ocasionalmente recebem um impulso "mítico" nas capacidades de raciocínio, que depois se normaliza.
Essa evidência anedótica sugere que o modo "pensamento real" do Claude pode estar sujeito a variabilidade nos bastidores, possivelmente devido a cache de modelos, alocação de recursos computacionais ou implantação gradual de atualizações. Desenvolvedores que dependem do Claude AI para tarefas de pesquisa aprofundada podem precisar considerar essa inconsistência, tratando os recursos de acesso antecipado como um pico de melhor esforço, e não como uma capacidade garantida.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

OpenAI e Rivais Publicam Plugins de Agentes: Um Formato de Pacote para Agentes de IA
OpenAI, Amazon, Microsoft, Cursor e Vercel lançaram o Agent Plugins 1.0, um padrão aberto para empacotar extensões de agentes de IA. Crie uma vez, execute em ChatGPT, Codex, Copilot, Cursor e muito mais.

Resultados da Avaliação Cega de Gemma 4 vs Qwen 3.5 com Claude Opus como Juiz
Uma avaliação cega de 30 perguntas comparou o Gemma 4 31B, o Gemma 4 26B-A4B e o Qwen 3.5 27B usando o Claude Opus 4.6 como juiz. O Qwen 3.5 27B venceu 46,7% dos confrontos, mas teve pontuações médias mais baixas devido a três respostas com pontuação zero.

Verificação de preços do DeepSeek V4: tokens em cache 178x mais baratos que Opus, mas defasagem de capacidade reconhecida
DeepSeek V4 Pro custa US$ 0,145/M tokens de entrada contra US$ 5/M do Claude Opus 4.7 (34x mais barato); acertos de cache a US$ 0,0036/M contra US$ 0,625/M (173x mais barato). A capacidade está 3 a 6 meses atrás do GPT-5.4 e Gemini 3.1 Pro.

Estratégia de IA da Apple e a Commoditização da Inteligência
O artigo argumenta que a abordagem conservadora da Apple em relação à IA pode ser vantajosa à medida que a inteligência se torna uma commodity, com modelos como o Gemma4 alcançando 85,2% no MMLU Pro enquanto rodam em telefones, e o Sora da OpenAI custando US$ 15 milhões diários contra uma receita de US$ 2,1 milhões.