Opus 4.6 O Pensamento Estendido Tem Desempenho Inferior em Problemas com Diagramas de Física

✍️ OpenClawRadar📅 Publicado: April 17, 2026🔗 Source
Opus 4.6 O Pensamento Estendido Tem Desempenho Inferior em Problemas com Diagramas de Física
Ad

Problema de Desempenho com o Modo de Pensamento Estendido

Um usuário no r/ClaudeAI relatou testar o Opus 4.6 e o Gemini 3.1 Pro em problemas de física que exigem interpretação de diagramas visuais. Os testes revelaram uma regressão específica de desempenho no Opus 4.6 ao usar o modo de pensamento estendido.

Principais Descobertas dos Testes

  • Escopo do Teste: 5 problemas de física onde "uma grande parte do problema é interpretar diagramas visuais que exibem cenários"
  • Opus 4.6 com Pensamento Estendido: Errou todos os 5 problemas "completamente devido a uma interpretação fundamentalmente errada do diagrama"
  • Gemini 3.1 Pro: "Arrasou" em todos os 5 problemas
  • Opus 4.6 sem Pensamento Estendido: Resolveu os problemas com sucesso e foi "muito mais rápido também"

O usuário descreveu isso como "um comportamento verdadeiramente estranho", já que o pensamento estendido normalmente melhora o desempenho, mas neste caso específico de interpretação de diagramas, causou falhas consistentes.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

Desenvolvedor Descreve Sensação de Fraude Após Primeiro Pull Request Assistido por IA
News

Desenvolvedor Descreve Sensação de Fraude Após Primeiro Pull Request Assistido por IA

Um desenvolvedor usou o Claude Code para criar um pull request para o Chroma, o realçador de sintaxe padrão do Hugo, adicionando realce de sintaxe ERB. O PR foi aprovado e mesclado, mas o desenvolvedor se sentiu como um impostor e experimentou uma síndrome do impostor agravada.

OpenClawRadar
A quantização Q8_0 do llama.cpp obtém uma aceleração de 3,1x em GPUs Intel Arc com a correção de reordenação SYCL.
News

A quantização Q8_0 do llama.cpp obtém uma aceleração de 3,1x em GPUs Intel Arc com a correção de reordenação SYCL.

Uma correção no backend SYCL do llama.cpp leva a quantização Q8_0 em GPUs Intel Arc de 21% para 66% da largura de banda teórica de memória, alcançando 15,24 tokens/segundo contra 4,88 tokens/segundo anteriormente em uma Arc Pro B70 com Qwen3.5-27B.

OpenClawRadar
🦀
News

Claude Code v2.1.208: Modo Leitor de Tela, Remapeamentos Vim, Correções de Vazamento de Memória e Mais

Claude Code v2.1.208 adiciona modo leitor de tela em texto simples (opt-in), remapeamentos de sequência no modo insert do Vim, um wrapper de processo para lançadores corporativos e corrige dezenas de bugs, incluindo vazamentos de memória em sessões longas.

OpenClawRadar
Usuário do Reddit relata 18,8 tok/s em inferência com CPU usando Qwen 3 30B Q4 em Zen 4
News

Usuário do Reddit relata 18,8 tok/s em inferência com CPU usando Qwen 3 30B Q4 em Zen 4

Um usuário no r/LocalLLaMA testou o Qwen 3 30B Q4 em CPU e alcançou 18,8 tokens por segundo com um processador Zen 4 e memória DDR5, superando significativamente as expectativas de 3-5 tok/s.

OpenClawRadar