Teste A/B do Claude Code reduz silenciosamente o esforço 'Alto' para o nível anterior 'Baixo'

✍️ OpenClawRadar📅 Publicado: August 23, 2026🔗 Source
Ad

Desenvolvedores que usam o Claude Code podem ter notado uma queda repentina no desempenho esta semana. De acordo com um relatório do usuário do X @argofowl, a Anthropic está realizando um teste A/B no lado do servidor que reduz silenciosamente o nível de esforço efetivo para certas sessões. A mudança afeta a versão 2.1.236 e posteriores do Claude Code, onde o modelo agora interpreta o esforço "alto" como 10 de 100 — o valor exato que o "baixo" usava. Versões mais antigas e Opus 5 não são afetadas, e o changelog não menciona isso.

Detalhes principais

  • Versão afetada: Claude Code 2.1.236+ (especificamente notado após 2.1.237)
  • Mudança: A escala de esforço é reduzida no lado do servidor; "alto" agora mapeia para 10/100 em vez de seu valor anterior mais alto.
  • Escopo: Apenas sessões inscritas — é um teste A/B, então nem todos veem isso.
  • Detecção: Se "alto" parece "baixo" para você, você está no grupo de teste.
  • Sem entrada no changelog: A mudança foi feita sem qualquer documentação pública.

O repórter, @argofowl, passou uma tarde convencido de que suas próprias ferramentas estavam quebradas antes de descobrir o problema. Eles expressaram frustração com as práticas de teste opacas da Anthropic: "puxa, Anthropic, vocês são insuportáveis às vezes".

Ad

Análise

Isso não é uma correção no lado do cliente — é uma configuração no lado do servidor que afeta como o modelo interpreta os parâmetros de esforço. Se você está na versão 2.1.236 ou posterior e notou uma qualidade de saída degradada ao definir o esforço para "alto", você pode fazer parte deste experimento. Para evitar o teste, você pode fixar uma versão mais antiga (por exemplo, 2.1.235 ou anterior) ou esperar que a Anthropic implemente ou reverta a mudança. Como é um teste A/B, sua experiência pode variar.

Para desenvolvedores que dependem de um comportamento consistente do agente de codificação de IA, esse tipo de mudança silenciosa é preocupante. Ainda não há declaração oficial da Anthropic, e a mudança não é mencionada em nenhum changelog público. Se você for afetado, considere verificar sua versão do Claude Code e possivelmente fazer downgrade para garantir desempenho estável.

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

HC1 de Taalas: Acelerando Inferência de IA com Silício Personalizado
News

HC1 de Taalas: Acelerando Inferência de IA com Silício Personalizado

A Taalas revela a plataforma HC1, oferecendo a inferência de IA mais rápida e de baixo custo do mundo por meio de design de hardware específico para modelos. Alcança 17 mil tokens/segundo no Llama 3.1 8B.

OpenClawRadar
🦀
News

Qwen3 27B supera Gemma 4 26B em chamada de ferramentas no mundo real para pipeline de vídeo AI local

Um experimento de pipeline de vídeo com IA local mostra o Qwen3 27B lidando com chamadas de ferramentas de forma limpa, enquanto o Gemma 4 26B entrava em loops. Também aborda Said Image Turbo para geração local de imagens e orquestração OpenCode atingindo 174K de contexto.

OpenClawRadar
Super Micro Co-Founder Entre Três Acusados em Caso de Exportação de Tecnologia de IA
News

Super Micro Co-Founder Entre Três Acusados em Caso de Exportação de Tecnologia de IA

Três indivíduos, incluindo o cofundador da Super Micro Computer, Charles Liang, foram acusados pelas autoridades dos EUA de conspirar para exportar ilegalmente tecnologia de IA para a China. O caso envolve supostas violações das leis de controle de exportação.

OpenClawRadar
Anthropic aplica política: uso de Claude por terceiros deixa de ser coberto pelos limites de assinatura
News

Anthropic aplica política: uso de Claude por terceiros deixa de ser coberto pelos limites de assinatura

A Anthropic está implementando uma mudança de política a partir de 4 de abril, onde ferramentas de terceiros como o OpenClaw não consumirão mais dos limites de uso da assinatura do Claude, exigindo que os usuários ativem uso extra ou cancelem até 9 de abril para reembolso.

OpenClawRadar