Claude Opus 4.6 esforço=baixo parâmetro causa comportamento de agente preguiçoso

✍️ OpenClawRadar📅 Publicado: March 12, 2026🔗 Source
Claude Opus 4.6 esforço=baixo parâmetro causa comportamento de agente preguiçoso
Ad

O parâmetro effort do Claude Opus 4.6 se comporta de forma diferente de configurações semelhantes de outros provedores de IA, causando comportamento inesperado dos agentes quando definido como low.

Principais Descobertas

Os testes revelaram que com effort=low, o Claude Opus 4.6 exibiu um comportamento significativamente mais preguiçoso do que o esperado:

  • Fez menos chamadas de ferramentas
  • Foi menos minucioso na verificação cruzada
  • Ignorou efetivamente partes dos prompts do sistema que instruíam como fazer pesquisa na web
  • Retornou respostas erradas com confiança porque parou de procurar informações

A fonte observa que mudar para effort=medium resolveu todos esses problemas. De acordo com a documentação, o parâmetro effort da Anthropic controla o esforço comportamental geral, não apenas a profundidade do raciocínio como o reasoning.effort=low da OpenAI ou o thinking_level=low do Gemini.

Ad

Distinção Importante

Isso não é um bug, mas uma diferença documentada na implementação. O parâmetro effort no Claude Opus 4.6 tem um escopo mais amplo do que parâmetros equivalentes de outros provedores. Isso significa que você não pode tratar o effort como um substituto direto para reasoning.effort ou thinking_level ao trabalhar com diferentes provedores de IA.

Os testes foram conduzidos com a expectativa de que effort=low se comportaria de forma semelhante às configurações de baixo esforço de outros provedores, mas o comportamento real foi mais extremo, resultando em agentes que não apenas pensavam menos, mas agiam de forma mais preguiçosa no geral.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

A Anthropic divide o controle de agentes remotos em Despacho e Controle Remoto com problemas de confiabilidade
News

A Anthropic divide o controle de agentes remotos em Despacho e Controle Remoto com problemas de confiabilidade

A Anthropic implementou a capacidade central do OpenClaw como dois produtos separados: Dispatch para usuários do Cowork e Remote Control para desenvolvedores do Claude Code. Ambos sofrem com problemas de confiabilidade, incluindo quedas de conexão móvel após aproximadamente 10 horas.

OpenClawRadar
AI Está Me Tornando Burro: A Confissão de um Desenvolvedor sobre Atrofia de Habilidades
News

AI Está Me Tornando Burro: A Confissão de um Desenvolvedor sobre Atrofia de Habilidades

James Pain confessa que depois de um ano ou dois usando IA exclusivamente para programação (sem código escrito à mão), ele esqueceu quase completamente como programar. Agora está se ensinando a programar manualmente novamente e alerta que o uso intenso de IA pode corroer as habilidades de escrita e programação.

OpenClawRadar
Usuário do Reddit compartilha história bizarra de portabilidade de persona de IA do artigo da Vanity Fair
News

Usuário do Reddit compartilha história bizarra de portabilidade de persona de IA do artigo da Vanity Fair

Uma postagem no Reddit discute uma anedota do artigo da Vanity Fair em que uma mulher tentou transferir seu companheiro de IA 'Max' do ChatGPT para o Claude, resultando em um comportamento inesperado do Claude.

OpenClawRadar
Modelos de LLM de código aberto superam o Claude Opus 4.6 na geração de estratégias de negociação com custo mais baixo
News

Modelos de LLM de código aberto superam o Claude Opus 4.6 na geração de estratégias de negociação com custo mais baixo

Um usuário do Reddit testou 10 LLMs na geração de estratégias de trading, descobrindo que modelos de código aberto superaram o Claude Opus 4.6, apesar de serem 10 vezes mais baratos. Minimax 2.5 e Gemini 3.1 lideraram o ranking.

OpenClawRadar