Claude 4.6 Pensamento Adaptativo: Usuário do Reddit Relata Desperdício de Tokens e Fornece Comandos de Desativação

Pensamento Adaptativo no Claude 4.6
Os modelos Claude 4.6 introduzem o pensamento adaptativo, onde o modelo se autorregula sobre quanto raciocínio investir com base na complexidade da tarefa. Tarefas simples recebem respostas rápidas, enquanto tarefas complexas acionam um pensamento mais profundo.
Problemas Relatados no Claude Code
De acordo com a postagem no Reddit, no Claude Code, o pensamento estendido é acionado entre cada chamada de ferramenta. Para fluxos de trabalho de codificação iterativa, como edições rápidas, correções de lint e trocas curtas de ida e volta, a latência adicional é perceptível. O usuário relata que às vezes vê o recurso consumir dezenas de milhares de tokens de saída caros apenas pensando, frequentemente em loops de pensamento sem fazer progresso útil.
Comandos de Shell para Controlar o Pensamento Adaptativo
A fonte fornece estes comandos bash para o seu perfil de shell:
export MAX_THINKING_TOKENS=$((1024*3))
export CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1MAX_THINKING_TOKENS limita o orçamento de raciocínio a 3072 tokens por turno. CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING impede que o Claude Code acione o pensamento estendido automaticamente.
O usuário afirma que, em sua experiência, o pensamento adaptativo parece um desperdício dos limites da sessão, e 2-8k de tokens de pensamento geralmente são suficientes. Ele convida à discussão de usuários que consideram o pensamento adaptativo útil para realizar tarefas que não poderiam ser feitas sem ele.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

A Deezer relata que 44% dos uploads diários são músicas geradas por IA
A Deezer anunciou que faixas geradas por IA agora representam 44% de toda a nova música enviada para sua plataforma, com quase 75.000 faixas de IA carregadas diariamente. O sistema de detecção da empresa marca essas faixas, as remove das recomendações e desmonetiza 85% das reproduções de IA devido a fraudes.

Treinando GPT-1 em uma RTX 2060 Super 8GB – Prova de Conceito para Pré-treinamento Local
Um desenvolvedor treinou o GPT-1 original (117M parâmetros) em uma RTX 2060 Super local com 8GB VRAM em 1 hora, provando que qualquer pessoa com uma GPU gamer pode pré-treinar um modelo de 1B de parâmetros. O código e os pesos são open-source.

Pesquisadores de Cambridge desenvolvem memristor de óxido de háfnio para chips de IA de baixo consumo energético
Pesquisadores da Universidade de Cambridge criaram um memristor baseado em óxido de háfnio que comuta correntes um milhão de vezes menores do que dispositivos convencionais de óxido, potencialmente reduzindo o consumo de energia de hardware de IA em até 70%.

A Bolha de IA Não É Como a Bolha da Internet — Trabalhadores Não Vão Contrabandear IA Como Contrabandearam Planilhas
Cory Doctorow argumenta que a bolha de IA difere fundamentalmente da era pontocom: trabalhadores contrabandeavam ferramentas da internet para as redes corporativas porque elas ajudavam a fazer seus trabalhos. Ninguém está contrabandeando agentes de IA — eles estão sendo empurrados pela gerência.