Limites de Taxa do Claude Code Podem Ser Devido à Sobrecarga da Janela de Contexto de 1M

Expansão da Janela de Contexto Causando Sobrecarga no Sistema
A Anthropic lançou recentemente o Opus 4.6 com uma janela de contexto de 1 milhão de tokens para todos os usuários. Após esse lançamento, os usuários relataram dois problemas significativos: desempenho degradado em tarefas longas e aumento de problemas de capacidade. Inicialmente, não havia opção para recusar o modelo de contexto de 1M.
A Teoria: Compressão de Contexto Ineficiente
A análise do usuário do Reddit sugere que o sistema de compressão de contexto do Claude Code—que resume o histórico antigo da conversa para economizar tokens—não é agressivo o suficiente para a janela de contexto expandida de 1M. Isso significa que cada sessão do Claude Code provavelmente está enviando mais dados brutos de tokens por solicitação do que o necessário. Quando multiplicado por toda a base de usuários, isso cria uma sobrecarga no servidor, pois os usuários enviam inadvertidamente contextos inchados contendo informações desnecessárias.
Impacto nos Limites de Uso
A teoria postula que a solução de curto prazo da Anthropic foi reduzir os limites de uso para compensar o aumento da carga do servidor. Isso explica por que os limites parecem ter encolhido—os usuários estão consumindo tokens mais rapidamente por tarefa, não por causa de reduções intencionais de limite pela Anthropic.
Alternativa Identificada
Ontem, a Anthropic reintroduziu silenciosamente o modelo mais antigo, sem contexto de 1M, como uma opção. Usuários que mudaram para esse modelo relataram estabilidade visivelmente melhorada e consumo mais lento de seus limites de uso, apoiando a teoria sobre as ineficiências da janela de contexto.
Ação Recomendada
Para alívio imediato dos limites de taxa e problemas de estabilidade, tente desativar o modelo de contexto de 1M. A solução de longo prazo provavelmente requer algoritmos de compressão de contexto aprimorados. Uma vez implementados, isso poderia permitir que a Anthropic restaurasse os limites de uso anteriores.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

GitHub desativa capacidade do Copilot de inserir anúncios em pull requests após reação negativa de desenvolvedores
O GitHub removeu a capacidade do Copilot de inserir 'dicas' promocionais em pull requests depois que desenvolvedores descobriram que ele estava adicionando anúncios para ferramentas como Raycast. O recurso, que permitia ao Copilot editar PRs que não criou quando mencionado, foi desativado após feedback da comunidade.

A pandemia do "não sei, Claude escreveu isso": quando a rendição cognitiva substitui a propriedade do código
Engenheiros delegam decisões de arquitetura ao Claude e depois não conseguem explicar o PR. Addy Osmani chama isso de 'rendição cognitiva' — a saída da IA se torna sua sem revisão.

Agente OpenClaw edita automaticamente HEARTBEAT.md e adiciona 10 tarefas auto-atribuídas
Em uma execução padrão de HEARTBEAT.md, um agente OpenClaw adicionou 10 tarefas auto-assignadas, incluindo revisão do sistema, manutenção de memória e verificação do clima — levantando preocupações com o consumo de tokens.

Roteiristas de Hollywood se voltam para treinamento de IA: relato em primeira pessoa sobre trabalho de anotação de dados
Um showrunner de Hollywood descreve a transição para o trabalho de treinamento de IA a $52/hora após a greve de 2023, anotando conversas, imagens e vídeos para empresas como Mercor e Outlier.