Limites de Taxa do Claude Code Podem Ser Devido à Sobrecarga da Janela de Contexto de 1M

Expansão da Janela de Contexto Causando Sobrecarga no Sistema
A Anthropic lançou recentemente o Opus 4.6 com uma janela de contexto de 1 milhão de tokens para todos os usuários. Após esse lançamento, os usuários relataram dois problemas significativos: desempenho degradado em tarefas longas e aumento de problemas de capacidade. Inicialmente, não havia opção para recusar o modelo de contexto de 1M.
A Teoria: Compressão de Contexto Ineficiente
A análise do usuário do Reddit sugere que o sistema de compressão de contexto do Claude Code—que resume o histórico antigo da conversa para economizar tokens—não é agressivo o suficiente para a janela de contexto expandida de 1M. Isso significa que cada sessão do Claude Code provavelmente está enviando mais dados brutos de tokens por solicitação do que o necessário. Quando multiplicado por toda a base de usuários, isso cria uma sobrecarga no servidor, pois os usuários enviam inadvertidamente contextos inchados contendo informações desnecessárias.
Impacto nos Limites de Uso
A teoria postula que a solução de curto prazo da Anthropic foi reduzir os limites de uso para compensar o aumento da carga do servidor. Isso explica por que os limites parecem ter encolhido—os usuários estão consumindo tokens mais rapidamente por tarefa, não por causa de reduções intencionais de limite pela Anthropic.
Alternativa Identificada
Ontem, a Anthropic reintroduziu silenciosamente o modelo mais antigo, sem contexto de 1M, como uma opção. Usuários que mudaram para esse modelo relataram estabilidade visivelmente melhorada e consumo mais lento de seus limites de uso, apoiando a teoria sobre as ineficiências da janela de contexto.
Ação Recomendada
Para alívio imediato dos limites de taxa e problemas de estabilidade, tente desativar o modelo de contexto de 1M. A solução de longo prazo provavelmente requer algoritmos de compressão de contexto aprimorados. Uma vez implementados, isso poderia permitir que a Anthropic restaurasse os limites de uso anteriores.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Opus 4.6 O Pensamento Estendido Tem Desempenho Inferior em Problemas com Diagramas de Física
Testes mostram que o Claude Opus 4.6 com pensamento estendido consistentemente falha em problemas de física que envolvem interpretação de diagramas visuais, enquanto o Gemini 3.1 Pro tem sucesso. Desativar o pensamento estendido permite que o Opus 4.6 resolva os mesmos problemas corretamente e mais rápido.

Desenvolvedor muda para Minimax 2.7 após banimento do Claude e problemas de crédito do MiMo
Um desenvolvedor testou vários modelos de IA para o OpenClaw após o banimento do Claude, descobrindo que o GLM 5.1 e o 5 Turbo eram ineficazes para tarefas de agente, o sistema de créditos do MiMo V2 Pro era ineficiente, e optou pelo Minimax 2.7 por sua cota generosa e capacidade de lidar com tarefas de automação.

Centros de Dados de IA Aumentam Temperaturas Locais Até 9,1°C, Revela Estudo
Um estudo da Universidade de Cambridge descobriu que os data centers de IA elevam a temperatura da superfície terrestre em média 2°C após o início das operações, com casos extremos atingindo aumentos de 9,1°C, afetando áreas de até 10 quilômetros de distância.

Pesquisa sobre a Consistência de Agentes de IA: Principais Descobertas e Aplicações Práticas
Um estudo de 3.000 experimentos com Claude, GPT-4o e Llama revela que agentes consistentes alcançam 80–92% de precisão, enquanto os inconsistentes caem para 25–60%, com 69% da divergência ocorrendo na primeira chamada de ferramenta.