Les limites de débit de Claude Code peuvent être dues à une surcharge de la fenêtre de contexte de 1 million de tokens

L'expansion de la fenêtre de contexte provoque une tension du système
Anthropic a récemment publié Opus 4.6 avec une fenêtre de contexte de 1 million de tokens pour tous les utilisateurs. Suite à cette sortie, les utilisateurs ont signalé deux problèmes majeurs : une dégradation des performances sur les tâches longues et des problèmes de capacité accrus. Il n'y avait initialement aucune option pour se désengager du modèle à contexte de 1 million de tokens.
La théorie : une compression de contexte inefficace
L'analyse de l'utilisateur de Reddit suggère que le système de compression de contexte de Claude Code—qui résume l'ancien historique de conversation pour économiser des tokens—n'est pas assez agressif pour la fenêtre de contexte étendue de 1 million de tokens. Cela signifie que chaque session Claude Code envoie probablement plus de données brutes de tokens par requête que nécessaire. Multipliée par l'ensemble des utilisateurs, cela crée une surcharge des serveurs, car les utilisateurs envoient involontairement des contextes gonflés contenant des informations inutiles.
Impact sur les limites d'utilisation
La théorie postule que la solution à court terme d'Anthropic a été de réduire les limites d'utilisation pour compenser la charge accrue des serveurs. Cela explique pourquoi les limites semblent avoir diminué—les utilisateurs consomment des tokens plus rapidement par tâche, et non à cause de réductions intentionnelles des limites par Anthropic.
Une solution de contournement identifiée
Hier, Anthropic a discrètement réintroduit l'ancien modèle, sans fenêtre de contexte de 1 million de tokens, comme option. Les utilisateurs qui sont passés à ce modèle ont signalé une stabilité nettement améliorée et une consommation plus lente de leurs limites d'utilisation, soutenant ainsi la théorie sur les inefficacités de la fenêtre de contexte.
Action recommandée
Pour un soulagement immédiat des limites de débit et des problèmes de stabilité, essayez de désactiver le modèle à contexte de 1 million de tokens. La solution à long terme nécessitera probablement des algorithmes de compression de contexte améliorés. Une fois mis en œuvre, cela pourrait permettre à Anthropic de rétablir les limites d'utilisation précédentes.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Fuite de l'OS AI léger de Windows 11 basé sur Edge, non publié par Microsoft
Une version allégée de Windows 11 AI OS de Microsoft, centrée sur Edge, a fuité. Destinée aux appareils modestes et aux workflows IA, elle intègre Edge comme composant principal.

Microsoft met fin au partage des revenus avec OpenAI, impact sur les agents d'IA incertain
Microsoft cessera de partager les revenus avec OpenAI, son principal partenaire en IA, selon un rapport de Bloomberg. Cette décision pourrait affecter la manière dont les développeurs intègrent les agents IA via les services Azure OpenAI.

Inde et EAU s'associent pour la souveraineté en IA avec des superordinateurs Cerebras
L'Inde et les Émirats arabes unis se sont associés pour déployer un supercalculateur IA Cerebras en Inde, offrant une alternative à AWS, Azure et GCP pour les charges de travail gouvernementales. G42 exploite le système à 64 CS sous les règles indiennes en matière de données.

sseanliu/VisionClaw apporte une assistance IA en temps réel aux lunettes intelligentes Meta Ray-Ban
VisionClaw de sseanliu propose une révolutionnaire assistance IA pour les lunettes intelligentes Meta Ray-Ban, combinant la voix, la vision et les actions agentiques alimentées par Gemini Live et OpenClaw.