AWS Bedrock réduit silencieusement le quota de Claude Opus 4.7 : un avertissement pour les workflows IA en production

✍️ OpenClawRadar📅 Publié: May 2, 2026🔗 Source
AWS Bedrock réduit silencieusement le quota de Claude Opus 4.7 : un avertissement pour les workflows IA en production
Ad

Un utilisateur de Hacker News rapporte que son accès au modèle Claude Opus 4.7 a été soudainement révoqué sur Amazon Bedrock, le quota TPM étant silencieusement passé à 0. L'utilisateur, qui dépend de ce modèle pour des workflows de production au service de clients gouvernementaux, a rencontré des erreurs de limitation avant d'obtenir une explication du support AWS.

Selon la réponse du support, la baisse de quota est due à une « récente mise à jour système » qui a ajusté les contrôles d'accès en fonction de facteurs incluant les considérations régionales, l'historique de paiement et les schémas d'utilisation. Les quotas ont été fixés à 0 à partir du 1er mai 2026, et AWS déclare explicitement que le rétablissement « ne peut garantir son approbation ». La solution de contournement recommandée : migrer vers Claude Opus 4.6, pour lequel l'utilisateur dispose de quotas de 10 000 requêtes/min et 3 000 000 tokens/min dans us-east-1 (avec des variantes interrégionales et globales). Le message de support note qu'Opus 4.6 « peut servir de remplacement efficace avec un minimum de modifications de code ».

Les commentateurs de HN expriment leur frustration. L'utilisateur DetroitThrow qualifie cela d'« insensé de la part d'une entreprise de faire un tel coup à des clients payants avec des workflows de production » et recommande de passer à Google AI ou à un accès direct à Anthropic. Ils notent que Bedrock a un historique de limitations aléatoires, citant la couverture précédente de Quinnypig sur les retraits de support entreprise. L'auteur original confirme qu'il « ne peut même plus faire une seule requête ».

Ad

Cet incident souligne le risque de dépendre d'AWS Bedrock pour l'inférence IA en production, en particulier avec des modèles frontières où l'accès peut être révoqué sans préavis. Les développeurs exécutant des charges de travail critiques sur Bedrock devraient envisager des bascules multi-fournisseurs ou des contrats API directs avec des fournisseurs de modèles comme Anthropic.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

L'armée américaine a utilisé l'IA Claude pour les frappes en Iran malgré l'interdiction de Trump
News

L'armée américaine a utilisé l'IA Claude pour les frappes en Iran malgré l'interdiction de Trump

L'armée américaine aurait utilisé le modèle d'IA Claude d'Anthropic pour le renseignement, la sélection de cibles et les simulations de champ de bataille lors des frappes conjointes américano-israéliennes sur l'Iran, malgré l'ordre de Donald Trump aux agences fédérales de cesser d'utiliser Claude quelques heures avant l'attaque.

OpenClawRadar
Cerebras lance les modèles Step-3.5-Flash-REAP avec une réduction de 40 % de la mémoire.
News

Cerebras lance les modèles Step-3.5-Flash-REAP avec une réduction de 40 % de la mémoire.

Cerebras a publié les modèles Step-3.5-Flash-REAP qui utilisent REAP (Router-weighted Expert Activation Pruning) pour compresser des modèles de 196B paramètres à 121B tout en maintenant des performances quasi identiques. Les modèles fonctionnent avec vLLM standard et sont optimisés pour les environnements aux ressources limitées.

OpenClawRadar
Les tests comparatifs montrent que les modèles distillés égalent les LLM de pointe sur les tâches structurées, pour un coût 10 fois inférieur.
News

Les tests comparatifs montrent que les modèles distillés égalent les LLM de pointe sur les tâches structurées, pour un coût 10 fois inférieur.

Une comparaison exhaustive des petits modèles Qwen3 distillés (0,6B à 8B) face aux LLM de pointe montre que les modèles distillés égalent ou surpassent les modèles de pointe de niveau intermédiaire sur 6 tâches sur 9, à un coût considérablement inférieur, avec Text2SQL atteignant 98,0 % de précision à 3 $/M de requêtes contre 378 $ pour Claude Haiku.

OpenClawRadar
"Avertissement honnête" de Claude Code : Analyse basée sur les données de r/ClaudeAI
News

"Avertissement honnête" de Claude Code : Analyse basée sur les données de r/ClaudeAI

Un internaute a suivi la montée des clauses de style 'honest caveat' dans les sorties de Claude Code en utilisant les résultats de recherche Google comme mesure proxy de fréquence.

OpenClawRadar