AWS Bedrock elimina silenciosamente a cota do Claude Opus 4.7: Um aviso para fluxos de trabalho de IA em produção

✍️ OpenClawRadar📅 Publicado: May 2, 2026🔗 Source
AWS Bedrock elimina silenciosamente a cota do Claude Opus 4.7: Um aviso para fluxos de trabalho de IA em produção
Ad

Um usuário do Hacker News relata que seu acesso ao modelo Claude Opus 4.7 foi subitamente revogado no Amazon Bedrock, com a cota de TPM silenciosamente definida para 0. O usuário, que depende do modelo para workflows de produção atendendo clientes governamentais, encontrou erros de throttling antes de receber uma explicação do suporte da AWS.

De acordo com a resposta do suporte, a queda na cota ocorreu devido a uma "atualização recente do sistema" que ajustou os controles de acesso com base em fatores como considerações regionais, histórico de pagamento e padrões de uso. As cotas foram definidas como 0 a partir de 1º de maio de 2026, e a AWS afirma explicitamente que a restauração "não pode garantir aprovação". A solução alternativa recomendada: migrar para o Claude Opus 4.6, para o qual o usuário tem cotas de 10.000 solicitações/min e 3.000.000 tokens/min em us-east-1 (com variantes cross-region e global). A mensagem de suporte observa que o Opus 4.6 "pode servir como uma substituição eficaz com mudanças mínimas de código".

Comentários no HN expressam frustração. O usuário DetroitThrow chama isso de "insano para uma empresa fazer isso com clientes pagantes que têm workflows de produção" e recomenda migrar para Google AI ou acesso direto à Anthropic. Eles observam que o Bedrock tem histórico de throttling aleatório, citando a cobertura anterior de Quinnypig sobre puxadas de tapete no suporte empresarial. O autor original confirma que "não pode mais fazer nem uma única solicitação".

Ad

Este incidente ressalta o risco de depender do AWS Bedrock para inferência de IA em produção, especialmente com modelos de fronteira onde o acesso pode ser revogado sem aviso. Desenvolvedores que executam cargas de trabalho críticas no Bedrock devem considerar fallbacks com múltiplos provedores ou contratos diretos de API com provedores de modelo como a Anthropic.

📖 Leia a fonte original: HN AI Agents

Ad

👀 See Also

Comparação de Desempenho entre Qwen3-30B-A3B e Qwen3.5-35B-A3B no RTX 5090
News

Comparação de Desempenho entre Qwen3-30B-A3B e Qwen3.5-35B-A3B no RTX 5090

Um benchmark direto entre Qwen3-30B-A3B e Qwen3.5-35B-A3B em uma RTX 5090 mostra que o modelo de 30B é 35% mais rápido na geração, enquanto o modelo 3.5 lida melhor com contexto longo, apresentando escalonamento plano de tokens contra uma degradação de 21% do modelo de 30B.

OpenClawRadar
O Claude Code foi removido do plano Pro da Anthropic e agora está disponível apenas nos planos Max
News

O Claude Code foi removido do plano Pro da Anthropic e agora está disponível apenas nos planos Max

A Anthropic removeu o Claude Code do seu plano Pro (US$ 17-20/mês), disponibilizando-o apenas nos planos Max a partir de US$ 100/mês. O plano Pro agora inclui Claude Cowork, projetos ilimitados, recurso de Pesquisa e acesso a mais modelos Claude.

OpenClawRadar
Atualização de Status do Claude: Taxas de Erro Elevadas para Opus 4.6 e Sonnet 4.6
News

Atualização de Status do Claude: Taxas de Erro Elevadas para Opus 4.6 e Sonnet 4.6

Um relatório oficial de status do sistema Claude informa taxas de erro elevadas para os modelos Opus 4.6 e Sonnet 4.6, com um incidente registrado em 2026-03-31T21:10:28.000Z. A publicação automática orienta os usuários a verificar o status de resolução e os relatórios de desempenho da comunidade.

OpenClawRadar
🦀
News

Claude Code v2.1.248: Modo Restrito, TTL de Cache e Correções de Sessão

Claude Code v2.1.248 adiciona um modo restrito para acesso a arquivos em sandbox, TTL de cache por agente, mensagens entre sessões e correções para falhas de cache de prompt e gerenciamento de sessão.

OpenClawRadar