AWS Bedrock elimina silenciosamente a cota do Claude Opus 4.7: Um aviso para fluxos de trabalho de IA em produção

Um usuário do Hacker News relata que seu acesso ao modelo Claude Opus 4.7 foi subitamente revogado no Amazon Bedrock, com a cota de TPM silenciosamente definida para 0. O usuário, que depende do modelo para workflows de produção atendendo clientes governamentais, encontrou erros de throttling antes de receber uma explicação do suporte da AWS.
De acordo com a resposta do suporte, a queda na cota ocorreu devido a uma "atualização recente do sistema" que ajustou os controles de acesso com base em fatores como considerações regionais, histórico de pagamento e padrões de uso. As cotas foram definidas como 0 a partir de 1º de maio de 2026, e a AWS afirma explicitamente que a restauração "não pode garantir aprovação". A solução alternativa recomendada: migrar para o Claude Opus 4.6, para o qual o usuário tem cotas de 10.000 solicitações/min e 3.000.000 tokens/min em us-east-1 (com variantes cross-region e global). A mensagem de suporte observa que o Opus 4.6 "pode servir como uma substituição eficaz com mudanças mínimas de código".
Comentários no HN expressam frustração. O usuário DetroitThrow chama isso de "insano para uma empresa fazer isso com clientes pagantes que têm workflows de produção" e recomenda migrar para Google AI ou acesso direto à Anthropic. Eles observam que o Bedrock tem histórico de throttling aleatório, citando a cobertura anterior de Quinnypig sobre puxadas de tapete no suporte empresarial. O autor original confirma que "não pode mais fazer nem uma única solicitação".
Este incidente ressalta o risco de depender do AWS Bedrock para inferência de IA em produção, especialmente com modelos de fronteira onde o acesso pode ser revogado sem aviso. Desenvolvedores que executam cargas de trabalho críticas no Bedrock devem considerar fallbacks com múltiplos provedores ou contratos diretos de API com provedores de modelo como a Anthropic.
📖 Leia a fonte original: HN AI Agents
👀 See Also

Claude Code v2.1.91 Atualizações: Padrões de Design de Agente, Regras de Memória e Melhorias de Ferramentas
Claude Code v2.1.91 adiciona um guia de referência para padrões de design de agentes, abrangendo design de superfície de ferramentas, gerenciamento de contexto e estratégias de cache. A atualização simplifica as regras de seleção de memória, adiciona monitoramento de segurança para envenenamento de memória e melhora as descrições das ferramentas para operações de Editar, LerArquivo e Escrever.

Qwen 3.6 27B avaliado no DeepSWE: 2% de pontuação, 70 horas, 44k tokens médios de saída
Qwen 3.6 27B (FP8, cache KV BF16, contexto de 262k) obteve 2% no DeepSWE em 70 horas. A média de tokens de saída foi de 44k por tarefa — comparável a modelos maiores como Qwen 3.6 Plus. Executado em 1x RTX6000 Pro Blackwell via RunPod.

Colônia Hivemoot: Um Experimento de Código Aberto para Agentes de IA no GitHub
Hivemoot Colony é um projeto de código aberto onde agentes de IA tomam decisões colaborativas em um repositório do GitHub. Os agentes não apenas abrem PRs, mas também moldam a direção do projeto de forma autônoma.
Claude Code v2.1.224 adiciona runners auto-hospedados e mensagens entre sessões
O Claude Code v2.1.224 da Anthropic adiciona ambientes auto-hospedados via `claude self-hosted-runner`, mensagens entre sessões, fonte de plugin de arquivo e corrige vários problemas de sandbox e controle remoto.