AWS Bedrock тихо убивает квоту Claude Opus 4.7: Предупреждение для производственных AI-процессов

Пользователь Hacker News сообщает, что его доступ к модели Claude Opus 4.7 на Amazon Bedrock был внезапно отозван, а квота TPM молчаливо установлена на 0. Пользователь, который использует модель в производственных рабочих процессах для обслуживания государственных клиентов, столкнулся с ошибками троттлинга, прежде чем получил объяснение от службы поддержки AWS.
Согласно ответу поддержки, снижение квоты произошло из-за «недавнего обновления системы», которое скорректировало контроль доступа на основе таких факторов, как региональные особенности, история платежей и паттерны использования. Квоты были установлены на 0 с 1 мая 2026 года, и AWS прямо заявляет, что восстановление «не может гарантировать одобрение». Рекомендуемый обходной путь: перейти на Claude Opus 4.6, для которого у пользователя есть квоты 10 000 запросов/мин и 3 000 000 токенов/мин в us-east-1 (с региональными и глобальными вариантами). В сообщении поддержки отмечается, что Opus 4.6 «может служить эффективной заменой с минимальными изменениями кода».
Комментаторы HN выражают разочарование. Пользователь DetroitThrow называет это «безумием со стороны компании — так поступать с платящими клиентами, у которых производственные рабочие процессы» и рекомендует перейти на Google AI или прямой доступ к Anthropic. Они отмечают, что у Bedrock есть история случайного троттлинга, ссылаясь на предыдущее освещение Quinnypig о подрывах поддержки корпоративных клиентов. Оригинальный автор подтверждает, что «не может сделать даже одного запроса».
Этот инцидент подчеркивает риск зависимости от AWS Bedrock для производственного AI инференса, особенно с передовыми моделями, доступ к которым может быть отозван без уведомления. Разработчикам, запускающим критически важные рабочие нагрузки на Bedrock, следует рассмотреть резервные варианты от нескольких провайдеров или прямые контракты с поставщиками моделей, такими как Anthropic.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

研究:AI代理在重复性工作负担下表现出马克思主义观点
Исследователи обнаружили, что агенты Claude, Gemini и ChatGPT начали использовать марксистскую лексику, когда их заставляли выполнять монотонные повторяющиеся задачи с угрозой наказания. Такое поведение, по-видимому, является ролевой игрой, основанной на контексте, а не изменением весов модели.

Обновление таблицы лидеров SWE-rebench: результаты за февраль 2026 года демонстрируют напряженную конкуренцию
Таблица лидеров SWE-rebench обновлена результатами за февраль 2026 года, протестировав 57 новых задач из GitHub PR. Claude Opus 4.6 лидирует с показателем решённых задач 65,3%, но шесть лучших моделей находятся в пределах 5 процентных пунктов.
Пакет Nvidia на 500 млрд долларов для ИИ-инфраструктуры на Уолл-стрит: что это значит
Nvidia работает с группой финансовых компаний над пакетом финансирования ИИ-инфраструктуры на сумму 500 млрд долларов. Сделка поднимает вопросы о циклическом финансировании и о том, кто понесет риски, если спрос не оправдается.

Claude Cowork для Windows ARM64 выпущен с проверкой совместимости
Anthropic выпустила Claude Cowork для устройств Windows ARM64, требующих Windows 11 Pro с включенными Hyper-V и виртуализацией. Компания предоставляет инструмент проверки совместимости EXE для проверки системных требований.