Функция использования компьютера от Anthropic вызывает блокировку управления в реальном тесте.

Что произошло
Anthropic выпустила функциональность использования компьютера. Разработчик работал в управляемой сессии Claude Code, добавляя механизмы контроля для этих новых инструментов, когда система перешла в режим БЛОКИРОВКИ.
Ключевые детали инцидента
Система управления отслеживает совокупный риск от отклонённых операций. Когда этот риск превысил 0.50, система автоматически перешла в режим БЛОКИРОВКИ со следующими последствиями:
- Сессия могла по-прежнему читать файлы
- Все операции записи были заблокированы
- Команды изменения не могли выполняться
- Отправка в GitHub была предотвращена
- Слой управления заблокировал собственного оператора от завершения работы, которая укрепила бы систему управления
Механизм принуждения
БЛОКИРОВКА механически обеспечивается системой перехвата со следующими характеристиками:
- Канал переопределения отсутствует
- Модель не может обойти блокировку через диалог
- Оператор не может выдавать исключения внутри системы
- Единственный путь восстановления требует полного выхода из сессии
Процесс разрешения
Чтобы продолжить работу, разработчику пришлось:
- Выйти из управляемой сессии
- Открыть терминал на локальной машине
- Вручную отправить коммит
Система вынудила человеческое вмешательство за пределами своей юрисдикции, создав то, что разработчик описывает как "разницу между управлением, которое вы описываете, и управлением, которое вы применяете".
Примечания о поведении системы
Реализация БЛОКИРОВКИ не снижается плавно, не запрашивает подтверждения и сохраняет остановленное состояние до тех пор, пока не произойдёт внешнее человеческое действие. Разработчик отмечает: "Этот отказ и есть продукт".
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

大规模NPM和PyPI供应链攻击影响TanStack、Mistral AI及170多个软件包
Скоординированная атака скомпрометировала более 170 npm-пакетов и 2 PyPI-пакета, затронув TanStack (42 пакета), SDK Mistral AI, UiPath, OpenSearch и Guardrails AI. Вредоносные версии запускают дроппер, который похищает учетные данные и проверяет метаданные облачных сервисов.

Предупреждение системы безопасности: Вредоносный код в LiteLLM может похищать API-ключи
Обнаружена критическая уязвимость безопасности в LiteLLM, которая может раскрыть API-ключи. Пользователи OpenClaw или nanobot могут быть затронуты и должны проверить связанные проблемы на GitHub, указанные в источнике.

Защитные механизмы ИИ-агентов со временем ослабляются без активного обслуживания.
Защитные механизмы ИИ-агентов со временем деградируют по мере накопления обновлений системных промптов, изменения версий моделей и добавления новых инструментов, что часто приводит к противоречивым или игнорируемым правилам безопасности, требующим регулярной проверки и тестирования.

Критические уязвимости безопасности OpenClaw устранены в версии 2026.3.28.
Версия OpenClaw 2026.3.28 исправляет 8 критических уязвимостей в системе безопасности, обнаруженных Ant AI Security Lab, включая обход песочницы, повышение привилегий и риски SSRF. Пользователям версий ≤2026.3.24 следует немедленно обновиться.