Функция использования компьютера от Anthropic вызывает блокировку управления в реальном тесте.

✍️ OpenClawRadar📅 Опубликовано: 24 марта 2026 г.🔗 Source
Функция использования компьютера от Anthropic вызывает блокировку управления в реальном тесте.
Ad

Что произошло

Anthropic выпустила функциональность использования компьютера. Разработчик работал в управляемой сессии Claude Code, добавляя механизмы контроля для этих новых инструментов, когда система перешла в режим БЛОКИРОВКИ.

Ключевые детали инцидента

Система управления отслеживает совокупный риск от отклонённых операций. Когда этот риск превысил 0.50, система автоматически перешла в режим БЛОКИРОВКИ со следующими последствиями:

  • Сессия могла по-прежнему читать файлы
  • Все операции записи были заблокированы
  • Команды изменения не могли выполняться
  • Отправка в GitHub была предотвращена
  • Слой управления заблокировал собственного оператора от завершения работы, которая укрепила бы систему управления

Механизм принуждения

БЛОКИРОВКА механически обеспечивается системой перехвата со следующими характеристиками:

  • Канал переопределения отсутствует
  • Модель не может обойти блокировку через диалог
  • Оператор не может выдавать исключения внутри системы
  • Единственный путь восстановления требует полного выхода из сессии
Ad

Процесс разрешения

Чтобы продолжить работу, разработчику пришлось:

  • Выйти из управляемой сессии
  • Открыть терминал на локальной машине
  • Вручную отправить коммит

Система вынудила человеческое вмешательство за пределами своей юрисдикции, создав то, что разработчик описывает как "разницу между управлением, которое вы описываете, и управлением, которое вы применяете".

Примечания о поведении системы

Реализация БЛОКИРОВКИ не снижается плавно, не запрашивает подтверждения и сохраняет остановленное состояние до тех пор, пока не произойдёт внешнее человеческое действие. Разработчик отмечает: "Этот отказ и есть продукт".

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

大规模NPM和PyPI供应链攻击影响TanStack、Mistral AI及170多个软件包
Безопасность

大规模NPM和PyPI供应链攻击影响TanStack、Mistral AI及170多个软件包

Скоординированная атака скомпрометировала более 170 npm-пакетов и 2 PyPI-пакета, затронув TanStack (42 пакета), SDK Mistral AI, UiPath, OpenSearch и Guardrails AI. Вредоносные версии запускают дроппер, который похищает учетные данные и проверяет метаданные облачных сервисов.

OpenClawRadar
Предупреждение системы безопасности: Вредоносный код в LiteLLM может похищать API-ключи
Безопасность

Предупреждение системы безопасности: Вредоносный код в LiteLLM может похищать API-ключи

Обнаружена критическая уязвимость безопасности в LiteLLM, которая может раскрыть API-ключи. Пользователи OpenClaw или nanobot могут быть затронуты и должны проверить связанные проблемы на GitHub, указанные в источнике.

OpenClawRadar
Защитные механизмы ИИ-агентов со временем ослабляются без активного обслуживания.
Безопасность

Защитные механизмы ИИ-агентов со временем ослабляются без активного обслуживания.

Защитные механизмы ИИ-агентов со временем деградируют по мере накопления обновлений системных промптов, изменения версий моделей и добавления новых инструментов, что часто приводит к противоречивым или игнорируемым правилам безопасности, требующим регулярной проверки и тестирования.

OpenClawRadar
Критические уязвимости безопасности OpenClaw устранены в версии 2026.3.28.
Безопасность

Критические уязвимости безопасности OpenClaw устранены в версии 2026.3.28.

Версия OpenClaw 2026.3.28 исправляет 8 критических уязвимостей в системе безопасности, обнаруженных Ant AI Security Lab, включая обход песочницы, повышение привилегий и риски SSRF. Пользователям версий ≤2026.3.24 следует немедленно обновиться.

OpenClawRadar