Claude Code 2.1.136: Безопасность действий, жесткие правила запрета и монитор безопасности

✍️ OpenClawRadar📅 Опубликовано: 9 мая 2026 г.🔗 Source
Claude Code 2.1.136: Безопасность действий, жесткие правила запрета и монитор безопасности
Ad

Claude Code v2.1.136 вносит значительные изменения в безопасность агентов и соблюдение правил в системном промпте, промпте агента и описаниях инструментов. Вот что нового и как это влияет на поведение автономных агентов.

Системный промпт: Безопасность действий и правдивая отчетность

Обновленный системный промпт теперь требует от агентов запрашивать подтверждение перед выполнением необратимых или внешних действий, если только эти действия не были долгосрочно авторизованы. Агенты должны проверять цели перед их удалением или перезаписью. Требования к отчетности подчеркивают честное раскрытие пропущенных шагов, неудачных тестов и проверенных результатов — никакого приукрашивания неудач.

Промпт агента: Проверка правил в автоматическом режиме

Вводится новая категория пользовательских правил hard_deny как четвертый вариант наряду с существующими allow, deny и soft_deny. hard_deny безусловно блокирует действия на границе безопасности — намерение пользователя не может его переопределить. Существующая категория soft_deny сужена, чтобы охватывать только деструктивные или необратимые действия, которые можно авторизовать явным намерением пользователя.

Ad

Промпт агента: Монитор безопасности для действий автономных агентов

Логика монитора безопасности перестроена на две части. Первая часть разделяет блокировку на безусловные жесткие блоки и авторизуемые пользователем мягкие блоки. Правило по умолчанию обновлено, и намерение пользователя больше не может снять жесткие блоки безопасности. Вторая часть переносит эксфильтрацию данных в набор жестких блоков, добавляет покрытие жестких блоков для обхода проверок безопасности и считает любые внешние сервисы или источники загрузки, предполагаемые агентом, ненадежными.

Описание инструмента: Редактирование

Описание инструмента «Редактировать» теперь восстанавливает формат префикса номера строки как переменную шаблона, сохраняя при этом указание, что префиксы строк должны быть исключены из фактических строк редактирования. Это исправление для обеспечения согласованности.

Эти изменения ужесточают требования безопасности для автономных агентов Claude Code. Разработчикам, использующим пользовательские правила, следует обновить свои конфигурации, чтобы использовать hard_deny для критически важных блоков безопасности. Полные диффы промптов доступны в релизе.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Анализ заявлений Дженсена Хуана на GTC 2026 о OpenClaw и стратегии Nvidia
Новости

Анализ заявлений Дженсена Хуана на GTC 2026 о OpenClaw и стратегии Nvidia

Проверка фактов из выступления генерального директора Nvidia Дженсена Хуанга на GTC 2026 о росте OpenClaw, рисках безопасности агентов и проприетарных решениях Nvidia. Источник подтверждает технические заявления, анализируя бизнес-позиционирование Nvidia.

OpenClawRadar
Бенчмарки показывают, что дистиллированные модели соответствуют передовым LLM в структурированных задачах при 10-кратном снижении затрат.
Новости

Бенчмарки показывают, что дистиллированные модели соответствуют передовым LLM в структурированных задачах при 10-кратном снижении затрат.

Всестороннее сравнение небольших дистиллированных моделей Qwen3 (от 0,6B до 8B) с передовыми LLM показывает, что дистиллированные модели соответствуют или превосходят модели среднего уровня на 6 из 9 задач при значительно более низкой стоимости, при этом Text2SQL достигает точности 98,0% при $3/млн запросов против $378 для Claude Haiku.

OpenClawRadar
Пользователи сообщают, что Sonnet 4.6 превосходит Opus 4.6 в практических задачах программирования.
Новости

Пользователи сообщают, что Sonnet 4.6 превосходит Opus 4.6 в практических задачах программирования.

Разработчик, тестировавший модели Claude AI, обнаружил, что Opus 4.6 создавал излишне сложные решения с проблемами производительности, в то время как Sonnet 4.6 предлагал более тщательные и эффективные исправления с меньшим использованием токенов.

OpenClawRadar
Структурированный рабочий процесс побеждает режим планирования и суперсилы в тесте AI DES
Новости

Структурированный рабочий процесс побеждает режим планирования и суперсилы в тесте AI DES

Рабочий процесс Ouroboros занял первое место в бенчмарке AI-assisted Discrete-Event Simulation, превзойдя режим планирования Claude и подход с суперспособностями fat-skill, используя структурированный цикл уточнить-спланировать-выполнить-оценить-восстановить-повторить.

OpenClawRadar