Claude Code 2.1.136: Безопасность действий, жесткие правила запрета и монитор безопасности

Claude Code v2.1.136 вносит значительные изменения в безопасность агентов и соблюдение правил в системном промпте, промпте агента и описаниях инструментов. Вот что нового и как это влияет на поведение автономных агентов.
Системный промпт: Безопасность действий и правдивая отчетность
Обновленный системный промпт теперь требует от агентов запрашивать подтверждение перед выполнением необратимых или внешних действий, если только эти действия не были долгосрочно авторизованы. Агенты должны проверять цели перед их удалением или перезаписью. Требования к отчетности подчеркивают честное раскрытие пропущенных шагов, неудачных тестов и проверенных результатов — никакого приукрашивания неудач.
Промпт агента: Проверка правил в автоматическом режиме
Вводится новая категория пользовательских правил hard_deny как четвертый вариант наряду с существующими allow, deny и soft_deny. hard_deny безусловно блокирует действия на границе безопасности — намерение пользователя не может его переопределить. Существующая категория soft_deny сужена, чтобы охватывать только деструктивные или необратимые действия, которые можно авторизовать явным намерением пользователя.
Промпт агента: Монитор безопасности для действий автономных агентов
Логика монитора безопасности перестроена на две части. Первая часть разделяет блокировку на безусловные жесткие блоки и авторизуемые пользователем мягкие блоки. Правило по умолчанию обновлено, и намерение пользователя больше не может снять жесткие блоки безопасности. Вторая часть переносит эксфильтрацию данных в набор жестких блоков, добавляет покрытие жестких блоков для обхода проверок безопасности и считает любые внешние сервисы или источники загрузки, предполагаемые агентом, ненадежными.
Описание инструмента: Редактирование
Описание инструмента «Редактировать» теперь восстанавливает формат префикса номера строки как переменную шаблона, сохраняя при этом указание, что префиксы строк должны быть исключены из фактических строк редактирования. Это исправление для обеспечения согласованности.
Эти изменения ужесточают требования безопасности для автономных агентов Claude Code. Разработчикам, использующим пользовательские правила, следует обновить свои конфигурации, чтобы использовать hard_deny для критически важных блоков безопасности. Полные диффы промптов доступны в релизе.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Claude.ai в настоящее время не работает, ошибки API участились — 28 апреля 2026 г.
Автоматическое обновление статуса, запущенное с официальной страницы статуса Claude, сообщает, что Claude.ai недоступен, а API испытывает повышенный уровень ошибок по состоянию на 2026-04-28T17:51:36.000Z.

TimesFM 2.5 от Google: 200-миллионная модель для временных рядов с контекстом в 16 тысяч элементов.
Google Research представила TimesFM 2.5 — декодерную базовую модель для прогнозирования временных рядов с 200 миллионами параметров, длиной контекста 16 тысяч и непрерывным квантильным прогнозированием до горизонта в 1 тысячу.

Claude Code v2.1.129: флаг URL плагина, принудительная синхронизация вывода и 20+ исправлений
Добавлен флаг --plugin-url для загрузки плагинов из ZIP по URL, переменная CLAUDE_CODE_FORCE_SYNC_OUTPUT для Emacs eat, исправлена трата токенов /context, понижение TTL кэша и гонка OAuth.

Миньоны Stripe: Одноразовые ИИ-агенты для программирования
Миньоны – это однострочные AI-агенты кода Stripe, направленные на повышение продуктивности разработчиков за счет полного автоматизированного процесса с использованием LLM.