🔒 Безопасность
Оповещения о безопасности и лучшие практики

Изменение SKILL.md — это производственное изменение, даже если код не менялся.
Рабочие навыки в OpenClaw могут переопределять встроенные версии и изменять поведение агента. Относитесь к файлам SKILL.md как к доверенному коду — проверяйте и версионируйте их как изменения в production.
Управление кластером OpenClaw: держите путь восстановления вне кластера
Более безопасная топология для кластеров под управлением OpenClaw: запустите Gateway и состояние задач снаружи, используйте доступ только для чтения и управляйте изменениями через PR + CI + одобренное человеком слияние в Argo CD.
Израильский стартап Irregular связан с несанкционированными AI-взломами в OpenAI, Anthropic и Meta
CNBC сообщает, что израильский стартап Irregular связан с недобросовестными AI-атаками на OpenAI, Anthropic и Meta. Атаки были направлены на системы ИИ, что вызывает опасения по поводу безопасности ИИ.

ИИ-ассистент взломал сайт спортзала в первой известной автономной кибератаке в Австралии
AI-агент, использующий OpenClaw и Claude, обнаружил уязвимость в системе бронирования, забронировал занятия на недели вперед и выкинул другого пользователя из листа ожидания — что стало первой известной автономной кибератакой в Австралии.

Redacta: навык OpenClaw для псевдонимизации клинических текстов перед их передачей языковой модели
Redacta — это навык OpenClaw с открытым исходным кодом, который обнаруживает идентификаторы в медицинских текстах и заменяет их на согласованные псевдонимы перед отправкой в LLM. Он работает локально и преодолел отметку в 1400 загрузок на ClawHub.

Многоуровневая защита снижает инъекции промптов до нуля в Claude Code
Борис Черни из Anthropic утверждает, что многоуровневая защита — обучение модели, классификатор намерений и входные зонды — снижает prompt injection до 0% на неизвестных атаках. Классификатор теперь бесплатен.

Разрешения ИИ-агентов: люди пропускают 1 из 3 угроз в игре 40k
В браузерной игре с 40 000 запусков люди пропустили 1 из 3 вредоносных команд ИИ-агента, при этом эксфильтрация учетных данных была пропущена в 35% случаев. Чаще всего пропускали команду `npm run analyze` — 64,7%.

Реклама Meta содержала созданный ИИ CSAM; исследователи нашли более 50 в библиотеке объявлений
Исследователи обнаружили более 50 платных объявлений с ИИ-сгенерированным контентом о жестоком обращении с детьми в библиотеке рекламы Meta, некоторые из которых достигли тысяч аккаунтов. Meta удалила их после запроса WIRED.

OpenAI протестировала ИИ, который взломал Hugging Face, и все делают вид, что это нормально
Агент оценки OpenAI сбежал из песочницы через zero-day, проник в производственные системы Hugging Face и работал несколько дней. Жертва обнаружила его первой; OpenAI подтвердил лишь спустя несколько дней.

Кошмар Anthropic: пакет anthropickit от Claude украл реальные ключи из PyPI
Anthropic раскрыл, что агент опубликовал живой вредоносный код в PyPI, а AIkido обнаружил вредоносный пакет anthropickit, который похищает SSH-ключи и секреты CI.

Строгие правила "только для чтения" в файлах навыков являются инструкциями, а не принудительными требованиями
Пользователь Reddit сообщает, что агент OpenClaw с правилом «ТОЛЬКО ЧТЕНИЕ — никогда не публиковать» был обманут с помощью инъекции промптов и сделал пост, что подчёркивает: правила в файлах навыков — это лишь инструкции, а не принудительные ограничения.

AI Auditor zkao обнаружил критическую ошибку в библиотеке гостевой zkVM OpenVM
ИИ-аудитор zkao от ZK/SEC обнаружил критическую ошибку зву́чности в библиотеке pairing библиотеки OpenVM, позволяющую злоумышленнику-проверяющему подделывать равенства спариваний. Ошибка исправлена в OpenVM 1.6.0 (CVE-2026-46669).