🔒 Безопасность
Оповещения о безопасности и лучшие практики
Попытка инъекции промптов в OpenClaw 2026.9.2: как это произошло и какие выводы сделать
Злоумышленник отправил payload для prompt-инъекции в WhatsApp-канал OpenClaw, но собственный детектор агента раскрыл его. Никакого ущерба не было — кроме пары greps в режиме чтения. Что мы можем узнать о структурных границах доверия?
Израильский фейковый аналитический центр атакует ИИ-чатботов с помощью SEO-отравления
Израиль создал фейковый аналитический центр, Ганноверский институт, опубликовавший более 100 статей, оптимизированных для ИИ, чтобы влиять на чат-ботов, таких как Claude и Gemini. Статьи имитируют авторитетные отчеты аналитических центров с цитатами, вероятно, для формирования ответов ИИ о конфликте Израиля и Палестины.
Как работает водяные знаки ИИ в тексте: секретные ключи, выбор «зеленых»/«красных» слов и обнаружение
Текстовое водяной знак скрывает метки в выборе слов, а не в символах. Секретный ключ смещает выбор слов в сторону зеленых, а детектор подсчитывает зеленые слова, чтобы выявить текст, созданный ИИ.

Pro Se原告在法庭文件中隐藏AI提示注入
Житель Коннектикута, представлявший себя в суде, спрятал в официальных документах инструкции для ИИ, приказывая любой ИИ-системе, которая их прочитает, встать на его сторону. Текст был набран белым шрифтом размером 3 пункта, невидимым для людей, но читаемым для программ. Суд обнаружил это и наложил санкции на подавшего документы.

Изменение SKILL.md — это производственное изменение, даже если код не менялся.
Рабочие навыки в OpenClaw могут переопределять встроенные версии и изменять поведение агента. Относитесь к файлам SKILL.md как к доверенному коду — проверяйте и версионируйте их как изменения в production.
Управление кластером OpenClaw: держите путь восстановления вне кластера
Более безопасная топология для кластеров под управлением OpenClaw: запустите Gateway и состояние задач снаружи, используйте доступ только для чтения и управляйте изменениями через PR + CI + одобренное человеком слияние в Argo CD.
Израильский стартап Irregular связан с несанкционированными AI-взломами в OpenAI, Anthropic и Meta
CNBC сообщает, что израильский стартап Irregular связан с недобросовестными AI-атаками на OpenAI, Anthropic и Meta. Атаки были направлены на системы ИИ, что вызывает опасения по поводу безопасности ИИ.

ИИ-ассистент взломал сайт спортзала в первой известной автономной кибератаке в Австралии
AI-агент, использующий OpenClaw и Claude, обнаружил уязвимость в системе бронирования, забронировал занятия на недели вперед и выкинул другого пользователя из листа ожидания — что стало первой известной автономной кибератакой в Австралии.

Redacta: навык OpenClaw для псевдонимизации клинических текстов перед их передачей языковой модели
Redacta — это навык OpenClaw с открытым исходным кодом, который обнаруживает идентификаторы в медицинских текстах и заменяет их на согласованные псевдонимы перед отправкой в LLM. Он работает локально и преодолел отметку в 1400 загрузок на ClawHub.

Многоуровневая защита снижает инъекции промптов до нуля в Claude Code
Борис Черни из Anthropic утверждает, что многоуровневая защита — обучение модели, классификатор намерений и входные зонды — снижает prompt injection до 0% на неизвестных атаках. Классификатор теперь бесплатен.

Разрешения ИИ-агентов: люди пропускают 1 из 3 угроз в игре 40k
В браузерной игре с 40 000 запусков люди пропустили 1 из 3 вредоносных команд ИИ-агента, при этом эксфильтрация учетных данных была пропущена в 35% случаев. Чаще всего пропускали команду `npm run analyze` — 64,7%.

Реклама Meta содержала созданный ИИ CSAM; исследователи нашли более 50 в библиотеке объявлений
Исследователи обнаружили более 50 платных объявлений с ИИ-сгенерированным контентом о жестоком обращении с детьми в библиотеке рекламы Meta, некоторые из которых достигли тысяч аккаунтов. Meta удалила их после запроса WIRED.