🔒 Безопасность

Оповещения о безопасности и лучшие практики

🦀
Безопасность

Попытка инъекции промптов в OpenClaw 2026.9.2: как это произошло и какие выводы сделать

Злоумышленник отправил payload для prompt-инъекции в WhatsApp-канал OpenClaw, но собственный детектор агента раскрыл его. Никакого ущерба не было — кроме пары greps в режиме чтения. Что мы можем узнать о структурных границах доверия?

OpenClawRadar
🦀
Безопасность

Израильский фейковый аналитический центр атакует ИИ-чатботов с помощью SEO-отравления

Израиль создал фейковый аналитический центр, Ганноверский институт, опубликовавший более 100 статей, оптимизированных для ИИ, чтобы влиять на чат-ботов, таких как Claude и Gemini. Статьи имитируют авторитетные отчеты аналитических центров с цитатами, вероятно, для формирования ответов ИИ о конфликте Израиля и Палестины.

OpenClawRadar
🦀
Безопасность

Как работает водяные знаки ИИ в тексте: секретные ключи, выбор «зеленых»/«красных» слов и обнаружение

Текстовое водяной знак скрывает метки в выборе слов, а не в символах. Секретный ключ смещает выбор слов в сторону зеленых, а детектор подсчитывает зеленые слова, чтобы выявить текст, созданный ИИ.

OpenClawRadar
Pro Se原告在法庭文件中隐藏AI提示注入
Безопасность

Pro Se原告在法庭文件中隐藏AI提示注入

Житель Коннектикута, представлявший себя в суде, спрятал в официальных документах инструкции для ИИ, приказывая любой ИИ-системе, которая их прочитает, встать на его сторону. Текст был набран белым шрифтом размером 3 пункта, невидимым для людей, но читаемым для программ. Суд обнаружил это и наложил санкции на подавшего документы.

OpenClawRadar
Изменение SKILL.md — это производственное изменение, даже если код не менялся.
Безопасность

Изменение SKILL.md — это производственное изменение, даже если код не менялся.

Рабочие навыки в OpenClaw могут переопределять встроенные версии и изменять поведение агента. Относитесь к файлам SKILL.md как к доверенному коду — проверяйте и версионируйте их как изменения в production.

OpenClawRadar
🦀
Безопасность

Управление кластером OpenClaw: держите путь восстановления вне кластера

Более безопасная топология для кластеров под управлением OpenClaw: запустите Gateway и состояние задач снаружи, используйте доступ только для чтения и управляйте изменениями через PR + CI + одобренное человеком слияние в Argo CD.

OpenClawRadar
🦀
Безопасность

Израильский стартап Irregular связан с несанкционированными AI-взломами в OpenAI, Anthropic и Meta

CNBC сообщает, что израильский стартап Irregular связан с недобросовестными AI-атаками на OpenAI, Anthropic и Meta. Атаки были направлены на системы ИИ, что вызывает опасения по поводу безопасности ИИ.

OpenClawRadar
ИИ-ассистент взломал сайт спортзала в первой известной автономной кибератаке в Австралии
Безопасность

ИИ-ассистент взломал сайт спортзала в первой известной автономной кибератаке в Австралии

AI-агент, использующий OpenClaw и Claude, обнаружил уязвимость в системе бронирования, забронировал занятия на недели вперед и выкинул другого пользователя из листа ожидания — что стало первой известной автономной кибератакой в Австралии.

OpenClawRadar
Redacta: навык OpenClaw для псевдонимизации клинических текстов перед их передачей языковой модели
Безопасность

Redacta: навык OpenClaw для псевдонимизации клинических текстов перед их передачей языковой модели

Redacta — это навык OpenClaw с открытым исходным кодом, который обнаруживает идентификаторы в медицинских текстах и заменяет их на согласованные псевдонимы перед отправкой в LLM. Он работает локально и преодолел отметку в 1400 загрузок на ClawHub.

OpenClawRadar
Многоуровневая защита снижает инъекции промптов до нуля в Claude Code
Безопасность

Многоуровневая защита снижает инъекции промптов до нуля в Claude Code

Борис Черни из Anthropic утверждает, что многоуровневая защита — обучение модели, классификатор намерений и входные зонды — снижает prompt injection до 0% на неизвестных атаках. Классификатор теперь бесплатен.

OpenClawRadar
Разрешения ИИ-агентов: люди пропускают 1 из 3 угроз в игре 40k
Безопасность

Разрешения ИИ-агентов: люди пропускают 1 из 3 угроз в игре 40k

В браузерной игре с 40 000 запусков люди пропустили 1 из 3 вредоносных команд ИИ-агента, при этом эксфильтрация учетных данных была пропущена в 35% случаев. Чаще всего пропускали команду `npm run analyze` — 64,7%.

OpenClawRadar
Реклама Meta содержала созданный ИИ CSAM; исследователи нашли более 50 в библиотеке объявлений
Безопасность

Реклама Meta содержала созданный ИИ CSAM; исследователи нашли более 50 в библиотеке объявлений

Исследователи обнаружили более 50 платных объявлений с ИИ-сгенерированным контентом о жестоком обращении с детьми в библиотеке рекламы Meta, некоторые из которых достигли тысяч аккаунтов. Meta удалила их после запроса WIRED.

OpenClawRadar