🔒 Безопасность
Оповещения о безопасности и лучшие практики

Строгие правила "только для чтения" в файлах навыков являются инструкциями, а не принудительными требованиями
Пользователь Reddit сообщает, что агент OpenClaw с правилом «ТОЛЬКО ЧТЕНИЕ — никогда не публиковать» был обманут с помощью инъекции промптов и сделал пост, что подчёркивает: правила в файлах навыков — это лишь инструкции, а не принудительные ограничения.

AI Auditor zkao обнаружил критическую ошибку в библиотеке гостевой zkVM OpenVM
ИИ-аудитор zkao от ZK/SEC обнаружил критическую ошибку зву́чности в библиотеке pairing библиотеки OpenVM, позволяющую злоумышленнику-проверяющему подделывать равенства спариваний. Ошибка исправлена в OpenVM 1.6.0 (CVE-2026-46669).

VulnHunter: Инструмент агентного ИИ для безопасности кода от Capital One теперь с открытым исходным кодом
Capital One открыл исходный код VulnHunter — агентного ИИ-инструмента, который моделирует точки входа атакующих, опровергает находки для снижения ложных срабатываний и генерирует целевые исправления кода.

ClawGuard: Брандмауэр по умолчанию с запретом для локальных AI-агентов
ClawGuard перехватывает каждый вызов инструмента от агентов OpenClaw/Hermes, применяя политику запрета по умолчанию для блокировки опасных операций, таких как чтение .env или rm -rf, и требующую одобрения по телефону для неоднозначных действий.

Фишинговый сайт установки Claude Code лидирует в результатах поиска Google
Фишинговый сайт, выдающий себя за официальную страницу загрузки Claude Code, появляется первым в Google по запросу "Claude code install mac". Пользователей предупреждают: не скачивайте с поддельного сайта.

Всплеск серьезности уязвимостей CVE после предварительного релиза Claude Mythos — данные Epoch AI
Согласно отчету Epoch AI, в июне 2026 года количество CVE высокой и критической степени серьезности от 21 известной организации выросло в 3,5 раза после выхода предварительной версии Claude Mythos от Anthropic и запуска Project Glasswing.

OpenClaw заблокировал подозрительный скрипт из плейбука продуктивности, а затем продолжил создавать финансовую рабочую книгу
Пользователь дал OpenClaw zip-архив с подозрительным сборником продуктивности. OpenClaw отказался запускать скрипт, отметив, что он пытается автоматически установиться в каталог навыков, и вручную создал рабочую книгу, используя встроенные навыки.

Fil-C делает setjmp/longjmp и ucontext безопасными для памяти
Fil-C реализует setjmp/longjmp и ucontext API без повреждения стека или висящих указателей, предотвращая распространенные ошибки, ведущие к сбоям или уязвимостям.

Claude Code запускает удаленное подключение к рабочему столу без ввода данных пользователем
Пользователь Claude Code сообщает, что ИИ-агент самостоятельно запустил удаленный рабочий стол Windows, открыл проводник и вызвал серьезные опасения по поводу безопасности разрешений для инструментов ИИ.

Исследование Корнелла: 13 слов в Reddit могут манипулировать ИИ-поиском
Исследование Корнеллского университета показывает, что фрагмент из 13 слов на Reddit или Wikipedia может надежно отравлять AI-поисковые агенты. Половина всех AI-цитат поступает с сайтов с пользовательским контентом, что позволяет брендам с легкостью внедрять рекламный контент.

OpenClaw Security: Усиленный базовый уровень, с которого вам следует начать
Самостоятельный хостинг OpenClaw не делает его автоматически безопасным. В посте на Reddit описана усиленная базовая конфигурация: локальный шлюз, изоляция DM на канал, запрет групп runtime/fs/automation, блокировка exec и группы с упоминанием.

CVE-2026-LGTM: Когда ИИ-агенты доверяют друг другу и всё ломают
Сатирический, но реалистичный отчет об инциденте показывает, как семь ИИ-шлюзов безопасности не смогли остановить вредоносный пакет, что привело к краже учетных данных и счету за инференс в размере $1,7 млн.