Оценка AISI демонстрирует кибервозможности Claude Mythos Preview в CTF и многошаговых атаках.

✍️ OpenClawRadar📅 Опубликовано: 16 апреля 2026 г.🔗 Source
Оценка AISI демонстрирует кибервозможности Claude Mythos Preview в CTF и многошаговых атаках.
Ad

Институт искусственного интеллекта и безопасности (AISI) провёл кибероценки предварительной версии Claude Mythos от Anthropic, оценив её производительность в заданиях типа "захват флага" и многошаговых симуляциях атак. Модель показала значительное улучшение по сравнению с предыдущими передовыми моделями в области кибербезопасности.

Результаты "Захвата флага"

В заданиях CTF, где модели должны идентифицировать и использовать уязвимости для получения скрытых флагов, Mythos Preview достигла 73% успеха на экспертных задачах. Эти задачи экспертного уровня до апреля 2025 года не могла выполнить ни одна модель. Оценка сравнивала производительность на разных уровнях сложности — от технического неспециалиста до эксперта, при этом модели тестировались с использованием бюджетов токенов до 50 миллионов.

Ad

Результаты киберполигона

AISI создал "Последних" (TLO) — 32-шаговую симуляцию атаки на корпоративную сеть, охватывающую от первоначальной разведки до полного захвата сети, на выполнение которой, по оценкам, человеку потребовалось бы 20 часов. Claude Mythos Preview стала первой моделью, решившей TLO от начала до конца, добившись успеха в 3 из 10 попыток. В среднем по всем попыткам модель завершала 22 из 32 шагов.

Следующей по производительности моделью был Claude Opus 4.6, который в среднем завершал 16 шагов. Оценка использовала бюджеты токенов до 100 миллионов, причём производительность продолжала расти вплоть до этого предела.

Ограничения и контекст

Модель не смогла завершить киберполигон "Охлаждающая башня", ориентированный на операционные технологии, хотя она застряла на разделах IT, а не на специфичных для OT частях. AISI отмечает, что два года назад лучшие доступные модели едва справлялись с задачами кибербезопасности начального уровня, тогда как сейчас, в контролируемых оценках, где Mythos Preview была явно направлена и получила доступ к сети, она могла выполнять многоэтапные атаки на уязвимые сети, а также самостоятельно обнаруживать и использовать уязвимости.

📖 Прочитать полный источник: HN AI Agents

Ad

👀 Смотрите также

Coldkey: Генерация ключей постквантовой эры и инструмент для бумажного резервного копирования
Безопасность

Coldkey: Генерация ключей постквантовой эры и инструмент для бумажного резервного копирования

Coldkey генерирует постквантовые ключи age (ML-KEM-768 + X25519) и создает одностраничные печатные резервные копии HTML с QR-кодами для автономного хранения.

OpenClawRadar
Уязвимость удаленного выполнения кода в ядре FreeBSD через переполнение буфера стека в kgssapi.ko (CVE-2026-4747)
Безопасность

Уязвимость удаленного выполнения кода в ядре FreeBSD через переполнение буфера стека в kgssapi.ko (CVE-2026-4747)

Переполнение буфера стека в модуле kgssapi.ko FreeBSD позволяет удалённое выполнение кода в ядре с получением root-доступа через NFS-сервер. Уязвимость затрагивает версии FreeBSD 13.5, 14.3, 14.4 и 15.0 до установки определённых патчей.

OpenClawRadar
Консультация по безопасности Claude Code: CVE-2026-33068 Обход проверки доверия рабочей области
Безопасность

Консультация по безопасности Claude Code: CVE-2026-33068 Обход проверки доверия рабочей области

Версии Claude Code до 2.1.53 содержат уязвимость (CVE-2026-33068, CVSS 7.7 ВЫСОКИЙ), позволяющую вредоносным репозиториям обходить подтверждение доверия к рабочей области через файл .claude/settings.json. Ошибка позволяла загружать настройки репозитория до принятия пользователем решения о доверии.

OpenClawRadar
ThornGuard: Прокси-шлюз для защиты подключений к серверам MCP от инъекций в промпты
Безопасность

ThornGuard: Прокси-шлюз для защиты подключений к серверам MCP от инъекций в промпты

ThornGuard — это прокси, который располагается между клиентами MCP и вышестоящими серверами, сканирует трафик на наличие шаблонов внедрения, удаляет персональные данные и ведёт логирование в панели управления. Он был создан после того, как тестирование выявило уязвимости, позволяющие серверам встраивать скрытые инструкции в ответы инструментов.

OpenClawRadar