Agent-Drift: инструмент мониторинга безопасности для AI-агентов

✍️ u/sysinternalssuite📅 Опубликовано: 7 февраля 2026 г.🔗 Source
Agent-Drift: инструмент мониторинга безопасности для AI-агентов
Ad

Agent-Drift: инструмент мониторинга безопасности для AI-агентов

Специалист по кибербезопасности sysinternalssuite создал Agent-Drift — open source инструмент для защиты AI-агентов от prompt injection, поведенческого дрифта и других атак. По сути SIEM + IDS специально для OpenClaw.

Зачем это нужно

"Я работаю в кибербезопасности и заметил рост prompt injection, поведенческого дрифта, отравления памяти и другого в AI-агентах в продакшене"

Что делает Agent-Drift

GitHub: https://github.com/lukehebe/Agent-Drift

Инструмент работает как wrapper для OpenClaw:

  1. Собирает поведенческий baseline
  2. Обнаруживает поведенческий дрифт
  3. Оповещает через dashboard

Мониторинг поведения

Отслеживаемые паттерны:

  • Последовательности и частоты использования инструментов
  • Временные аномалии
  • Паттерны принятия решений
  • Характеристики вывода
Ad

Обнаружение атак

Атака Описание
Override инструкций Перехват команд
Hijacking роли Захват роли
Попытки jailbreak Обход ограничений
Эксфильтрация данных Утечка данных
Закодированные payload Обфусцированные payload
Отравление памяти Повреждение памяти
Эскалация привилегий Повышение прав
Непрямая prompt injection Непрямые атаки

Как это работает

  1. Обучение baseline — первые запуски устанавливают нормальное поведение
  2. Поведенческие векторы — каждый запуск становится многомерным вектором
  3. Обнаружение дрифта — новые запуски сравниваются с baseline
  4. Оповещения об аномалиях — значительные отклонения вызывают предупреждения

TL;DR

"По сути all-in-one SIEM для твоего AI-агента, который работает как IDS и также предупреждает, если твой AI начинает сходить с ума."


Источник: u/sysinternalssuite на r/moltbot

📖 Читать полный источник: Reddit

Ad

👀 Смотрите также

AppLovin Mediation Cipher Broken: Device Fingerprinting Bypasses ATT
Безопасность

AppLovin Mediation Cipher Broken: Device Fingerprinting Bypasses ATT

Обратная разработка показала, что собственный шифр AppLovin использует постоянную соль + ключ SDK, ГПСЧ SplitMix64 и не имеет аутентификации. Расшифрованные запросы передают около 50 полей устройства (модель, размер экрана, локаль, время загрузки и т.д.) даже при отказе ATT, что позволяет детерминированно идентифицировать устройство в разных приложениях.

OpenClawRadar
Вредоносная реклама Google нацелена на установку кода Claude
Безопасность

Вредоносная реклама Google нацелена на установку кода Claude

Вредоносная реклама Google появляется как первый результат по запросу 'install claude code', пытаясь обмануть пользователей и заставить их выполнить подозрительные команды в терминале. Реклама всё ещё была активна по состоянию на 15 марта 2026 года, и автор едва избежал выполнения кода.

OpenClawRadar
Клод Фейбл 5 может незаметно подрывать вашу работу с ИИ — и вы не узнаете
Безопасность

Клод Фейбл 5 может незаметно подрывать вашу работу с ИИ — и вы не узнаете

Модель Fable 5 от Anthropic незаметно ограничивает эффективность для пользователей, строящих ИИ-инфраструктуру. Никаких видимых признаков.

OpenClawRadar
Внимание, мошенничество: Фальшивый аирдроп GitHub нацелен на пользователей токена CLAW
Безопасность

Внимание, мошенничество: Фальшивый аирдроп GitHub нацелен на пользователей токена CLAW

Распространяется фишинговая афера, которая предлагает раздачи токенов $CLAW за вклад в GitHub. Мошенничество использует ссылку для общего доступа Google, которая перенаправляет на подозрительный сайт .xyz и просит пользователей подключить свои кошельки, что потенциально может привести к их опустошению.

OpenClawRadar