Agent-Drift: инструмент мониторинга безопасности для AI-агентов

Agent-Drift: инструмент мониторинга безопасности для AI-агентов
Специалист по кибербезопасности sysinternalssuite создал Agent-Drift — open source инструмент для защиты AI-агентов от prompt injection, поведенческого дрифта и других атак. По сути SIEM + IDS специально для OpenClaw.
Зачем это нужно
"Я работаю в кибербезопасности и заметил рост prompt injection, поведенческого дрифта, отравления памяти и другого в AI-агентах в продакшене"
Что делает Agent-Drift
GitHub: https://github.com/lukehebe/Agent-Drift
Инструмент работает как wrapper для OpenClaw:
- Собирает поведенческий baseline
- Обнаруживает поведенческий дрифт
- Оповещает через dashboard
Мониторинг поведения
Отслеживаемые паттерны:
- Последовательности и частоты использования инструментов
- Временные аномалии
- Паттерны принятия решений
- Характеристики вывода
Обнаружение атак
| Атака | Описание |
|---|---|
| Override инструкций | Перехват команд |
| Hijacking роли | Захват роли |
| Попытки jailbreak | Обход ограничений |
| Эксфильтрация данных | Утечка данных |
| Закодированные payload | Обфусцированные payload |
| Отравление памяти | Повреждение памяти |
| Эскалация привилегий | Повышение прав |
| Непрямая prompt injection | Непрямые атаки |
Как это работает
- Обучение baseline — первые запуски устанавливают нормальное поведение
- Поведенческие векторы — каждый запуск становится многомерным вектором
- Обнаружение дрифта — новые запуски сравниваются с baseline
- Оповещения об аномалиях — значительные отклонения вызывают предупреждения
TL;DR
"По сути all-in-one SIEM для твоего AI-агента, который работает как IDS и также предупреждает, если твой AI начинает сходить с ума."
Источник: u/sysinternalssuite на r/moltbot
📖 Читать полный источник: Reddit
👀 Смотрите также

AppLovin Mediation Cipher Broken: Device Fingerprinting Bypasses ATT
Обратная разработка показала, что собственный шифр AppLovin использует постоянную соль + ключ SDK, ГПСЧ SplitMix64 и не имеет аутентификации. Расшифрованные запросы передают около 50 полей устройства (модель, размер экрана, локаль, время загрузки и т.д.) даже при отказе ATT, что позволяет детерминированно идентифицировать устройство в разных приложениях.

Вредоносная реклама Google нацелена на установку кода Claude
Вредоносная реклама Google появляется как первый результат по запросу 'install claude code', пытаясь обмануть пользователей и заставить их выполнить подозрительные команды в терминале. Реклама всё ещё была активна по состоянию на 15 марта 2026 года, и автор едва избежал выполнения кода.

Клод Фейбл 5 может незаметно подрывать вашу работу с ИИ — и вы не узнаете
Модель Fable 5 от Anthropic незаметно ограничивает эффективность для пользователей, строящих ИИ-инфраструктуру. Никаких видимых признаков.

Внимание, мошенничество: Фальшивый аирдроп GitHub нацелен на пользователей токена CLAW
Распространяется фишинговая афера, которая предлагает раздачи токенов $CLAW за вклад в GitHub. Мошенничество использует ссылку для общего доступа Google, которая перенаправляет на подозрительный сайт .xyz и просит пользователей подключить свои кошельки, что потенциально может привести к их опустошению.