エージェント・ドリフト:AIエージェント向けセキュリティ監視ツール

✍️ u/sysinternalssuite📅 公開日: February 7, 2026🔗 Source
エージェント・ドリフト:AIエージェント向けセキュリティ監視ツール
Ad

Agent-Drift: AIエージェント向けセキュリティ監視ツール

サイバーセキュリティ専門家sysinternalssuiteがAgent-Driftを作成しました。これは、プロンプトインジェクション、行動ドリフト、その他の攻撃からAIエージェントを保護するオープンソースツールです。本質的には、OpenClaw専用のSIEM + IDSです。

なぜこれが必要か

「私はサイバーセキュリティ分野で働いており、AIエージェントに対するプロンプトインジェクション、行動ドリフト、メモリ汚染などの攻撃が実際に増加していることに気づきました」

Agent-Driftの機能

GitHub: https://github.com/lukehebe/Agent-Drift

このツールはOpenClawのラッパーとして機能します:

  1. 行動ベースラインを収集
  2. 行動ドリフトを検出
  3. ダッシュボードを通じてアラート

行動監視

追跡されるパターン:

  • ツール使用の順序と頻度
  • タイミングの異常
  • 決定パターン
  • 出力特性
Ad

攻撃検出

攻撃 説明
命令の上書き コマンドの乗っ取り
役割の乗っ取り 役割の奪取
脱獄試行 制限の回避
データ流出 データ漏洩
エンコードされたペイロード 難読化されたペイロード
メモリ汚染 メモリ破損
権限昇格 権限の向上
間接的なプロンプトインジェクション 間接的な攻撃

仕組み

  1. ベースライン学習 — 最初の実行で通常の行動を確立
  2. 行動ベクトル — 各実行が多次元ベクトルになる
  3. ドリフト検出 — 新しい実行をベースラインと比較
  4. 異常アラート — 大きな逸脱が警告をトリガー

要約

「基本的には、AIエージェント向けのオールインワンセキュリティインシデントイベントマネージャー(SIEM)であり、侵入検知システム(IDS)として機能し、AIが異常な行動を始めた場合にも警告します。」


出典: u/sysinternalssuite on r/moltbot

📖 全文を読む: Reddit

Ad

👀 See Also

OpenClawセキュリティ強化:自律エージェントリスクに対する多層防御
Security

OpenClawセキュリティ強化:自律エージェントリスクに対する多層防御

開発者は、自律エージェントによる破壊的なコマンドやデータ流出を防ぐため、ハードデニー正規表現ガード、再帰的難読化解除ツール、AppArmorプロファイル、監査統合を含む多層セキュリティスタックをOpenClawのコードベースに追加しました。

OpenClawRadar
🦀
Security

OpenClaw、OpenAIのPatch the Planetを通じてTrail of Bitsとのセキュリティ監査を完了

OpenClawはOpenAIの「Patch the Planet」イニシアチブの一環として、Trail of Bitsによるセキュリティ監査を完了しました。エージェントのタスク実行中に権限が変更された場合の挙動を含む内容で、対応可能なすべての問題は安定版リリースで修正済みです。

OpenClawRadar
AISI評価により、Claude MythosプレビューのCTFおよび多段階攻撃におけるサイバー能力が示される
Security

AISI評価により、Claude MythosプレビューのCTFおよび多段階攻撃におけるサイバー能力が示される

AIセキュリティ研究所はAnthropicのClaude Mythos Previewを評価し、専門家レベルのキャプチャー・ザ・フラッグ課題の73%を成功裏に完了し、32段階の企業ネットワーク攻撃シミュレーションを10回中3回で解決したことを確認しました。

OpenClawRadar
McpVanguardプロキシがOpenClawスキルデータの外部流出をブロック
Security

McpVanguardプロキシがOpenClawスキルデータの外部流出をブロック

CiscoのAIセキュリティチームがサードパーティ製OpenClawスキルによるサイレントデータ流出とプロンプトインジェクションを発見したことを受け、開発者がMcpVanguardをリリースしました。これはAIエージェントとそのツールの間に配置され、悪意のある呼び出しが実行される前にブロックするプロキシです。

OpenClawRadar