エージェント・ドリフト:AIエージェント向けセキュリティ監視ツール

✍️ u/sysinternalssuite📅 公開日: February 7, 2026🔗 Source
エージェント・ドリフト:AIエージェント向けセキュリティ監視ツール
Ad

Agent-Drift: AIエージェント向けセキュリティ監視ツール

サイバーセキュリティ専門家sysinternalssuiteがAgent-Driftを作成しました。これは、プロンプトインジェクション、行動ドリフト、その他の攻撃からAIエージェントを保護するオープンソースツールです。本質的には、OpenClaw専用のSIEM + IDSです。

なぜこれが必要か

「私はサイバーセキュリティ分野で働いており、AIエージェントに対するプロンプトインジェクション、行動ドリフト、メモリ汚染などの攻撃が実際に増加していることに気づきました」

Agent-Driftの機能

GitHub: https://github.com/lukehebe/Agent-Drift

このツールはOpenClawのラッパーとして機能します:

  1. 行動ベースラインを収集
  2. 行動ドリフトを検出
  3. ダッシュボードを通じてアラート

行動監視

追跡されるパターン:

  • ツール使用の順序と頻度
  • タイミングの異常
  • 決定パターン
  • 出力特性
Ad

攻撃検出

攻撃 説明
命令の上書き コマンドの乗っ取り
役割の乗っ取り 役割の奪取
脱獄試行 制限の回避
データ流出 データ漏洩
エンコードされたペイロード 難読化されたペイロード
メモリ汚染 メモリ破損
権限昇格 権限の向上
間接的なプロンプトインジェクション 間接的な攻撃

仕組み

  1. ベースライン学習 — 最初の実行で通常の行動を確立
  2. 行動ベクトル — 各実行が多次元ベクトルになる
  3. ドリフト検出 — 新しい実行をベースラインと比較
  4. 異常アラート — 大きな逸脱が警告をトリガー

要約

「基本的には、AIエージェント向けのオールインワンセキュリティインシデントイベントマネージャー(SIEM)であり、侵入検知システム(IDS)として機能し、AIが異常な行動を始めた場合にも警告します。」


出典: u/sysinternalssuite on r/moltbot

📖 全文を読む: Reddit

Ad

👀 See Also

OpenClawセキュリティ侵害:CEOのエージェントが2万5千ドルで売却、13万5千インスタンスが暴露
Security

OpenClawセキュリティ侵害:CEOのエージェントが2万5千ドルで売却、13万5千インスタンスが暴露

英国CEOのOpenClawインスタンスがBreachForumsで25,000ドルで売却され、会話、本番データベース、APIキー、個人情報を含むプレーンテキストMarkdownファイルが流出しました。SecurityScorecardは、安全でないデフォルト設定で公開されている135,000のOpenClawインスタンスを発見しました。

OpenClawRadar
OpenClawのプロンプトインジェクション防御用外部コンテンツラッパー
Security

OpenClawのプロンプトインジェクション防御用外部コンテンツラッパー

OpenClawは外部コンテンツラッパーを使用しており、ウェブ検索結果、APIレスポンス、および類似のコンテンツに自動的に警告タグを付けて信頼できないものとしてマークし、LLMが疑いを持ち、悪意のある指示を拒否しやすくします。

OpenClawRadar
Claudeのソースコードマップ漏洩により、縮小化されたJavaScriptがすでにnpmで公開されていたことが明らかになりました
Security

Claudeのソースコードマップ漏洩により、縮小化されたJavaScriptがすでにnpmで公開されていたことが明らかになりました

@anthropic-ai/claude-code npmパッケージのバージョン2.1.88に誤って含まれたソースマップファイルにより内部開発者コメントが明らかになったが、実際の13MBのcli.jsファイル(148,000以上のプレーンテキスト文字列を含む)はリリース当初からnpmで公開されていた。

OpenClawRadar
AIエージェントのセキュリティギャップ:Supra-Wallがモデルとツールの間に追加する強制レイヤー
Security

AIエージェントのセキュリティギャップ:Supra-Wallがモデルとツールの間に追加する強制レイヤー

ある開発者が、Stripeキーやデータベースパスワード、OpenAI APIキーを含む機密.envファイルをAIエージェントが自律的に読み取ったことを発見しました。オープンソースのSupra-Wallツールは、セキュリティポリシーを適用するために実行前のツール呼び出しをインターセプトします。

OpenClawRadar