エージェント・ドリフト:AIエージェント向けセキュリティ監視ツール

Agent-Drift: AIエージェント向けセキュリティ監視ツール
サイバーセキュリティ専門家sysinternalssuiteがAgent-Driftを作成しました。これは、プロンプトインジェクション、行動ドリフト、その他の攻撃からAIエージェントを保護するオープンソースツールです。本質的には、OpenClaw専用のSIEM + IDSです。
なぜこれが必要か
「私はサイバーセキュリティ分野で働いており、AIエージェントに対するプロンプトインジェクション、行動ドリフト、メモリ汚染などの攻撃が実際に増加していることに気づきました」
Agent-Driftの機能
GitHub: https://github.com/lukehebe/Agent-Drift
このツールはOpenClawのラッパーとして機能します:
- 行動ベースラインを収集
- 行動ドリフトを検出
- ダッシュボードを通じてアラート
行動監視
追跡されるパターン:
- ツール使用の順序と頻度
- タイミングの異常
- 決定パターン
- 出力特性
攻撃検出
| 攻撃 | 説明 |
|---|---|
| 命令の上書き | コマンドの乗っ取り |
| 役割の乗っ取り | 役割の奪取 |
| 脱獄試行 | 制限の回避 |
| データ流出 | データ漏洩 |
| エンコードされたペイロード | 難読化されたペイロード |
| メモリ汚染 | メモリ破損 |
| 権限昇格 | 権限の向上 |
| 間接的なプロンプトインジェクション | 間接的な攻撃 |
仕組み
- ベースライン学習 — 最初の実行で通常の行動を確立
- 行動ベクトル — 各実行が多次元ベクトルになる
- ドリフト検出 — 新しい実行をベースラインと比較
- 異常アラート — 大きな逸脱が警告をトリガー
要約
「基本的には、AIエージェント向けのオールインワンセキュリティインシデントイベントマネージャー(SIEM)であり、侵入検知システム(IDS)として機能し、AIが異常な行動を始めた場合にも警告します。」
出典: u/sysinternalssuite on r/moltbot
📖 全文を読む: Reddit
👀 See Also

OpenClawセキュリティ侵害:CEOのエージェントが2万5千ドルで売却、13万5千インスタンスが暴露
英国CEOのOpenClawインスタンスがBreachForumsで25,000ドルで売却され、会話、本番データベース、APIキー、個人情報を含むプレーンテキストMarkdownファイルが流出しました。SecurityScorecardは、安全でないデフォルト設定で公開されている135,000のOpenClawインスタンスを発見しました。

OpenClawのプロンプトインジェクション防御用外部コンテンツラッパー
OpenClawは外部コンテンツラッパーを使用しており、ウェブ検索結果、APIレスポンス、および類似のコンテンツに自動的に警告タグを付けて信頼できないものとしてマークし、LLMが疑いを持ち、悪意のある指示を拒否しやすくします。

Claudeのソースコードマップ漏洩により、縮小化されたJavaScriptがすでにnpmで公開されていたことが明らかになりました
@anthropic-ai/claude-code npmパッケージのバージョン2.1.88に誤って含まれたソースマップファイルにより内部開発者コメントが明らかになったが、実際の13MBのcli.jsファイル(148,000以上のプレーンテキスト文字列を含む)はリリース当初からnpmで公開されていた。

AIエージェントのセキュリティギャップ:Supra-Wallがモデルとツールの間に追加する強制レイヤー
ある開発者が、Stripeキーやデータベースパスワード、OpenAI APIキーを含む機密.envファイルをAIエージェントが自律的に読み取ったことを発見しました。オープンソースのSupra-Wallツールは、セキュリティポリシーを適用するために実行前のツール呼び出しをインターセプトします。