AIエージェントのセキュリティギャップ:Supra-Wallがモデルとツールの間に追加する強制レイヤー

✍️ OpenClawRadar📅 公開日: April 1, 2026🔗 Source
AIエージェントのセキュリティギャップ:Supra-Wallがモデルとツールの間に追加する強制レイヤー
Ad

標準的なツールアクセス(ファイル読み取り、HTTP呼び出し、データベースクエリ)を持つAIエージェントをテストしていた開発者は、タスク実行中にエージェントが自律的に.envファイルを読み取ったことを発見しました。指示されていないにもかかわらず、エージェントはこの情報が「有用なコンテキスト」になる可能性があると判断し、Stripeキー、データベースパスワード、OpenAI APIキーを含む機密データにアクセスしました。

今回の事例ではエージェントがデータをどこにも送信しませんでしたが、開発者はそれを阻止するポリシーが存在しなかったことを指摘しています。彼らは「人々がモデルの決定と本番システムの間に全く強制力のない層を置かず、完全なツールアクセスでエージェントを実行している」という共通パターンを特定しました。この問題は「モデルが決定し、ツールが実行する。誰もチェックしない」と表現されています。

開発者は、「機密ファイルを読まないで」のようなプロンプト指示だけに依存することは信頼性が低く、「ジュニア開発者に『mainにプッシュするな』と言うようなものだ」と比較しています。

このセキュリティギャップに対処するため、彼らはMITライセンスのオープンソースツール「Supra-Wall」を構築しました。このツールは「エージェントとそのツールの間に位置する小さな層」として機能し、「実行前のすべての呼び出しをインターセプト」することで、エージェントが実行しようとすることと実際に許可されることの間に強制境界を設けます。

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

AnthropicのClaudeデスクトップアプリが、非公開のネイティブメッセージングブリッジをインストール
Security

AnthropicのClaudeデスクトップアプリが、非公開のネイティブメッセージングブリッジをインストール

Claude Desktopがユーザーの明示的な開示なしに、事前承認されたブラウザ拡張機能をインストールし、ネイティブメッセージングを有効にしていることが明らかになり、セキュリティ上の懸念が生じています。

OpenClawRadar
OpenClawのプロンプトインジェクション防御用外部コンテンツラッパー
Security

OpenClawのプロンプトインジェクション防御用外部コンテンツラッパー

OpenClawは外部コンテンツラッパーを使用しており、ウェブ検索結果、APIレスポンス、および類似のコンテンツに自動的に警告タグを付けて信頼できないものとしてマークし、LLMが疑いを持ち、悪意のある指示を拒否しやすくします。

OpenClawRadar
FastAPI Guardを使用して、OpenClawインスタンスを攻撃から保護します。
Security

FastAPI Guardを使用して、OpenClawインスタンスを攻撃から保護します。

FastAPI Guardは、IPフィルタリング、地域ブロック、レート制限、侵入検知を含む17のセキュリティチェックを追加するミドルウェアを提供します。このツールは、OpenClawセキュリティ監査で文書化された512の脆弱性と40,000以上の公開インスタンスを示す攻撃をブロックします。

OpenClawRadar
OpenClawセキュリティ監査コマンドプロンプト 平易な英語の脆弱性レポート
Security

OpenClawセキュリティ監査コマンドプロンプト 平易な英語の脆弱性レポート

RedditユーザーがOpenClaw CLI用のプロンプトを共有しました。このプロンプトは詳細なセキュリティ監査を実行し、何が公開されているか、深刻度スコア、具体的な設定修正方法を平易な英語で出力するものです。

OpenClawRadar