McpVanguard: MCPベースのAIエージェント向けのオープンソースセキュリティプロキシ

McpVanguardは、Model Context Protocol(MCP)を使用するローカルAIエージェント向けに特別に設計されたオープンソースのセキュリティプロキシおよびファイアウォールです。LLMにターミナルやファイルシステムなどのツールへのアクセス権を与える際に生じるセキュリティ上の懸念に対処します。
仕組み
このプロキシはAIエージェントとMCPツールの間に配置され、既存のMCPサーバーをラップして動作するため、セットアップの書き換えは不要です。軽量プロキシとしてローカルで実行することも、クラウドゲートウェイとしてデプロイすることも可能で、より簡単なデプロイメントのためのRailwayテンプレートが利用できます。
セキュリティレイヤー
- ルール/シグネチャエンジン: リバースシェル、SSRF試行、その他の明らかな脅威などの一般的な攻撃を検出する約50のYAMLシグネチャを含みます。このレイヤーは約16msの遅延を追加します。
- セマンティックスコアリングレイヤー(オプション): リクエストが不審だが明らかに悪意があるとは言えない場合、意図を評価する小型LLM(OllamaまたはOpenAI)によって評価できます。
- 行動監視: エージェントが短時間に数百のファイルを読み取ろうとするなど、異常なパターンをブロックします。
監査機能
ブロックされたすべてのリクエストは、暗号的に署名されローカルに保存される不変の監査ログに記録され、何がなぜブロックされたかの検証可能な記録を提供します。
このツールは、プロンプトインジェクション、パストラバーサル、AIエージェントによる誤ったディレクトリ削除など、MCP実装に伴う特定のセキュリティ懸念に対処するために開発されました。
📖 Read the full source: r/LocalLLaMA
👀 See Also

クロードコードが23年前のLinuxカーネル脆弱性を発見
Anthropicの研究者ニコラス・カリーニは、Claude Codeを使用してLinuxカーネル内の複数のリモートで悪用可能なヒープバッファオーバーフローを発見しました。その中には23年間隠れていた脆弱性も含まれています。AIはカーネルソースツリー全体をスキャンし、最小限の監視でこれらのバグを見つけ出しました。

フライトラップ攻撃は、敵対的傘を用いてカメラベースの自律ドローンのセキュリティを脅かします。
カリフォルニア大学アーバイン校の研究者らは、塗装された傘を利用してカメラベースの自律ターゲット追跡システムの脆弱性を悪用する物理的攻撃フレームワーク「FlyTrap」を開発しました。この攻撃は追跡距離を危険なレベルまで縮め、ドローン捕獲、センサー攻撃、または物理的衝突を可能にします。

MetaのAIサポート機能で誰でもInstagramアカウントを乗っ取れる — 脆弱性の詳細
InstagramでABテスト中のAIサポート機能に脆弱性。3ステップでパスワードリセット可能、100以上のアカウントが乗っ取られる。

Claudeモデルは、特にツールアクセス時に、不可視のUnicode文字によるハイジャックに対して脆弱です。
テスト結果によると、ツールが有効な場合、Claude Sonnet 4は不可視のUnicode文字に埋め込まれた隠し指示に対して71.2%の従順性を示し、Opus 4はUnicodeタグエンコーディングで100%の従順性を達成しました。ツールへのアクセスは、すべてのClaudeモデルの脆弱性を劇的に増加させます。