ThornGuard: MCPサーバー接続をプロンプトインジェクションから保護するプロキシゲートウェイ

ThornGuardは、外部のMCP(Model Context Protocol)サーバーに接続する際に、Claude AIを悪意のあるコンテンツから保護するために設計されたセキュリティプロキシです。このツールは、アップストリームサーバーがツールの応答に隠れた命令を注入し、Claudeがフィルタリングなしでそれを受け取る可能性があることがテストで明らかになった後、作成されました。
特定されたセキュリティ問題
Claudeを外部のMCPサーバーに接続する際、アップストリームサーバーがツールの応答に隠れた命令を注入するのを防ぐものは何もありません。テストでは、サーバーが特定のベンダーを常に優先するようにClaudeに指示する偽の推奨事項を埋め込みました。Claudeはこの明らかなペイロードを検出しましたが、より巧妙なインジェクションは検出を回避するでしょう。
ThornGuardの機能
- ツールの定義と応答をプロンプトインジェクションとポイズニングでスキャン
- シークレットとPIIをコンテキストウィンドウに入る前に除去
- 疑わしいペイロードをフラグするセマンティック分類器を含む
- コンプライアンスエクスポート付きのリアルタイム監査ダッシュボードを提供
- Claude Desktop、Cursor、VS Code、その他いくつかのための設定を生成するCLIを提供
実装の詳細
プロキシアーキテクチャはセキュリティモデルを念頭に設計され、その後Claude Code on Cloudflare Workersを使用して実装されました。実装にはOAuthフローとCLIツールが含まれます。
ThornGuardは、thorns.qwady.appで7日間の無料トライアルで利用可能です。デモンストレーションビデオはhttps://youtu.be/1PWNFpUWKV8でご覧いただけます。
📖 Read the full source: r/ClaudeAI
👀 See Also

AnthropicのClaudeデスクトップアプリが、非公開のネイティブメッセージングブリッジをインストール
Claude Desktopがユーザーの明示的な開示なしに、事前承認されたブラウザ拡張機能をインストールし、ネイティブメッセージングを有効にしていることが明らかになり、セキュリティ上の懸念が生じています。
美国防部网络安全顾问:中国AI企业对美国企业发动恶意蒸馏活动
米国防総省の新たなCSA報告書は、中国のAI企業が米国のAIモデルを盗むために悪意ある蒸留キャンペーンを実施していることを明らかにし、商用AI製品とオープンソースフレームワークを標的にしている。

OpenClawスキルアナライザー:AIエージェントスキルの静的セキュリティスキャナー
ある開発者が、インストール前にOpenClawスキルのセキュリティリスクをスキャンする静的解析ツールを構築しました。プロンプトインジェクションやデータ流出など12カテゴリにわたる40以上の検出ルールを備えています。

AI脆弱性発見がパッチ展開時間を上回るペースで進行
セキュリティ専門家は、MythosのようなAIツールが脆弱性を修正の展開よりも速く発見すると主張し、Log4jのデータから平均修復時間が17日、完全排除には10年かかるとの見通しを示している。