ThornGuard: MCPサーバー接続をプロンプトインジェクションから保護するプロキシゲートウェイ

ThornGuardは、外部のMCP(Model Context Protocol)サーバーに接続する際に、Claude AIを悪意のあるコンテンツから保護するために設計されたセキュリティプロキシです。このツールは、アップストリームサーバーがツールの応答に隠れた命令を注入し、Claudeがフィルタリングなしでそれを受け取る可能性があることがテストで明らかになった後、作成されました。
特定されたセキュリティ問題
Claudeを外部のMCPサーバーに接続する際、アップストリームサーバーがツールの応答に隠れた命令を注入するのを防ぐものは何もありません。テストでは、サーバーが特定のベンダーを常に優先するようにClaudeに指示する偽の推奨事項を埋め込みました。Claudeはこの明らかなペイロードを検出しましたが、より巧妙なインジェクションは検出を回避するでしょう。
ThornGuardの機能
- ツールの定義と応答をプロンプトインジェクションとポイズニングでスキャン
- シークレットとPIIをコンテキストウィンドウに入る前に除去
- 疑わしいペイロードをフラグするセマンティック分類器を含む
- コンプライアンスエクスポート付きのリアルタイム監査ダッシュボードを提供
- Claude Desktop、Cursor、VS Code、その他いくつかのための設定を生成するCLIを提供
実装の詳細
プロキシアーキテクチャはセキュリティモデルを念頭に設計され、その後Claude Code on Cloudflare Workersを使用して実装されました。実装にはOAuthフローとCLIツールが含まれます。
ThornGuardは、thorns.qwady.appで7日間の無料トライアルで利用可能です。デモンストレーションビデオはhttps://youtu.be/1PWNFpUWKV8でご覧いただけます。
📖 Read the full source: r/ClaudeAI
👀 See Also

セキュリティアラート:LiteLLM内の悪意あるコードがAPIキーを盗む可能性あり
LiteLLMでAPIキーが漏洩する可能性のある重大なセキュリティ脆弱性が発見されました。OpenClawやnanobotのユーザーは影響を受ける可能性があるため、ソースに記載されているGitHubのIssueを確認してください。

SKILL.mdの編集は、コードが変更されていない場合でも本番変更です。
OpenClawのワークスペーススキルはバンドル版を上書きし、エージェントの動作を変更できます。SKILL.mdファイルを信頼できるコードとして扱い、本番変更と同様に監査とバージョン管理を行いましょう。

人間的信頼の根源:自律型AIエージェントに対する説明責任の確立
Human Root of Trustは、自律型AIエージェントに対する説明責任の欠如を暗号技術によって解決する、パブリックドメインのフレームワークです。

大量NPM和PyPI供应链攻击波及TanStack、Mistral AI及170多个软件包
調整された攻撃により、170以上のnpmパッケージと2つのPyPIパッケージが侵害され、TanStack(42パッケージ)、Mistral AI SDK、UiPath、OpenSearch、Guardrails AIが標的となりました。悪意のあるバージョンは、認証情報を流出させ、クラウドメタデータを調べるドロッパーを実行します。