BlindKey: AIエージェント向けブラインド認証情報インジェクション

BlindKeyの仕組み
BlindKeyは、AIエージェントが平文のAPI認証情報を扱う際のセキュリティリスクに対処します。エージェントにシークレットへの直接アクセスを与える代わりに、エージェントが暗号化されたボールトトークン(例:bk://stripe)を参照するシステムを使用します。ローカルプロキシがこれらの参照を傍受し、APIリクエストが行われた瞬間に実際の認証情報を注入します。エージェントプロセスは平文のシークレットを決して見たり保存したりしません。
セキュリティ機能
- 保存データのAES-256-GCM暗号化
- シークレットごとのドメイン許可リスト(例:Stripeキーはapi.stripe.comでのみ使用可能)
- デフォルト拒否のファイルシステムゲーティング
- エージェントの書き込みに対するコンテンツスキャン(誤って漏洩した認証情報やPIIを検出)
- 暗号化ハッシュチェーンによる改ざん検知監査ログ
脅威モデルと攻撃対象領域
特定された主な脆弱性は、エージェントがBlindKey自身のプロセスメモリやボールトファイルを読み取れる場合で、これによりブラインドインジェクション保護が回避されます。現在の緩和策には、SQLite暗号化とOSレベルのファイル権限が含まれます。ソースは、カーネルレベルのサンドボックス(nonoのアプローチなど)がより強力な保護を提供すると示唆しています。
このツールはGitHubで入手可能です:github.com/michaelkenealy/blindkey。
📖 Read the full source: r/openclaw
👀 See Also

メタ・セキュリティインシデントは、不正確な技術的アドバイスを提供する不正なAIエージェントによって引き起こされました。
メタ社のエンジニアが、OpenClawに類似した社内AIエージェントを使用して技術的な質問を分析したが、そのエージェントが不正確なアドバイスを非公開ではなく公開投稿したため、機密データが一時的に露出するSEV1セキュリティインシデントが発生しました。

AWSは、AI強化型攻撃により600以上のFortiGateファイアウォールが侵害されたと報告しています。
AWSによると、サイバー犯罪者は市販の生成AIツールを使用し、1か月間にわたるキャンペーンで55か国にまたがる600以上のインターネットに公開されたFortiGateファイアウォールを侵害しました。攻撃者は公開された管理インターフェースをスキャンし、脆弱な認証情報を試行し、AIを使用して攻撃プレイブックやスクリプトを生成しました。

アイアンクローのAIエージェント安全性に対するセキュリティ第一のアプローチ
IronClawは、安全な動作をLLMの知能に依存する代わりに、制約付き実行、暗号化環境、明示的な権限を実装することで、AIエージェントのセキュリティ懸念に対処します。

AI監査ツールzkao、OpenVMのzkVMゲストライブラリで重要な健全性バグを発見
ZK/SECのAI監査ツールzkaoがOpenVMのペアリングライブラリに重大な健全性バグを発見。悪意ある証明者がペアリングの等価性を偽造可能。OpenVM 1.6.0で修正(CVE-2026-46669)。