GitHubリポジトリには、公開AIチャット向けの16のプロンプトインジェクション手法と防御戦略が文書化されています。

開発者が実験として自社ウェブサイトにカスタムAIチャットを構築したところ、実際のユーザーがそれを破ろうとする試みにより、複数のセキュリティ課題に直面しました。この経験から、GitHubで公開されている包括的なセキュリティガイドの作成につながりました。
直面したセキュリティ課題
ユーザーは以下のような様々な攻撃を試みました:
- プロンプトインジェクション
- ロールプレイ攻撃
- 多言語トリック
- Base64エンコードされたペイロード
実装された防御戦略
開発者は多層防御アプローチを文書化し、以下をカバーしています:
- 入力のサニタイズ
- レート制限
- ゼロトラストシステムプロンプト設計
- 出力制御
- コスト上限
GitHubリポジトリの内容
リポジトリには以下が含まれています:
- 16種類のプロンプトインジェクション手法の詳細解説
- あなたのチャットボットに対して16種類の手法を自動的にテストするClaudeコードスキル
- 防御実装の詳細情報
開発者は、ユーザーが「自分ではテストしようとも思わなかったようなこと」を試みたと述べており、このガイドが同様の公開AIチャットシステムを実装するすべての人にとって役立つことを意図しているとしています。
📖 詳細情報を読む: r/ClaudeAI
👀 See Also

Endo Familiar: AIエージェント向けオブジェクトケイパビリティサンドボックス
Endo FamiliarはAIエージェントに対してオブジェクトキャパビリティセキュリティを実装します。エージェントはゼロの環境権限から始まり、特定のファイルやディレクトリへの明示的な参照のみを受け取り、サンドボックス化されたコード内でより狭い権限を派生させることができます。

OpenClawにおけるプライバシー懸念:スキル、SOUL MD、エージェント通信
開発者がOpenClawのアーキテクチャについてプライバシー上の懸念を提起。具体的には、スキルが機密データに無制限にアクセスできること、SOUL MDが書き込み可能であること、エージェントがフィルターなしで情報を共有することなどが指摘されています。

マイクロソフトのオープンソースツールがハッキング:AI開発者リポジトリにパスワード盗むマルウェア
ハッカーが少なくとも70のMicrosoft GitHubリポジトリにパスワードを盗むマルウェアを仕込み、Claude Code、Gemini CLI、VS Codeを使用するAI開発者を標的にした。これは以前のDurable Task侵害の再侵害である。

LinuxカーネルがPGP Web of Trustに代わる分散型アイデンティティシステムを提案
Linuxカーネルのメンテナーたちは、現在のPGPの信頼の網に代わる分散型アイデンティティ層「Linux ID」の開発に取り組んでいます。このシステムはW3Cスタイルの分散型識別子(DID)と検証可能なクレデンシャルを活用し、開発者の認証を対面での鍵署名セッションなしで実現します。