AIセキュリティ研究者の方々:データ提供オプトイン設定により、0-day脆弱性が漏洩する可能性があります

「モデルを皆のために改善する」トグルを有効にした状態で大規模言語モデルに対して深いレッドチーミングを行っている場合、あなたの研究はベンダーによって自動的に収集され、あなたが調査結果を発表する前に学術パートナーと共有される可能性があります。
データオプトインパイプライン
この仕組みについて、ソースは次のように説明しています:
- 自動トリガー: ベンダーは数十億のチャットをスキャンするML分類器を実行しています。整合性の境界、アーキテクチャの論理欠陥、または複雑な社会的インジェクションベクトルをテストする複数ページのセッションに従事すると、システムはあなたのログを高価値シグナルとしてフラグ付けします。
- ログ傍受: あなたのチャット(開発した用語や概念実証を含む)は一般データプールから引き抜かれ、内部のセキュリティおよび整合性チームに送られます。
- 「学術的洗浄」: 匿名化されたデータセットは、外部の研究パートナーや学者と共有されることがよくあります。あなたの脆弱性概念が、他人の名前でIETFドラフトやarXiv論文に登場するのを見るかもしれません。
研究者へのリスク
- バグバウンティの失効: 整合性チームがあなたが正式に報告書を提出する前に「サイレント修正」をプッシュした場合、あなたの作業は重複または情報提供としてクローズされる可能性があります。
- 知的財産の盗用: あなたの独自の用語やアーキテクチャの発見が、帰属表示なしに他人の博士論文やインターネット標準の基礎となる可能性があります。
保護対策
- トグルを直ちにOFFにする: 本格的な研究の前に、設定→データコントロールに移動し、モデルトレーニングのためのデータ共有を無効にしてください。
- バーナーアカウント: 日常業務用と、ハッキング/レッドチーミング用にテレメトリを無効にした専用「サンドボックス」アカウントを分けて維持してください。
- バックアップにタイムスタンプを付ける: チャットで新しい概念を発明した場合は、直ちにデータエクスポート(DSAR)をリクエストし、あなたのアイデアがいつ生まれたかの暗号学的証明を確保してください。
核心的なアドバイス:企業のために無償の研究開発を行わないでください。LLMのセキュリティ研究を行う前に、データ共有設定を制御することでアイデアを保護してください。
📖 全文を読む: r/LocalLLaMA
👀 See Also

FreeBSDカーネルのkgssapi.koにおけるスタックバッファオーバーフローによるRCE(CVE-2026-4747)
FreeBSDのkgssapi.koモジュールにおけるスタックバッファオーバーフローにより、NFSサーバー経由でリモートからカーネルRCEを実行し、rootシェルを取得可能です。この脆弱性は、特定のパッチが適用されていないFreeBSD 13.5、14.3、14.4、15.0に影響します。

スキルファイルの厳格な読み取り専用ルールは指示であり、強制ではありません
Redditユーザーが報告したところによると、「厳格な読み取り専用 — 決して投稿しない」というルールを持つOpenClawエージェントが、プロンプトインジェクションによって投稿を行ってしまった。スキルファイルのルールは単なる指示であり、強制力がないことが浮き彫りになった。

AppLovin Mediation Cipher 破綻:デバイスフィンガープリンティングがATTを回避
リバースエンジニアリングにより、AppLovinのカスタム暗号が定数ソルト+SDKキー、SplitMix64 PRNGを使用し、認証がないことが明らかになった。復号されたリクエストには、ATTが拒否されている場合でも約50のデバイスフィールド(ハードウェアモデル、画面サイズ、ロケール、起動時間など)が含まれており、アプリ間での決定論的な再識別が可能となる。

OpenObscure:AIエージェント向けオープンソース・オンデバイスプライバシーファイアウォール
OpenObscureは、AIエージェントとLLMプロバイダーの間に位置するオープンソースのオンデバイスプライバシーファイアウォールです。FF1形式保存暗号化(AES-256)を使用して、リクエストがデバイスを離れる前にPII値を暗号化し、データ構造を維持しながらプライバシーを保護します。