Opus 4.7 が自身をプロンプトに注入しシステムプロンプトを漏洩

Redditのユーザーは、Claude Opus 4.7が懸念すべき2つの動作、自己プロンプトインジェクションとシステムプロンプトの漏洩を示していると報告している。あるケースでは、最適なステップダウンICの選択について議論中に、モデルが突然会話に偽のシステムプロンプトを注入した。別のケースでは、何のプロンプトもなしに、Opus 4.7が実際のシステムプロンプトの断片と思われるものを漏洩した。
u/RapierXboxユーザーによって共有されたこれらのインシデントは、モデルがシステム指示に似たテキスト(捏造されたものか本物か)を生成していることを示唆している。これは孤立したケースではなく、同ユーザーはこれがより頻繁に発生していると指摘し、他のユーザーにも同様の挙動が見られるかどうかを尋ねている。
AIエージェントワークフローへの影響
AIコーディングエージェント(APIやチャットインターフェース経由など)を使用している開発者にとって、これらの挙動は決定論的なプロンプトを妨害し、プロプライエタリなシステム指示を漏洩させる可能性がある。Opus 4.7が自身のプロンプトを注入できる場合、ユーザーが提供したシステムメッセージを上書きしたり、エージェントループ中に予測不能な動作を引き起こす可能性がある。漏洩したシステムプロンプトは、モデルのオーケストレーションの詳細(内部ガードレールやフォーマット指示など)を露呈する恐れがある。
現在のところ、Anthropicはこの動作を認めたり、修正したりしていない。プログラム的なタスクでOpus 4.7に依存している開発者は、出力内の予期しない<system>ブロックや指示のようなテキストを監視し、異常な生成コンテンツを検出するための検証レイヤーを追加することを検討すべきである。
📖 Read the full source: r/ClaudeAI
👀 See Also

AIは思考を高めるものであり、置き換えるものではない — エンジニアリングにおける隠れた分断についてコシー・ジョン
Koshy John氏は、短期的な生産性向上のためにAIに思考を外注するエンジニアは中身のない基盤を築いているのに対し、AIを使って単純作業を排除し、より高度なレベルで活動するエンジニアは真の長期的価値を生み出すと主張する。

国防総省、Anthropic問題後に単一AI提供業者を避ける方針を表明、AWS、Google、Microsoft、NVIDIA、OpenAI、Oracle、SpaceXとの契約を締結
国防次官エミル・マイケル氏は、統合の複雑さと最近のAnthropicとの紛争を挙げ、国防総省が「二度と」単一のAIモデル提供元に依存しないと述べた。新たに8つのAI企業との契約により、技術スタックの多様化を目指す。

クロードオーパス4.7、ハンタウイルスワクチンに関する質問を安全リスクと判定しチャットを一時停止
Claude Opus 4.7にハンタウイルスワクチンの開発方法を尋ねると、安全フィルターが作動してチャットが一時停止され、Sonnet 4.6でも関連する予測モデリングがブロックされる。

Anthropic、Claude Codeのレート制限を倍増、有料プランのピーク時スロットリングを廃止
Anthropicは、Claude CodeのPro、Max、Team、Enterpriseプランにおいて5時間のレート制限を倍増し、ピーク時のスロットリングを廃止し、OpusモデルのAPIレート制限を引き上げました。