アンソロピックのClaudeにおけるテキスト透かし:意味ステガノグラフィーの解説
Anthropicが全てのClaudeテキスト出力に透かしを入れる計画は、当初の示唆とは異なります。Daring FireballのJohn Gruber氏による詳細な分析によると、この技術は推論時に単語選択を変更する意味的ステガノグラフィーの一種であり、彼らの初期の主張である「知覚不能」で「意味、品質、読みやすさを変えない」という点に矛盾します。
透かしの実際の仕組み
この方法は、「緑」と「赤」のリストを使ってトークン選択をバイアスします:
- 各トークン生成ステップで、秘密鍵に基づいて単語が決定的に緑と赤のリストに分割されます。
- モデルは赤リストの単語よりも緑リストの単語を選ぶ可能性がわずかに高くなります(偏った51-49コインを考えてください)。
- これにより、確率的に検出できる統計的パターンが導入されますが、真に自然なテキスト生成から逸脱します。
元のサポート文書では、透かしは「知覚不能」で読みやすさに影響しないと主張していましたが、Gruber氏はこのプロセスが本質的にトークン選択を変更し、意味的品質を低下させる可能性があるため、これは誤解を招くと論じています。
詳細情報
Gruber氏は、James Padolsey氏によるインタラクティブなエッセイ「AIテキスト透かしの仕組み」が、一般的な技術の最良の説明であると指摘しています。Anthropicも「Claudeのテキスト透かしの仕組み」というフォローアップ記事を公開しており、この方法を説明していますが、Gruber氏はそれを婉曲的だと批判しています。
AIエージェントを使用する開発者にとって、これは重要です:透かしは出力を微妙に変える可能性があるため、ワークフローを適宜テストしてください。
📖 全文を読む: HN AI Agents
👀 See Also

LLMの指示重み付けの理解:なぜClaudeは時々命令を無視するのか
Redditの調査により、Claudeがコードレビューを生成する際に「パターンマッチしないで」といった明示的な指示を無視できることが明らかになり、LLMの指示は制約ではなく重み付けされたコンテキストであることが示されました。

OpenClaw 0.9 CLIの削除によるエージェントの機能停止
ユーザーから報告されたところによると、AIエージェントを通じてOpenClawを更新しようとした結果、CLIが削除され、ゲートウェイコマンドとTelegramチャット機能が破損しました。OpenClaw 0.9ではCLIが完全に廃止され、'openclaw gateway start'や'openclaw status'などのコマンドが削除されました。
Opus 4.7の注意劣化:256kコンテキストでMRCRスコアが92%から59%に低下
Opus 4.7 は MRCR v2 8-needle テストにおいて大幅なリコール低下を示しています。256k コンテキストでは 91.9% から 59.2%、1M では 78.3% から 32.2% に低下しています。Anthropic は MRCR を廃止し Graphwalks に移行していますが、この劣化はユーザーの報告と一致しています。

IDPリーダーボードのベンチマークによると、Claude Sonnet 4.6は文書AIタスクにおいてOpus 4.6と同等の性能を示しています
IDPリーダーボードは、OCR、表抽出、キー抽出、視覚的QA、手書き、長文書の9,000以上のドキュメントで16のAIモデルをテストしました。Claude Sonnet 4.6は総合80.8点で、Opus 4.6の80.3点とほぼ同等の成績を収め、Haiku 4.5は69.6点でした。