テキストAIの透かしは常に除去が容易である

2026年8月から施行されるEU AI法の第50条は、LLMプロバイダーに対し、AI生成テキストへの透かしを義務付けています。しかし、テキストの透かしは画像の透かしとは根本的に異なり、除去は依然として簡単です。ここでは、その技術的な詳細を解説します。
テキストの透かしが難しい理由
画像にはノイズがあり、そこに透かしを隠すことができますが、テキストにはそれがありません。人間に気付かれずに文を微調整することはできません。つまり、平文を任意に操作できないステガノグラフィの問題なのです。「5文字ごとに'e'を入れる」といった単純な方法では、出力品質が損なわれます。
モデル自体が透かしを操作できるでしょうか?高性能なモデルなら可能ですが、推論トークンを消費し、出力品質が低下するため、採算が合いません。
モデルの再実行による検出が失敗する理由
テキストをモデルに通してトークン確率をチェックする方法は機能しません。AI出力のように読める人間のテキストの空間は広大で、誤検出が多発し、さらにEU市民全員に無料で検証を提供するのは法外なコストがかかります。
SynthIDの仕組み
GoogleのSynthIDは、公開されている唯一のテキスト透かしです。各トークンに、前のトークンに基づくスコア(例:トークンIDの合計を5で割った余り)を割り当てます。サンプリング時に、モデルは上位5つの候補から最もスコアの高いトークンを選択します。検出は、テキストのブロック全体でスコアを集計し、不自然に高い合計スコアがAI生成を示します。
これはemダッシュのヒューリスティックに似ていますが、人間には見抜けない微妙な数学的パターンに基づいています。
問題点
しかし、語彙の多様性を保つ透かしは、単純な言い換え、トークン置換、翻訳によって除去可能です。テキストが自然に読める限り、最小限の労力で信号を除去できます。SynthIDの堅牢性は限定的であり、大量検出用に設計されており、意図的な除去に抵抗するようには作られていません。
EUが技術的に満たせない要件を施行するのは必至です。企業は文言を順守するでしょうが、気にする人は誰でも数秒で回避できます。
📖 原文を読む: HN AI Agents
👀 See Also

オープンクロー実験:信号対雑音比を向上させるために沈黙を選ぶAIエージェント
OpenClawの実験では、AIエージェントに価値を追加できない場合にタスクをスキップする自律性を与え、その判断理由を「サイレンスログ」に記録します。このシステムは、コンテンツ生成前にLLM呼び出しを行い、3日連続でサイレンスが続いた後は閾値を自動調整します。

生産用AIエージェントにおけるOpenClawの3つの重大なギャップ
開発者は、AIエージェントが真の従業員として機能するのを妨げるOpenClawの3つの不足機能を特定しました:監査可能性、詳細なアクション制御、指示解決です。

AnthropicはClaudeのコンピュータ利用能力を向上させるため、Vercept AIを買収しました。
Anthropicは、Claudeのコンピュータ利用機能を開発するためにVercept AIを買収しました。この買収は、AIを複雑なタスクにより有用にするために、知覚とインタラクションの問題を解決することに焦点を当てています。

Claude Opus 4.1は、SWE-Bench Proのプライベートデータセットにおいて17.75%のスコアを記録し、記憶力と推論力のギャップを浮き彫りにしました。
Claude Opus 4.1はSWE-Bench Verifiedで80%を獲得しましたが、SWE-Bench Proのプライベートデータセットでは17.75%に低下しました。Scale AIの分析によると、モデルは馴染みのあるリポジトリで推論するのではなく、記憶に基づいてナビゲートしていたことが判明しました。