テキストAIの透かしは常に除去が容易である

✍️ OpenClawRadar📅 公開日: August 14, 2026🔗 Source
テキストAIの透かしは常に除去が容易である
Ad

2026年8月から施行されるEU AI法の第50条は、LLMプロバイダーに対し、AI生成テキストへの透かしを義務付けています。しかし、テキストの透かしは画像の透かしとは根本的に異なり、除去は依然として簡単です。ここでは、その技術的な詳細を解説します。

テキストの透かしが難しい理由

画像にはノイズがあり、そこに透かしを隠すことができますが、テキストにはそれがありません。人間に気付かれずに文を微調整することはできません。つまり、平文を任意に操作できないステガノグラフィの問題なのです。「5文字ごとに'e'を入れる」といった単純な方法では、出力品質が損なわれます。

モデル自体が透かしを操作できるでしょうか?高性能なモデルなら可能ですが、推論トークンを消費し、出力品質が低下するため、採算が合いません。

モデルの再実行による検出が失敗する理由

テキストをモデルに通してトークン確率をチェックする方法は機能しません。AI出力のように読める人間のテキストの空間は広大で、誤検出が多発し、さらにEU市民全員に無料で検証を提供するのは法外なコストがかかります。

SynthIDの仕組み

GoogleのSynthIDは、公開されている唯一のテキスト透かしです。各トークンに、前のトークンに基づくスコア(例:トークンIDの合計を5で割った余り)を割り当てます。サンプリング時に、モデルは上位5つの候補から最もスコアの高いトークンを選択します。検出は、テキストのブロック全体でスコアを集計し、不自然に高い合計スコアがAI生成を示します。

これはemダッシュのヒューリスティックに似ていますが、人間には見抜けない微妙な数学的パターンに基づいています。

問題点

しかし、語彙の多様性を保つ透かしは、単純な言い換え、トークン置換、翻訳によって除去可能です。テキストが自然に読める限り、最小限の労力で信号を除去できます。SynthIDの堅牢性は限定的であり、大量検出用に設計されており、意図的な除去に抵抗するようには作られていません。

EUが技術的に満たせない要件を施行するのは必至です。企業は文言を順守するでしょうが、気にする人は誰でも数秒で回避できます。

📖 原文を読む: HN AI Agents

Ad

👀 See Also

Claude.aiでClaude Codeのエラー増加とログイン問題が発生中
News

Claude.aiでClaude Codeのエラー増加とログイン問題が発生中

Claude.aiは2026年3月11日現在、Claude Codeのログイン問題を含むエラー発生率の上昇を経験しています。このインシデントは公式システムステータス更新の2分以内に自動的に報告されました。

OpenClawRadar
Claude Max 100ドルサブスクリプションのAPI拡張タスク使用データ
News

Claude Max 100ドルサブスクリプションのAPI拡張タスク使用データ

Claude Maxの100ドルサブスクリプション利用者が、既存のAPIにお気に入りライブラリ機能を拡張するために5時間セッションの13%を消費したと報告。コンテキスト使用率は11%、週間使用率は5%から6%に増加。

OpenClawRadar
Claudeに正規表現について尋ねたら、深夜にコンパイラ設計に没頭することになった話
News

Claudeに正規表現について尋ねたら、深夜にコンパイラ設計に没頭することになった話

あるRedditユーザーがClaudeに正規表現の説明を求めたところ、45分にわたってパーサー、コンパイラ設計、言語理論についての会話に発展し、自分のキャリアに疑問を抱くことになった。

OpenClawRadar
Claude Research Previewがタスク自動化のための直接コンピューター制御機能を追加
News

Claude Research Previewがタスク自動化のための直接コンピューター制御機能を追加

Anthropicは、Claudeがコンピューターを直接操作してアプリを開いたり、ブラウザを操作したり、スプレッドシートに入力したりするタスクを完了できる研究プレビューをリリースしました。macOSのProおよびMaxユーザー向けで、Claude CoworkとClaude Codeを通じて動作し、モバイルとのペアリングが必要です。

OpenClawRadar