テキストAIの透かしは常に除去が容易である

✍️ OpenClawRadar📅 公開日: August 14, 2026🔗 Source
テキストAIの透かしは常に除去が容易である
Ad

2026年8月から施行されるEU AI法の第50条は、LLMプロバイダーに対し、AI生成テキストへの透かしを義務付けています。しかし、テキストの透かしは画像の透かしとは根本的に異なり、除去は依然として簡単です。ここでは、その技術的な詳細を解説します。

テキストの透かしが難しい理由

画像にはノイズがあり、そこに透かしを隠すことができますが、テキストにはそれがありません。人間に気付かれずに文を微調整することはできません。つまり、平文を任意に操作できないステガノグラフィの問題なのです。「5文字ごとに'e'を入れる」といった単純な方法では、出力品質が損なわれます。

モデル自体が透かしを操作できるでしょうか?高性能なモデルなら可能ですが、推論トークンを消費し、出力品質が低下するため、採算が合いません。

モデルの再実行による検出が失敗する理由

テキストをモデルに通してトークン確率をチェックする方法は機能しません。AI出力のように読める人間のテキストの空間は広大で、誤検出が多発し、さらにEU市民全員に無料で検証を提供するのは法外なコストがかかります。

SynthIDの仕組み

GoogleのSynthIDは、公開されている唯一のテキスト透かしです。各トークンに、前のトークンに基づくスコア(例:トークンIDの合計を5で割った余り)を割り当てます。サンプリング時に、モデルは上位5つの候補から最もスコアの高いトークンを選択します。検出は、テキストのブロック全体でスコアを集計し、不自然に高い合計スコアがAI生成を示します。

これはemダッシュのヒューリスティックに似ていますが、人間には見抜けない微妙な数学的パターンに基づいています。

問題点

しかし、語彙の多様性を保つ透かしは、単純な言い換え、トークン置換、翻訳によって除去可能です。テキストが自然に読める限り、最小限の労力で信号を除去できます。SynthIDの堅牢性は限定的であり、大量検出用に設計されており、意図的な除去に抵抗するようには作られていません。

EUが技術的に満たせない要件を施行するのは必至です。企業は文言を順守するでしょうが、気にする人は誰でも数秒で回避できます。

📖 原文を読む: HN AI Agents

Ad

👀 See Also

エージェントチームの設計:Googleが自律コード生成のためにサブエージェントを反重力構造化する方法
News

エージェントチームの設計:Googleが自律コード生成のためにサブエージェントを反重力構造化する方法

Google Antigravityが自律コーディングのためのサブエージェントアーキテクチャを公開:7つの専門エージェントタイプ(Sentinel(フロントデスク)からAuditor(真正性チェッカー)まで)。OpenClawのサブエージェント設計に関連。

OpenClawRadar
AIスラップが開発者コミュニティを窒息させる「バイブコーディングノイズフロア」
News

AIスラップが開発者コミュニティを窒息させる「バイブコーディングノイズフロア」

rmoffが、デベロッパーコミュニティに溢れる低品質なAI生成コンテンツ(無意味なGitHubリポジトリからゴーストライターによるブログ記事まで)と、それが有機的な参加を減少させている理由について苦言を呈する。

OpenClawRadar
Claude Code v2.1.222:ワークツリーのセキュリティ、プロキシ修正、使用量課金の再調整
News

Claude Code v2.1.222:ワークツリーのセキュリティ、プロキシ修正、使用量課金の再調整

Claude Code v2.1.222では、ワークツリー分離セッションでの破壊的なgitコマンド、HTTPSプロキシ起動時のハング、MCP使用量の課金を修正し、SendMessage権限チェックを追加しました。

OpenClawRadar
AI推論は明らかに収益性が高い:その経済性を分解する
News

AI推論は明らかに収益性が高い:その経済性を分解する

最先端AI推論プロバイダーは粗利率70〜80%を報告している。コスト試算では70Bモデルの提供に100万トークンあたり約1ドルかかる一方、API価格は100万トークンあたり4.50ドル以上である。

OpenClawRadar