powered by TechFeed
表示モード
主要ニュース

ChatGPTのテキストにEU向け「不可視ウォーターマーク」——単語25%を置き換えるだけで検出率17%に落ちる限界もOpenAI自身が公表

10月5日、TechStartupsが「ChatGPT text is getting an invisible watermark in Europe to comply with the EU AI Act. Here's how it works」と題した記事を公開した。EU AI Actへの対応としてOpenAIがChatGPTとCodexのテキストに不可視ウォーターマークを埋め込む仕組みを紹介しつつ、単語をわずか25%置き換えるだけで検出率が17%まで崩壊するという限界をOpenAI自身が率直に公表している点が最大の読みどころだ。

10月5日、TechStartupsが「ChatGPT text is getting an invisible watermark in Europe to comply with the EU AI Act. Here's how it works」と題した記事を公開した。EU AI Actへの対応としてOpenAIがChatGPTとCodexのテキストに不可視ウォーターマークを埋め込む仕組みを紹介しつつ、単語をわずか25%置き換えるだけで検出率が17%まで崩壊するという限界をOpenAI自身が率直に公表している点が最大の読みどころだ。


OpenAIの「textGrain」——単語選択の統計パターンを変える

OpenAIは、EU域内のChatGPTおよびCodexの全プランを対象に、今後数週間以内に不可視ウォーターマークの展開を開始する。EU域外では原則オフのままだが、APIを利用する世界中の開発者は今日から一部モデルでオプトインが可能だ。

この技術はtextGrainと呼ばれる。可視ラベル、不可視文字、メタデータのいずれも使わず、モデルが生成時に行う単語選択の統計的パターンを微妙に変化させることでシグナルを埋め込む。検出器はそのパターンを解析し、OpenAIのウォーターマークが含まれているかを推定する。

「推定」という点が肝だ。

なお、2ヶ月足らず前にはAnthropicが同じEU規制への対応としてClaudeにも不可視ウォーターマークを導入している。Anthropicはコピーペーストやある程度の編集を経ても信号が残ると説明しており、主要AIプロバイダーの間でこの対応が広がりつつある。


編集でウォーターマークは消える——OpenAI自身のデータが示す限界

最も注目すべきは、OpenAI自身が公開した検出精度のデータだ。数字を見ると、技術的な限界が率直に示されている。

  • 400トークンの文章:未改変の状態で検出率 約92%
  • 単語の 10%を同義語に置換:検出率 66% に低下
  • 単語の 25%を置換:検出率 17% まで低下

文章の長さも影響する。偽陽性率1%の条件下では、200トークンの文章で約80%、400トークンで約95% の検出率となった。


文章の長さと種類が検出率に与える影響

さらに、数学のテキストでは検出性能が大幅に低下する。数式や論理的な記述は単語の言い換えの自由度が低く、統計パターンを変えにくいためだ。

実運用を考えると、この限界は深刻だ。ユーザー、編集者、翻訳ツール、そして別のAIが生成テキストを加工するのは日常茶飯事であり、出版前に何度も書き直されたテキストでウォーターマークが生き残る保証はない。

こうした限界を踏まえ、OpenAIは一般向けの検出ツールを当面提供しない方針を取る。検出器へのアクセスは承認された研究者や専門機関のみに限定される。偽陽性・偽陰性のリスクを考慮してのことだという。


ウォーターマークが証明できること・できないこと

OpenAIは、textGrainが何を証明できて、何を証明できないかを明確に線引きしている。

証明できること:

  • ある文章の一部をOpenAIのシステムが生成または処理した可能性

証明できないこと:

  • 誰がそのモデルを使ったか
  • どのアカウント・どのプロンプト・どの会話で生成されたか
  • 著作権の帰属や法的責任
  • テキストの正確性
  • 人間がどの程度関与したか

逆向きの推論にも注意が必要だ。ウォーターマークが検出されなかったとしても、人間が書いたテキストであるとは証明されない。 編集・翻訳・短縮された可能性のほか、対応していないモデル、ウォーターマーク導入前の生成物、あるいは別プロバイダーのAIによるテキストである可能性もある。


EU規制が求める「機械可読なシグナル」

今回の展開は、EU域内とそれ以外でOpenAI生成テキストの扱いが異なるという、珍しい分断を生む。

EUはEU AI Actにおいて、AI生成コンテンツに対して機械可読なマーキングを義務付けており(同規則第50条が主要根拠とされる)、AI企業に対して「システムの仕組みを開示する」段階から、「生成されたコンテンツの中に機械可読なシグナルを埋め込むことを求める」段階へと規制を進化させている。

OpenAIはtextGrainが内部の品質・性能評価において大きな悪影響を与えなかったと述べており(※元記事では「Astra」という名称が登場するが、これがどの製品・ベンチマークを指すのかは元記事の記述のみでは判断できないため、詳細は元記事を参照されたい)、技術仕様のより詳細な公開と、将来的なオープンソース化も予定している。

日本企業にとっても、このような「コンプライアンス対応型の透明性技術」がどう機能し、どこまで限界があるかを理解しておくことは、EU向けサービス展開や今後の国内規制論議を見据えた実務的な知識となるだろう。EU AI Actの条文については欧州議会の公式テキストも合わせて参照すると理解が深まる。

詳細はChatGPT text is getting an invisible watermark in Europe to comply with the EU AI Act. Here's how it worksを参照していただきたい。