powered by TechFeed
表示モード
主要ニュース

ChatGPT生成テキストに「見えない透かし」を埋め込む技術をOpenAIが導入へ — 2023年の失敗を経た再挑戦、EU規制対応だが短文やコードには効かない

10月7日、Dexertoが「ChatGPT text is about to become detectable with invisible watermark to comply with EU AI law」と題した記事を公開した。2023年、OpenAIは自社のAIテキスト検出器をリリースしたが精度が低すぎて同年中に廃止した——その失敗から3年以上を経て、OpenAIはテキスト透かし技術「textGrain」を引っ提げて再挑戦する。EU AI法への対応を直接の契機としており、今後数週間以内にロールアウトが始まる予定だ。

10月7日、Dexertoが「ChatGPT text is about to become detectable with invisible watermark to comply with EU AI law」と題した記事を公開した。2023年、OpenAIは自社のAIテキスト検出器をリリースしたが精度が低すぎて同年中に廃止した——その失敗から3年以上を経て、OpenAIはテキスト透かし技術「textGrain」を引っ提げて再挑戦する。EU AI法への対応を直接の契機としており、今後数週間以内にロールアウトが始まる予定だ。


2023年の失敗からの転換

今回の取り組みは、OpenAIの過去の失敗を踏まえたリベンジでもある。

2023年、OpenAIは自社のAIテキスト分類器をリリースしたものの、**AIが書いたテキストを正しく識別できた割合はわずか26%**という低精度に終わり、同年中にサービスを停止した。当時、OpenAIは「より効果的なプロベナンス技術(出所証明技術)を研究中」と述べていた。3年以上を経て、textGrainはその回答となる。

EU AI法とは

今回の導入の直接的な契機となっているのが、**EU AI法(EU AI Act)**だ。EU AI法は2024年8月に段階的な施行が始まった世界初の包括的AI規制であり、生成AIプロバイダーに対してAI生成コンテンツを機械可読な形式で識別可能にすることを義務付けている。透かし技術の導入はこの要件への直接的な対応となる。

OpenAIは、EU域内でChatGPTが生成したテキストに不可視の電子透かしを埋め込む準備を進めている。透かし機能は、ChatGPTおよびCodexのテキスト出力を対象に、EU向けに今後数週間以内にロールアウトされる予定だ。

「textGrain」の仕組み

OpenAIが開発した透かし技術の名称は「textGrain」だ。

従来型の透かし手法——見えない文字の挿入、特殊な句読点、不可視のスペース、追加トークンの埋め込み——とは異なるアプローチをとる。textGrainは、モデルがテキストを生成する際に単語や語句の候補を選ぶプロセス自体を微妙に変化させることで、文章全体に統計的なパターンを刻み込む。このパターンをOpenAIの検出器が後から照合する仕組みだ。

透かしは文章の語彙選択に織り込まれているため、単純にコピー&ペーストしても除去できないとOpenAIは説明している。また、透かしには生成者の個人情報・所属組織・プロンプト内容は含まれない。

なお、テキスト透かしの導入はモデルの品質に有意な低下をもたらさず、生成速度への影響も無視できる程度だとOpenAIは述べている。

検出器へのアクセスは限定的

注意すべき点として、誰でも検出器を使えるわけではない。OpenAIは現在、承認済みの研究者や専門機関に限定してアプリケーションの受け付けを開始しており、技術の信頼性と用途を評価しながら段階的に展開する方針だ。

一方、APIを利用する企業顧客は世界中で対応モデルへのテキスト透かしをオプトインできる(デフォルトは無効)。クラウドや流通パートナーとの連携も進めている。

OpenAIはすでに画像・音声向けのプロベナンス技術を持っており、対応ツールで生成した画像にはContent Credentialsの透かしが付与され、AI生成音声にはGoogleのDeepMindが開発した**SynthID**が使われている——OpenAIはSynthIDを自社の音声出力に採用する形で利用している。これらの検証ツールはすでに一般公開されている。新しいテキスト向け検出器がまず限定公開にとどまる点は、画像・音声との大きな違いだ。

検出できないケースも多い

透かし検出は万能ではなく、OpenAI自身も限界を認めている。

  • 短い応答は統計パターンを確立するのに十分なテキスト量がなく、検出が困難
  • コード・数学の答え・高度に事実ベースの応答は、モデルが語句を言い換える余地が少なく透かしが埋め込みにくい
  • 大幅な書き換え・言い換え・翻訳を行うと、透かしが弱まったり消えたりする

こうした制約を踏まえ、EU AI法のコード・オブ・プラクティスでは、200トークン未満(英語で約150語)の短い出力やコードスニペットは透かしの対象外とされている。

重要な前提として、透かしが検出されてもそれはテキストがAIに生成・処理されたことを示すに過ぎず、人間がどれだけ編集に関与したかは判断できない。逆に透かしが見つからなくても、人間が書いたとは言えない。


詳細はChatGPT text is about to become detectable with invisible watermark to comply with EU AI lawを参照していただきたい。