AI

ChatGPTの文章にEUで透かし導入、OpenAIが2024年に見送った技術

Adrian Kessler
Googleで追加する

OpenAIはこれまで、ChatGPTの文章に透かしを入れない理由を公の場で長く説明してきた。ところが今、結局は透かしを導入する。技術が同社の考えを変えたわけではない。期限と罰金を定めた法律が、方針を変えさせたのだ。

同社によると、欧州連合(EU)のユーザー向けにChatGPTとCodexが生成する文章には、今後数週間かけて全プランにわたり、目には見えない統計的な署名が付与される。一方、EU以外では同じ仕組みを開発者向けAPIの設定として利用できるが、初期設定ではオフになっている。OpenAIが線を引いたのは、同社に制裁を科せる管轄区域の境界だ。

ChatGPTの透かしはどう機能するのか

textGrainと呼ばれるこの方式は、出力に目に見える印を付けるものではない。次に続く複数の単語がどれも同じくらい自然に文に収まる場合、秘密鍵を使って、そのうち特定の単語が選ばれやすくなるよう調整する。こうした小さな偏りは一つだけなら意味を持たない。しかし文章全体で何百回も重なるとパターンが生まれ、鍵を持つ検出器で判定できるようになる。信号は単語そのものに埋め込まれているため、コピー&ペーストしても残る。OpenAIはペンシルベニア大学とイェール大学の研究者とともに技術報告書を執筆した。品質への実質的な影響はないとしており、Artificial Analysis Intelligence Indexでは、透かし入りの出力が49.76点、透かしなしが49.57点だった。

OpenAIがすでに持っていた技術

OpenAIにとって、今回の取り組みは目新しいものではない。2024年夏、Wall Street Journalは、同社が社内文書で有効性99.9%と評価された実用段階のテキスト透かし技術を持ちながら、導入を見送っていると報じた。OpenAIはこれに対し、「慎重なアプローチ」を取っていると説明した。理由として挙げたのは、技術面と社会面の懸念だ。別のモデルで翻訳したり言い換えたりすれば悪意ある利用者が「簡単に回避できる」こと、また、英語を母語としない人にとって文章作成を助けるAIが、汚名を着せられる可能性があることだった。今週の発表を報じたTechCrunchは、当時の第三の理由として、透かしを導入しない競合サービスにユーザーが流れる懸念も挙げている。

こうした経緯を踏まえると、今回の導入からは、OpenAIが実際にどの懸念に対処できたのかが見えてくる。回避の問題は、同社自身の数字が示すとおり、依然として残っている。商業面の懸念については、単一の市場に限定することで折り合いをつけた。

批判者の数字ではなく、OpenAI自身の数字

条件が良好な場合、誤検知率を1%に設定すると、検出器は200トークンの透かし入り文章の約80%を検出し、400トークンでは約95%を検出する。単語の10%を同義語に置き換えると、検出率は92%から66%に低下する。4分の1を置き換えれば、17%まで落ちる。短い返答や数式、翻訳された文章は、そもそも検出が難しい。OpenAI自身も、理想的な条件下で高い性能を示しても「日常的な利用で信頼できる検出ができるとは限らない」と警告し、透かしが見つからなくても人間が書いた証明にはならないとしている。また、この印からユーザーを特定することもできないという。

つまりtextGrainは、何も考えずにコピー&ペーストした文章を見つけるには使えるが、少し時間をかけて編集する相手には心もとない。多言語で読み書きが行われるEUでは、翻訳による検出率の低下は、些細な問題ではない。

なぜEUなのか、なぜ今なのか

導入の法的根拠はAI法第50条だ。透明性に関する規則は8月2日に施行された。同条は、生成AIシステムの提供事業者に対し、合成されたテキスト、音声、画像、動画に機械可読な方法で印を付け、検出手段も提供するよう求めている。同日より前から市場に出ていたシステムは、ChatGPTを含め、12月2日までに対応しなければならない。法律事務所Cooleyの分析によると、違反した場合は最高1,500万ユーロ、または全世界の年間売上高の3%のうち、いずれか高い額の制裁金が科される可能性がある。

今回の導入が原則ではなく法的義務に沿っていることは、二つの点からよく分かる。一つ目は検出器だ。法律は検出手段を求めている。OpenAIはそれを開発したものの、利用できるのは審査を通った研究者と専門機関に限られ、申請が必要となる。同社はThe Decoderの報道によると、「結果を責任ある形で解釈できると判断した段階で」利用範囲を広げるとしているが、時期は示していない。リスボンやワルシャワの教師や編集者が、疑わしい文章を手元に持っていても、今すぐ確かめることはできない。

二つ目は対象地域だ。8月にClaudeの文章への透かし導入を始めたAnthropicは、ユーザーがどのようにモデルにアクセスするかにかかわらず、世界中で透かしを適用しており、一部のユーザーから反発も招いた。OpenAIは逆の道を選んだ。規制当局が罰金を科せる地域では初期設定でオン、それ以外では開発者が選択する方式とし、導入時点で世界一律の初期設定にはしなかった。透かしを付けない競合サービスへユーザーが移るという、かつての懸念がなくなったのなら、ここまで地域を分ける理由はほとんどない。

今後の焦点

OpenAIはtextGrainをオープンソースとして公開する予定で、GoogleのSynthIDなどの方式と同等か、それを上回る性能だとしている。コードが公開されれば、どちらの主張も検証できる。ブリュッセルにとって問われるのは、軽い編集で消えてしまい、ほとんど誰も実行できない検出器に頼る透かしが、AI生成の文章をほかのシステムでも識別できるようにすることを目的とした規則を満たすのか、という点だ。

12月2日を過ぎても、OpenAIの署名が初期設定で文章に付くChatGPTユーザーは、規制当局から請求書を突きつけられる可能性のある地域の人々だけだ。

タグ: , , , ,

Googleで追加する

ディスカッション

0件のコメントがあります。