ChatGPTにも電子透かし、AI生成文か判定可能に。OpenAI独自手法textGrainでEU AI法対応、APIでは全世界でオプトイン可能に

テクノロジー AI
テクノエッジ編集部ピックアップ

テクノエッジ編集部がピックアップしたニュースをお伝えします。

特集

OpenAIは今後数週間のうちに、AIが生成したテキストに目に見えない電子透かし「textGrain」を付与します。対象はEU域内のChatGPTとCodexの全プラン。EU AI法が求めるAI生成テキストの識別要件への対応です。

APIでは10月5日から、全世界の顧客が一部モデルで透かしを任意に有効化できるようになりました。透かしを読み取る検出ツールは、当面は審査を通過した研究者と専門機関のみに提供します。

■ 対象はEU域内の一部サービス

OpenAIによれば、テキストへの電子透かし付加は初期段階の技術であり限界があるため、EU AI法の要件を踏まえ段階的に導入します。

他社の対応をみると、Google は以前から自社の電子透かし技術 SynthID Text をGemini に導入済み。Anthropicは Claudeの文章へ SynthID 透かし導入を発表しており、APIやClaude Code、クラウド経由も含め、地域を問わず全世界で透かしを付与します。

OpenAI は2024年8月の時点で、AI生成文へのテキスト透かし技術を開発済みと発表していました。

当時の説明では、統計的な単語選択を使ったテキスト透かしは手動での言い換えなど部分的な改変には強い一方、透かしのない別の生成AIによる全文の書き直しや翻訳には弱く、AI生成であることを隠したい場合は容易に回避が可能。

一方で、英語を母語としない人がAIの助けを借りて書いたり、翻訳させた文章も「AI生成」と判定されるために、文章ツールとして使うことへの偏見を生みかねない点も挙げていました。

■ 単語の選び方に統計的な信号、SynthIDと同等以上と主張

OpenAIが導入する「textGrain」は、モデルの単語選択に目に見えない統計的な信号を埋め込む技術。検出器はこの信号の有無を調べ、OpenAIの透かしが含まれるかを判定します。基本的な仕組みとしては Google や Anthropic が導入する SynthID Text と同じ。

LLMが文章を生成する際の単語選びをわずかに偏らせることで文章そのものに透かしを埋め込むため、コピペしても手で書き写しても消えず、多少の段落入れ替えや書き換えでも残ります。

単語の偏りはわずかで、OpenAIだけが持つ秘密鍵と直前の文によって暗号的に決まるため、透かしありの文章から単純に統計をとっても見破れません。

ペンシルベニア大、イェール大の研究者とOpenAIが共著で公開した技術レポートによれば、秘密鍵と直前の文脈から作る疑似乱数に応じて次の単語の選択を偏らせつつ、鍵について平均すると本来の出現確率が保たれる設計です。偏らせる度合いには上限を設け、同じ質問に毎回同じ回答を返すような多様性の低下を抑える点が特徴。

自社による評価では、textGrainがGoogleの SynthID Text 含む他の手法と同等以上の性能だったとしていますが、比較の条件や数値は今回の発表文では示していません。OpenAIは画像と音声の透かしにはSynthIDを採用しており、テキストでは自社のtextGrainを選んだことになります。textGrain は今後オープンソース化する予定。

■ 短文と書き換えに弱く、検出は研究者限定

OpenAIが示した評価では、誤検出率を1%に設定した場合、心理学分野の文章で200トークンなら約80%、400トークンなら約95%で透かしを検出できました。一方、言葉の選択の自由度が低い数学の文章では検出率が大幅に下がります。別の評価では、400トークンの英語の文章で単語の10%を同義語に置き換えると検出率は約92%から66%に、25%を書き換えることで検出率は17%まで落ちました。

こうした限界から、検出ツールは当面一般公開せず、EUの行動規範に沿って個別に審査した研究者や専門機関に限って提供します。ツールが示すのは透かしの有無のみで、利用者や会話内容は特定しません。

OpenAIは電子透かしが検出されても、以下の点は分からないと強調しています。

・人間がどれだけ関与したか
・文章についての権利や責任の所在
・生成させたユーザーが誰か
・内容が正確か

逆に透かしが検出されなくても人間が書いた証明にはならないことや、透かしがあっても短すぎる文章、編集を経た文章からは検出できない場合もあり、他のAIモデルにより全文を翻訳した場合は消えると説明しています。

出力の品質については、最新のフロンティアモデルGPT-6 Astraで8種のベンチマークについて透かしありとなしを比較したところ、透かしの有無で優位の差は見られなかったとしています。

■ APIは即日、ChatGPTとCodexは数週間内

APIでの透かしは一部のモデルを対象に、10月5日から全世界でオプションとして有効化できるようになります。初期設定ではオフ。クラウドパートナー経由での提供も今後数週間で提供する予定です。

ChatGPTとCodexでは、今後数週間でEU域内の全プランの対象ユーザーに導入します。検出ツールの利用申請も同日に受付を開始しました。画像と音声については、従来どおり判定ツール openai.com/verify が利用できます。

《テクノエッジ編集部ピックアップ》

Amazon売れ筋ランキング

テクノエッジ編集部ピックアップ

テクノエッジ編集部がピックアップしたニュースをお伝えします。

特集

BECOME A MEMBER

『テクノエッジ アルファ』会員募集中

最新テック・ガジェット情報コミュニティ『テクノエッジ アルファ』を開設しました。会員専用Discrodサーバ参加権やイベント招待、会員限定コンテンツなど特典多数です。