OpenAIは2026年10月5日(現地時間)、欧州連合(EU)の人工知能法(EU AI Act)で義務付けられる生成テキストの識別性に対応するアプローチを公表した。同社はモデルが生成したコンテンツの出所を明確にし、透明性を高める目的で、API顧客向けに一部モデルでのテキスト透かしのオプトイン提供を開始。今後数週間以内にEU圏のChatGPTおよびCodexの出力にも不可視の透かしを追加する予定だ。透かし検出器へのアクセスは、初期段階として研究者や専門組織に限定される。
OpenAIのテキスト透かし技術テキストグレイン (textGrain)は、モデルの単語選択に不可視の統計的信号を追加し、検出器がその信号を探索する仕組みを採用している。同社は、テキストグレインがシンセティックID・フォー・テキスト (SynthID for text)を含む他社アプローチと同等またはそれ以上の性能を示したと評価している。技術の詳細は今後更新される技術レポートで公開され、オープンソース化も計画されている。
この技術には限界がある。短いテキストや、単語の選択肢が少ない数学のようなコンテンツでは検出が難しい。例えば、心理学の200トークンパッセージでは約80%、400トークンパッセージでは約95%の検出率を示すが、数学では大幅に低下する。また、テキストの編集も透かしを弱める要因となる。400トークンパッセージで単語の10%を類義語に置き換えると、検出率は約92%から66%に減少する。さらに25%を置き換えると、検出率は約92%から17%まで低下する。これらの限界から、検出器への初期アクセスは、信頼性と責任ある利用を評価・改善できる研究者や専門組織に限定される。
OpenAIは、最新のフロンティアモデル「アストラ (Astra)」のベンチマーク評価において、透かしの有無による出力品質に「意味のある性能差は見られない」と述べている。
テキスト透かしは、テキストがOpenAIシステムによって生成または処理されたことを示す限定的な信号であり、人間の貢献度、所有権、ユーザーの特定、情報の正確性を測定するものではない。検出されない場合でも、人間が作成したとは限らない。短い、編集された、翻訳されたテキストや、サポート対象外のモデル、透かし導入前の生成物、他社ツールによるものも検出されにくい。
今後のステップとして、EU圏でのChatGPTおよびCodexユーザーへのテキスト透かし展開、API顧客向けのオプトイン機能の提供、そして研究者や専門組織への検出器アクセスを継続する。これらのアプローチは、技術、標準、エビデンスの進化に伴い再検討される予定だ。OpenAIは、コンテンツ出所の証明に際し、オープンスタンダード、耐久性のある透かし、検証ツールを組み合わせた多層的なアプローチを取っている。画像と音声については、Content Credentials、C2PA準拠、SynthID透かし、openai.com/verify、Content Provenance APIを活用している。
参考: OpenAI Blog (アーカイブ) — 2026年9月29日 04:00 (JST)