規制

OpenAI、EU AI法の規則に基づき段階的にテキスト透かし付けを開始

mm
Unite.AI を Google の優先ソースに追加

OpenAIは2026年10月5日、テキスト透かし付けへのアプローチを示し、EU AI Actの下で、API顧客全世界にオプトイン透かし付けを提供開始し、今後数週間で欧州連合内の対象となるChatGPTおよびCodexのテキスト出力に見えない透かしが追加されると発表した。

EU AI法は、生成AIプロバイダーに対し、生成されたテキストを機械可読な形で識別可能にすることを求めている。OpenAIはテキスト透かし付けと検出を初期段階の技術であり、重要な制限があると説明し、段階的アプローチは法的要件とこれらの制限の両方を反映していると述べた。

オプトインAPIアクセスと欧州地域での展開

2026年10月5日以降、全世界のAPI顧客は特定モデルに対してテキスト透かし付けをオプトインでき、設定はデフォルトでオフのままである。OpenAIは、オプトイン設計により顧客が透かし付けを透明性義務やユーザー体験にどのように組み込むかを選択できるとし、クラウドパートナーと協力して、今後数週間で同社のサービスを通じてアクセスされるOpenAIモデル出力に透かし付けを提供できるように取り組んでいると述べた。

自社製品に関しては、OpenAIは欧州連合内の対象となるChatGPTおよびCodexユーザー向けに、すべてのプランでテキスト透かし付けを導入する予定で、これも今後数週間で実施される。同社は、ローンチ時にテキスト透かし付けを全世界でデフォルトにするつもりはなく、地域別アプローチにより実際の利用とフィードバックから学べると述べた。

OpenAIは2026年10月5日にテキスト透かし検出器へのアクセス申請も開始した。アクセスは当初、承認された研究者および専門機関に限定され、ケースバイケースでEUのCode of Practice on transparency of AI-generated contentに従って付与され、テキストの出所評価と改善を支援する。今回の発表はテキストにのみ適用され、OpenAIは音声や画像用の検証ツール(openai.com/verify のウェブツールや Content Provenance API を含む)は引き続き一般に公開されていると述べた。

textGrain の仕組み

OpenAIの透かし技術であるtextGrainは、モデルが選択する単語に見えない統計的シグナルを埋め込み、同社の検出器はそのシグナルをテキスト内でテストしてOpenAIの透かしが付いているかを判断する。技術報告書「textGrain: Entropy-Calibrated Watermarking for Language Model Text」(2026年10月5日付)では、University of Pennsylvania、Yale University、OpenAIに所属する著者が掲載されている。

報告書によると、この手法はGumbel乱数に基づくコストを持つ最適輸送問題を解くことで、キー付き乱数性とトークン生成を結び付け、Kullback–Leibler正則化が独立性からの逸脱にペナルティを課す。エントロピーバジェットは透かしシグナルと引き換えに放棄される平均サンプリングエントロピーを上限とし、報告書はKLペナルティが透かしが除去する平均エントロピーと正確に等しいと述べ、強度パラメータに直接的な情報理論的意味を与えている。語彙トークンのキー付きブロックに輸送ステップを適用することで、最適化の規模を縮小しつつ、各ブロック内の相対的トークン確率は変わらないままに保たれる。検出器は生成されたテキストとシークレットキーだけを必要とし、生成時に使用されたエントロピーバジェットは不要である。

OpenAIはこの技術をオープンソースとして公開し、他者がそれを基盤に構築できるようにする計画であり、報告書は今後数週間で追加の詳細を加えて更新されると述べた。

検出性能と明示された制限

OpenAIは評価において、textGrainがテストした他の手法(テキスト向けSynthIDを含む)と同等またはそれ以上の性能を示したと報告したが、理想的な条件下での高性能が日常使用における信頼できる検出を保証するものではないと注意喚起した。

目標偽陽性率を1%に設定した場合、検出器は心理学などのコンテンツにおいて200トークンの文章の約80%、400トークンの文章の約95%で透かしを検出したとOpenAIは報告した。語彙選択の自由度が低い数学などのコンテンツでは検出率は大幅に低下した。400トークンの文章の評価では、単語の10%を同義語に置き換えると検出率が約92%から66%に低下し、25%置き換えると17%にまで低下した。これらの評価は、ELI5データセットの質問に対する透かし付き英語回答を使用した。

出力品質に関して、OpenAIは最新のフロンティアモデルであるAstraを評価するために使用するベンチマーク全体で、透かしの有無による有意な性能差は見られないと述べた。公開された表では、透かしなしテキストと透かしありテキストそれぞれについて、Artificial Analysis Intelligence Indexで49.57点と49.76点、GPQA Diamondで94.44%と93.94%と報告されている。OpenAIは、検出の制限が初期の検出器アクセスを承認された研究者および専門機関に限定する決定に寄与したと述べた。

透かしが確立しないこと

OpenAIは、テキストのウォーターマークはそのシステムが文章で果たした役割に関する限定的なシグナルを提供すると述べています。ウォーターマークは人間の貢献度を測定せず、所有権や責任を確立せず、ユーザーを特定せず、正確性を検証もしない、と同社は述べています。また、ウォーターマークが検出されなかったからといって人間が執筆したことを証明できないとしています。なぜなら、テキストが短すぎる、編集された、あるいは翻訳されたために信頼できる検出ができない場合や、対応していないモデルから生成された場合、ウォーターマーク導入前のもの、または他社のツールで生成された可能性があるからです。

検出器は、ユーザーやプロンプト、会話内容を特定したり開示したりすることなく、OpenAIのウォーターマークが検出されたかどうかを報告します。ウォーターマークの見逃しや誤検出のリスクを考慮し、OpenAIはリリース時にこのツールを一般公開しない方針です。

EUの透明性義務

AI法第50条に基づく透明性義務は、AI生成コンテンツのマーキングと検出、ディープフェイクや特定のAI生成出版物のラベリングを対象とし、2026年8月2日から適用されます。AI生成コンテンツの透明性に関する実践規範は、AIオフィスが主導するマルチステークホルダーのプロセスで独立した専門家により策定され、最終コードは2026年6月10日に公表されました。

コードへの遵守は任意ですが、第50条の透明性要件は法的義務です。欧州委員会とAI委員会は、このコードがコンプライアンスを示すための適切な自主的ツールであることを確認しており、2026年7月末までに約190社・組織がコードに署名したと委員会は報告しています。

OpenAIは、検出機能の改善を継続し、ウォーターマークが編集や翻訳にどの程度耐えるかを研究し、AI支援とAI著作を区別する方法を模索するとともに、結果が責任ある形で解釈できると判断した場合に検出器へのアクセスを拡大すると述べています。

ソフィー・デナールは、Unite.AIのAI生成ジャーナリストで、世界中の市場における人工知能の政策、規制、ガバナンスを担当しています。彼女の仕事は、国家および国際的な規制枠組みが、長期にわたってAI技術の開発、導入、商業化にどのように影響するかを調査することに焦点を当てています。
外交的かつ世界的に情報を得た視点から、ソフィーは政府、多国間機関、規格団体からの政策イニシアチブを追跡し、さまざまな規制アプローチがイノベーション、競争、市場アクセスにどのように影響するかを分析しています。彼女は、国境を越えた影響、コンプライアンスの課題、リスク管理と技術進歩のバランスに特に注意を払います。
ソフィー・デナールによって執筆された記事は、AIの政策および規制開発に関する正確性、中立性、責任ある報道を確保するために、Unite.AIの編集チームによってレビューされたAI生成記事です。