OpenAI、EUでChatGPTとCodexの出力に透かし - APIは任意で既定オフ、検出器は研究者らに限定

OpenAI、EUでChatGPTとCodexの出力に透かし - APIは任意で既定オフ、検出器は研究者らに限定

OpenAIが2026年10月5日、EU AI法のテキスト来歴ルールへの対応を公表。EUのChatGPTとCodexでは今後数週間でテキスト出力に不可視の透かしを入れ、APIでは全世界の顧客がプロジェクトまたは組織単位で任意に有効化できる(既定はオフ)。検出器は当面、承認を受けた研究者・専門機関に限る。

OpenAIは2026年10月5日、EU AI法のテキスト来歴(provenance)ルールにどう対応するかを公表した1。内容は3本立てになっている。APIでは同日から、世界中の顧客が一部のモデルについてテキストの透かしを任意で有効にできる。既定はオフのままだ。EUのChatGPTとCodexでは、今後数週間のうちに対象となるテキスト出力へ不可視の透かしを入れる。そして透かしを見つける検出器は、当面、承認を受けた研究者と専門機関にだけ開放する。

EU AI法は、生成AIの提供者に対し、生成したテキストを機械可読な形で識別できるようにすることを求めている。OpenAIはテキストの透かしと検出を「大きな限界を抱えた初期段階の技術」と位置づけ、法の要件と技術の限界の両方を踏まえて段階的に進めるとしている1。

EUのChatGPTとCodexは全プランが対象、適用はEUだけ

OpenAIによると、透かしは今後数週間でEU域内の対象となるChatGPTとCodexの利用者に導入され、プランは問わない。一方で、適用はEUに限り、開始時点では全世界の既定にはしない。地域を絞る理由について、同社は実際の利用とフィードバックから学ぶ余地を残すためだと説明している1。

どの出力が「対象(eligible)」になるのか、発表文は具体的な条件を示していない。参考になるのはヘルプセンターの説明で、EU AI法の「AI生成コンテンツの透明性に関する行動規範」は、200トークン未満(英語でおよそ150語)の出力とコード片には透かしを求めていないという2。ただしこれは行動規範の扱いの説明であり、OpenAIがそのまま除外条件にしているとまでは書かれていない。

APIはプロジェクト単位か組織単位で有効化する

APIでの設定方法はヘルプセンターにある2。組織全体の既定は「Organization settings → Data controls → Text provenance」、プロジェクトごとの上書きは「Project Settings → Text provenance」で設定し、「Allow text watermarking」をオンにして対象モデルを選び、保存する。どちらの単位でも、透かしを付けるモデルを個別に選べる。対応モデルで有効にすれば、生成の段階でOpenAI側が透かしを入れるので、応答ごとに印を付ける処理を自前で書く必要はない。

対応モデルは設定画面に一覧が出る仕組みで、ヘルプセンターはモデル名を挙げていない。今後数週間で、対象を全レガシーモデルに広げる予定だという2。クラウド事業者を経由してOpenAIのモデルを使う場合についても、同じく今後数週間で透かしを使えるよう各社と調整を進めているとしている1。

OpenAIは、APIで有効化を顧客に委ねる理由を、透かしを自社の透明性義務や利用者に提供する体験にどう組み込むかを顧客自身が決められるようにするため、と説明している1。

注意したいのは、透かしを有効にしても検出器が使えるようにはならない点だ。ヘルプセンターは、テキスト検出器へのアクセスは現時点で承認を受けた研究・学術機関に限られると明記している。また、透かしやC2PAメタデータはソフトウェアが読み取るための情報で、求められる可能性のある可視のラベル・バナー・告知の代わりにはならない。個別の法的義務についてOpenAIは助言できないので、自社の法務で判断してほしいとしている2。

textGrainの検出率は文の長さ・内容・編集で大きく変わる

OpenAIの透かし技術は「textGrain」と呼ばれ、モデルの単語選択に目に見えない統計的なシグナルを加える1。技術レポートも公開されており、OpenAIはこれを今後数週間で追補し、技術自体もオープンソースで公開する予定だとしている。ヘルプセンターによれば、隠し文字や透かし専用のトークンを差し込む方式ではない2。TechCrunchは、技術レポートがペンシルベニア大学とイェール大学の研究者との共著だと伝えている3。

性能について、OpenAIは自社の評価でtextGrainが「SynthID for text」を含む他の方式と同等かそれ以上だったと述べる。そのうえで、理想的な条件での好成績が日常の利用で確実に検出できることを意味するわけではない、とも書いている。公表された数値は次のとおりで、いずれも偽陽性率1%を目標にした条件での結果である1。

  • 心理学のような内容では、200トークンの文章で約80%、400トークンで約95%を検出した。数学のように言い回しの自由度が低い内容では、検出率は大幅に下がる
  • 400トークンの文章で単語の10%を同義語に置き換えると、検出率は約92%から66%に下がった。25%を置き換えると17%になった

言語による差もある。ヘルプセンターでは、英語で作った500件の合成プロンプトをEUの他の23の公用語に翻訳して24言語で評価しており、偽陽性率1%での検出率はスペイン語の69.0%が最も高く、ルーマニア語の42.2%が最も低かった2。検出率が60%を下回る言語では、透かしの強さを調整して改善を図ったという。

出力の品質と速度への影響は小さいとしている。OpenAIは、同社が最新のフロンティアモデルと位置づけるAstraの評価に使うベンチマーク群で、透かしの有無による意味のある性能差は見られなかったとし、8項目の比較表を載せている1。速度への影響もごくわずかだという2。

検出器を一般公開しない理由と、透かしが示さないこと

OpenAIは、こうした限界があることが、検出器を当面は研究者と専門機関に限る判断につながったと説明している。見逃しと誤検出のリスクを踏まえ、開始時点では一般公開しない。アクセスは行動規範に沿ってケースごとに審査し、ツールはOpenAIの透かしを検出したかどうかだけを返し、利用者を特定したりプロンプトや会話を明かしたりはしないとしている。画像と音声については、openai.com/verify と Content Provenance API による検証をこれまでどおり公開で提供する1。

発表は、透かしで分からないことにも一節を割いている1。透かしはOpenAIのシステムが文章の一部を生成または処理したことを示しうるが、人がどれだけ判断・編集・創作を加えたかは測れない。所有者や責任の所在も決めないし、利用者を特定せず、内容の正確さも保証しない。逆に、透かしが検出されなくても人が書いた証明にはならない。短すぎる、編集・翻訳されている、対応外のモデルによる、透かし導入前に作られた、他社のツールで生成された、といった場合が考えられるからだ。

Claudeは全世界で適用、OpenAIはEU限定と任意

テキストの透かしをめぐる動きは、EU AI法第50条の透明性義務を軸に進んできた。欧州委員会は7月20日に透明性義務のガイドラインを公開し、義務は2026年8月2日から適用された。同日より前に市場投入されたシステムについては、ラベリング等の要件への対応期限が2026年12月2日とされている。

Anthropicは8月、Claudeの生成テキストに不可視の透かしを入れる方針を公表し、API(Claude Platform)を含め、Claudeが提供されている場所であれば世界中で適用するとした。仕組みの解説では、地域ごとに適用範囲を絞る持続的な方法がまだないことを全世界適用の理由に挙げている。検出側では9月に透かし検出APIのプライベートプレビューを始め、利用できるのは規制当局、法執行機関、メディア、ファクトチェッカー、独立研究者、教育機関、EUの市民社会団体といった、EU法上の要件を満たす組織に限られる。

OpenAIの今回の方針は、この線引きの位置が異なる。透かしを自動で入れるのはEUのChatGPTとCodexに限り、APIは顧客が選ぶ方式で既定はオフ。検出器について発表が挙げている対象は研究者と専門機関で、Anthropicの既報にある列挙とは書き方が違う。OpenAIは技術・標準・証拠の進展に合わせて各項目を見直すとしており1、地域の範囲や既定値はこの先も変わりうる。

API利用者と、文章を受け取る側への影響

APIでOpenAIのモデルを使っている事業者にとって、まず確認すべきは既定値だ。設定を変えなければテキストに透かしは入らない。EU向けに生成テキストを届けるサービスを運営している場合は、自社の透明性義務と照らして、組織単位で一括して有効にするか、EU向けのプロジェクトだけで有効にするかを判断することになる。先に見たとおり、透かしは可視のラベル表示の代わりにはならないので、表示の要否は別に検討が要る。

EUでChatGPTやCodexを使う組織では、今後数週間で出力に透かしが入り始める。ヘルプセンターは、文言をそのまま使えば再利用先でもシグナルが残ると見込む一方、大幅な書き換えや言い換え、翻訳では検出の信頼性が下がるとしている2。

文章を受け取る側に立つと、OpenAIのテキスト検出器は一般に公開されておらず、届いた文書にOpenAIの透かしがあるかを手元で確かめる手段はない。仮に検出できるようになっても、OpenAI自身が示した検出率と「検出されない=人が書いた、ではない」という説明を踏まえると、応募書類やレポートの真偽を透かしだけで判定する運用は成り立ちにくいと考えられる。

Sources

  1. Our approach to EU text provenance rules - OpenAI公式発表(2026年10月5日)
  2. Provenance signals in OpenAI-generated content - OpenAIヘルプセンター(API設定手順・言語別の検出率)
  3. OpenAI will start watermarking ChatGPT’s text in the EU - TechCrunch(2026年10月5日)

最新のAIニュースをほぼ毎日更新しています。

RSSで購読する 更新をいち早くチェックできます。

他のキーワードで探す →