OpenAI は10月5日、ChatGPT と Codex が EU で生成する文章に、目に見えない透かしを入れ始めると発表した。EU の AI 規則に対応するためで、対象となる文章への適用は今後数週間かけて進める。API を使う開発者は、同じ日から世界中で、一部のモデルの文章に透かしを入れる設定を選べるようになった。
今回の発表で目新しいのは、透かしの弱さを数字で出してきたことだ。文章の1割の語を同義語に置き換えるだけで、検出できる割合は大きく下がる。この数字は、AI を使って書く側にも、AI が書いたかを気にする読む側にも、印をどこまで当てにできるかの目安になる。
速報では発表の骨子だけを伝えた。ここでは仕組みと数字を見ていく。
EU の ChatGPT と、世界の API から
範囲を先に整理しておく。
- EU の ChatGPT と Codex — 対象となる文章に透かしが入る。今後数週間で順次
- 世界中の API 利用者 — 一部のモデルで、透かしを入れる設定を自分で有効にできる。報道によれば初期設定はオフ
- 画像と音声 — OpenAI のモデルで作られたかを確かめる道具は、すでに提供している
つまり、日本で ChatGPT を使っている人の文章に、今回の発表で透かしが入るわけではない。入るとすれば、API を使ったサービスの運営者が設定を選んだ場合だ。Anthropic は8月に、Claude が生成する文章への透かしを全世界の製品で始めると発表しており、範囲の取り方は2社で分かれた。
textGrain は語の選び方に印を残す
方式の名前は textGrain という。同時に公開された技術報告によると、AI が文章を1語ずつ作るとき、次の語の選び方を、秘密の鍵から作った乱数に少しだけ寄せる。人の目には普通の文章のままだが、同じ鍵を持つ検出器が文章を読むと、語の並びにその偏りが統計的に浮かび上がる。
検出に要るのは文章と鍵だけで、生成時の細かい設定は要らない、と報告は書いている。裏を返せば、鍵を持たない人には検出できない。報道各社が伝える OpenAI の説明では、検出の道具はまず研究者や専門機関に限って提供し、信頼性が確かめられるにつれて広げるという。
1割の言い換えで66%、4分の1で17%
報道各社が伝える OpenAI の評価では、400トークンほどの文章なら、手を加えていない状態で9割台を検出できる。ところが語の10%を同義語に置き換えると検出率は66%に、25%を置き換えると約17%に落ちる。翻訳や大きな書き換えでも印は弱まる。
短い文章では、見逃しも誤検出も起きやすい。数学のように言い回しの選択肢が少ない分野も、印を入れる余地が小さく検出しにくい。
この数字から読めるのは、透かしが手を加えていない AI の文章を見つけるには役立っても、AI を使ったかどうかを判定する道具にはならない、ということだ。人が少し手を入れた文章は、印の上では人の文章に近づいていく。
印が言えないこと
OpenAI 自身も、透かしが示さないことを並べている。報道によれば、利用者やアカウントは特定しない。文章のうち人が書いた部分の割合も、内容の正しさも、誰の著作物かも示さない。そして、透かしが見つからないことは、人が書いた証明にならない。
この線引きは、Claude の透かしを取り上げた8月の記事で見たものとほぼ同じだ。各社の印は、どれも「その AI を通った可能性」までしか言わない。
書く側と読む側が決めておくこと
書く側にとっては、印の有無よりも、自分がどう AI を使ったかを説明できることのほうが重い。下書きを任せたのか、校正だけか、事実の確認は誰がしたのか。言い換え1割で検出が大きく揺らぐ以上、印の結果が自分の使い方を正しく映すとは限らない。
読む側、たとえば学校や職場で提出物を受け取る側は、検出の結果を判定の根拠にしない運用を先に決めておくほうがいい。いまは検出の道具そのものが手元にない。仮に手元に来ても、66%や17%という数字は、検出されない AI の文章が少なくないことを示している。
次に見るのは、EU での ChatGPT への適用が実際に始まる時期と、検出の道具が研究者の外にいつ開かれるかだ。どちらも、OpenAI が EU 向けの文章の来歴表示について出した発表ページで追える。
ことば
- 透かし (ウォーターマーク) — 生成した文章や画像に、目には見えない形で入れる識別の印。文章の場合は語の選び方の偏りとして入り、鍵を持つ検出器だけが読み取れる。
- EU AI 規則 — EU の人工知能の規則。生成 AI の提供者に、作った内容を機械で判別できる形で示すことを求める透明性の条項が、すでに適用されている。
- トークン — AI が文章を扱うときの最小の単位。語より少し細かい単位で数え、検出の精度は文章が長いほど上がる。
あなたが AI に手伝わせた文章を誰かに出すとき、その手伝わせ方を、印の有無と関係なく説明できるだろうか?

