EUのAI法は、AIが作った文章を機械が識別できる形にするよう求める。OpenAIは「textGrain」と呼ぶ見えない透かしをChatGPTに入れる。ただし同社自身、この技術の限界を認めている。
OpenAIのtextGrainとは何か
米OpenAIは10月5日、生成テキストに電子透かしを入れる方針を発表した。EU(欧州連合)のAI規制「AI Act」への対応だ。AI Actは、生成AIを使う事業者に対し、生成された文章を機械が読み取れる形で識別可能にするよう義務づける。OpenAIはこの要求に沿う最初の大きな動きとして、自社の技術を公開した。
中核となるのが「textGrain」という透かし技術だ。仕組みは単純化すればこうなる。モデルが次に出す単語を選ぶとき、複数の候補のうちどれを選ぶかに、目に見えない統計的な信号を混ぜ込む。専用の検出器は、その信号の有無をたどって、その文章に自社の透かしが入っているかを判定する。
文章の見た目は何も変わらない。読者が読んでも、通常のChatGPTの出力と区別はつかない。
OpenAIがtextGrainを入れる範囲
OpenAIはこの透かしを、3つの経路で展開する。
1つ目はAPIだ。10月5日から、世界中のAPI利用者が一部モデルでテキスト透かしを選べるようになった。ただし既定はオフで、使う側が明示的に有効化しないと入らない。
2つ目はEU域内のChatGPTとCodexだ。今後数週間をかけて、対象となるテキスト出力に見えない透かしが自動で加わる。無料を含む全プランが対象になる。
3つ目は検出器の開放だ。OpenAIは透かし検出器へのアクセス申請を始めたが、当初は審査を通過した研究者と専門機関に限る。
既に公開されている画像と音声の検証ツールは、これまで通り誰でも使える。今回の変更はテキストの来歴だけを対象にしている。
textGrainの検出精度と限界
OpenAIが自ら公表した数字は、この技術の実力を正直に映している。理想的とは言えない条件では、検出は簡単ではない。
検出器には2種類の誤りがある。透かしが無いのに「ある」と判定する誤検知と、透かしがあるのに見逃す見落としだ。誤検知率を1%に抑えた設定で、心理学のような内容の文章200トークンでは約80%を検出できた。400トークンなら約95%まで上がる。文章が長いほど検出しやすい。
逆に短い文章や、言葉の選び方に自由度が少ない内容は苦手だ。数学のような文章では検出率が大きく下がる。単語の選択肢が狭いと、透かしを埋め込む余地も減るからだ。
編集にも弱い。400トークンの文章で単語の10%を類語に置き換えると、検出率は約92%から66%へ落ちた。25%を置き換えると17%まで下がる。人が少し手を入れるだけで、透かしは薄くなる。
OpenAIがtextGrainで判断を限定した理由
なぜ検出器を誰にでも開放しないのか。上の限界がその答えだ。誤検知が起きれば、無実の文章が「AI製」と疑われる。見落としが起きれば、対策として機能しない。だからOpenAIは、信頼性と適切な使い方を評価できる相手に限定して、まず検出器を渡す道を選んだ。
同社は、この技術をオープンソースで公開する計画も示している。誰もが検証できる形にすることで、透かしの信頼性を外に委ねる狙いだ。
textGrainがChatGPTの品質に与える影響
透かしを入れても、出力の質は落ちない。OpenAIは最新モデル「Astra」を使った複数の評価で、透かしの有無による意味のある差は見られなかったと報告している。
一例として、総合指標のArtificial Analysis Intelligence Indexは、透かし無しで49.57点、透かし有りで49.76点だった。コーディングのDeepSWE v1.1は72.80%対71.68%とわずかに下がるが、コマンド操作のTerminal-Bench 4.0は53.90%対56.06%と逆に上がった。差はいずれも誤差の範囲で、品質低下として扱える水準ではない。
つまりユーザーにとって、透かしが入っても普段の使い勝手は変わらない。変わるのは、出力の後ろに「これはOpenAIのモデルが関与した」という微弱な信号が付くかどうかだけだ。
textGrainで何が分かり、何が分からないか
透かしがあるからといって、分かることは限られる。OpenAI自身が説明している通り、透かしは「その文章に自社システムの関与があった」という弱い信号にすぎない。
分かるのは、その文章がOpenAIのモデルで生成または処理された可能性だ。分からないのは、人間がどれだけ関与したかだ。人が下書きを書いてAIが整えた場合と、AIが一から書いた場合を、透かしは区別しない。文章が盗用かどうかも、内容が正確かどうかも判定しない。
EUに住む読者にとって、実務的な意味はこうなる。今後数週間で、ChatGPTが書いた文章には見えない透かしが入る。それは出力の質を下げないが、その文章が「完全に人間の手によるもの」ではないことを示す信号になる。日本の利用者には当面、直接の変化はない。APIで透かしを使いたい開発者は、今すぐオプトインで試せる。技術の詳細は、今後数週間で更新される技術レポートとオープンソース版で確かめられる見通しだ。






