OpenAI 要在歐盟為 ChatGPT 與 Codex 的文字加上看不見的浮水印,並開放偵測器給審核過的研究人員。公司自己也坦白,這套技術對付長篇、輕度編輯過的內容遠比簡短回答管用。
OpenAI 為什麼現在要為文字加浮水印
歐盟《人工智慧法案》(EU AI Act)要求生成式 AI 的提供者,必須讓生成的文字能用機器辨識。OpenAI 在 10 月 5 日公布做法,時間點扣著法案第 50 條,這條透明度規定自 2026 年 8 月 2 日起適用,已在市場上的系統則有 2026 年 12 月 2 日的期限。
整套計畫分三塊。全球的 API 客戶即日起可選擇加入文字浮水印,適用部分模型,預設是關閉的。接下來幾週,OpenAI 會在歐盟為符合條件的 ChatGPT 與 Codex 文字輸出加上隱形浮水印。公司同時開放浮水印偵測器的申請,初期只給審核過的研究人員與專家機構,協助評估可靠性。
最後那一點,決定了這套系統在實務上有多好用。一般使用者與多數平台目前無法自己檢查一段文字,至少還不行。浮水印只出現在產出端,驗證則被關在門後,等 OpenAI 把可靠性評估清楚。
textGrain 如何把浮水印藏進 ChatGPT 文字
OpenAI 把方法叫做 textGrain。它在模型挑詞的過程中,加入一層看不見的統計訊號。對讀者來說,句子看起來毫無異樣。但偵測器知道那套模式,會去檢查一段文字是否帶著它。
圖片與音訊的驗證早就靠公開工具運作,像 openai.com/verify 頁面與 Content Provenance API,任何人都能用。文字是更難的一題,因為沒有檔案可以把簽章附上去。
浮水印在哪裡會失靈
OpenAI 對限制講得異常直接。在自家評測裡,把誤報率目標設在 1% 時,偵測器對心理學這類內容,能抓出約八成的 200 詞元段落,400 詞元段落約九成五。換到數學,因為選詞的自由度小,檢出率就掉得很快。
編輯會讓訊號迅速變弱。在 400 詞元的段落上,把一成詞語換成同義詞,檢出率從約 92% 掉到 66%。換掉四分之一,只剩 17%。
情境 | 檢出率 |
|---|---|
200 詞元段落 | 約 80% |
400 詞元段落 | 約 95% |
400 詞元、替換一成詞語 | 約 66% |
400 詞元、替換四分之一詞語 | 約 17% |
想揪出 AI 文字的人該記住的重點是:簡短回答、充滿公式的內容、只稍微改寫過的段落,正是浮水印訊號最弱的地方。OpenAI 說它拿 textGrain 跟其他方法比過,包括 Google 的文字版 SynthID,在理想條件下打平或更好,同時也提醒,實驗室裡表現強,不代表日常偵測就可靠。
偵測器對研究人員與讀者代表什麼
偵測器之所以重要,是因為浮水印得有人能讀出訊號才有用。OpenAI 把早期存取限給審核過的研究人員與專家機構,讓他們協助測試可靠性、找出負責任的用法。
這裡有個隱私層面值得點出來。溯源可以證明某人借助過 AI 助理,即使那個用途本身合法、私密,或在商業上敏感。浮水印也判斷不了文字的真假。人可以寫假話,模型也能產出正確的內容。這個訊號唯一能做的,是暗示文字從哪裡來。
文字浮水印足以撐起歐盟法案的要求嗎
OpenAI 把文字浮水印定位成還在早期的技術,有明顯限制,分階段上線正反映了這個態度。API 客戶預設關閉、偵測器限制存取,都是預留的緩衝,不是疏漏。
如果你在 API 上開發,浮水印是一個可以打開的開關,不主動開啟就維持關閉。如果你是歐盟的 ChatGPT 使用者,接下來幾週那個隱形標記會悄悄到位,不管你察覺與否。對其他人來說,真正的問題是:一個只要輕度編輯就會消散的訊號,撐得起法律要求它扛的重量嗎?OpenAI 說打算把這項技術開源,讓其他人能接手、獨立測試,慢慢回答這個問題。






