https://www.informationsecurity.com.tw/seminar/2026_Finance/
https://www.informationsecurity.com.tw/seminar/2026_Finance/

新聞

OpenAI 將在歐盟為 ChatGPT 與 Codex 文字加入隱形浮水印,技術名為「textGrain」

2026 / 10 / 06
編輯部
OpenAI 將在歐盟為 ChatGPT 與 Codex 文字加入隱形浮水印,技術名為「textGrain」
ChatGPT 開發商 OpenAI 近日宣布,未來幾週內將在歐盟(EU)使用者的 ChatGPT 與程式開發工具 Codex 文字輸出中,加入肉眼看不見的浮水印。這項技術名為「textGrain」,使用者閱讀或複製文字時都看不出差異。全球的 API 開發者則從即日起可自行選用,不過預設為關閉,目前還不是全球預設設定。

歐盟自動套用,API 開發者自行選擇

依外媒報導,歐盟使用者會在未來幾週內,陸續收到帶有浮水印的 ChatGPT 與 Codex 文字。API 部分,全球開發者現在就能針對支援的模型選擇啟用浮水印,但這項設定預設為關閉。換句話說,目前只有歐盟是由 OpenAI 主動套用,其他地區的 API 使用者仍須自行決定是否開啟。

微調選字偏好,埋入統計訊號

「textGrain」不是在文字上加標記,而是微調模型的選字偏好,讓產生的文字帶有特定的統計模式(statistical pattern)。偵測工具之後會尋找這項訊號,藉此評估內容是否帶有 OpenAI 的浮水印。

OpenAI 表示,在最新的 GPT-6 Astra 模型上開啟浮水印,基準測試(benchmark)結果與未開啟時相近,對輸出品質沒有明顯影響。

偵測率與文字長度、主題有關

偵測率會隨文字長度與主題而改變,文字越長,模型留下的選字痕跡越多,偵測就越容易。OpenAI 的測試顯示,200 個詞元(token)的心理學回答,在 1% 誤判率(false-positive rate)的條件下,偵測率約為 80%。文字拉長到 400 個詞元時,偵測率提高到約 95%。

數學類內容的表現則較差。原因是數學文字可選用的字詞變化有限,模型能調整選字偏好的空間不大,訊號也就不容易留下。

同義詞替換會明顯降低偵測率

浮水印的另一個限制是怕編輯。OpenAI 的測試中,把 400 個詞元段落裡 10% 的字詞換成同義詞,偵測率從約 92% 降到 66%。替換比例提高到 25% 時,偵測率只剩約 17%。換算下來,只改動 10% 的字詞,偵測率就少了約 26 個百分點。外媒報導指出,文字浮水印並不完美,OpenAI 自家測試也顯示,一般程度的編輯就足以大幅削弱偵測能力。

沒有偵測到不代表人類撰寫

OpenAI 也說明了這項技術做不到的事。沒有偵測到浮水印,不代表文字出自人類之手。浮水印無法揭露文字由誰產生,也看不出帳號、提示詞(prompt)或對話內容,更無法得知人類編輯了多少比例。經過編輯、長度較短或翻譯後的文字,也可能偵測不到。

至於浮水印偵測工具,OpenAI 已開放申請,但初期僅限經核准的研究人員與專家機構使用。

本文轉載自 BleepingComputer。