OpenAI/官方:公布歐盟文字溯源做法——API 即日起可自願開啟 textGrain 隱形浮水印;未來數週為歐盟 ChatGPT 與 Codex 文字輸出加水印;偵測器先限獲批研究機構申請;四百詞元偵測率約九成五,改寫兩成半字詞即跌至約一成七

Key takeaway

OpenAI 於香港時間十月五日晚公布其回應歐盟《AI 法案》文字溯源要求的做法:由即日起,全球 API 客戶可為指定模型自願開啟文字浮水印,預設仍屬關閉;未來數週,歐盟境內合資格的 ChatGPT 與 Codex 文字輸出將加入肉眼不可見的浮水印,但不會作為全球預設。

OpenAI/官方:公布歐盟文字溯源做法——API 即日起可自願開啟 textGrain 隱形浮水印;未來數週為歐盟 ChatGPT 與 Codex 文字輸出加水印;偵測器先限獲批研究機構申請;四百詞元偵測率約九成五,改寫兩成半字詞即跌至約一成七

OpenAI 於香港時間十月五日晚公布其回應歐盟《AI 法案》文字溯源要求的做法:由即日起,全球 API 客戶可為指定模型自願開啟文字浮水印,預設仍屬關閉;未來數週,歐盟境內合資格的 ChatGPT 與 Codex 文字輸出將加入肉眼不可見的浮水印,但不會作為全球預設。

這套名為 textGrain 的技術在用字選擇中嵌入統計訊號。官方數據顯示,在 1% 誤報率目標下,400 詞元的心理學類文字偵測率約 95%,200 詞元約 80%;但以同義詞替換四分之一字詞後,偵測率跌至約 17%。由於誤報與漏報風險,偵測器暫只開放予獲批的研究人員與專業機構申請,不會公開。

OpenAI 公布歐盟文字浮水印方案:API 即日可選用 textGrain,ChatGPT/Codex 歐盟輸出數週內加隱形水印

本文以 OpenAI 官方網站十月五日發布的《Our approach to EU text provenance rules》、同日公開的 textGrain 技術報告,以及歐盟委員會「AI 生成內容透明度行為守則」官方頁面為主要依據,來源真實性已驗證。下文整理新措施的範圍、技術原理、實測限制,以及對香港企業與開發團隊的影響。

一、核心事件:三步走的歐盟文字溯源方案

歐盟《AI 法案》第 50 條要求生成式 AI 供應商以機器可讀方式標示其生成內容。歐盟委員會官方頁面指出,相關透明度義務自 2026 年 8 月 2 日起適用;配套的《AI 生成內容透明度行為守則》屬自願簽署,但第 50 條本身是法律義務,至 2026 年 7 月底約有 190 間企業及機構簽署守則。

OpenAI 今次公布的分階段做法如下:

技術細節

  • API 自願開啟(即日起,全球):API 客戶可為指定模型開啟文字浮水印輸出,預設維持關閉,由客戶自行判斷如何配合其透明度義務。OpenAI 亦表示正與雲端合作夥伴合作,未來數週讓經其平台調用的 OpenAI 模型輸出也可使用浮水印。
  • ChatGPT 與 Codex(未來數週,只限歐盟):歐盟境內所有方案中合資格用戶的文字輸出將加入隱形浮水印;官方明言不會在推出時把文字浮水印設為全球預設,以地區試行收集實際使用回饋。
  • 偵測器(即日接受申請):按行為守則,個別審批研究人員與專業機構的使用申請。工具只會回報是否偵測到 OpenAI 浮水印,不會識別用戶身份,也不會披露提示詞或對話內容。

至於圖像與音訊,OpenAI 的網上驗證工具及 Content Provenance API 維持公開,不受今次文字方案影響。

二、技術原理深度解析

根據同日公開、由 OpenAI 與賓夕法尼亞大學、耶魯大學研究人員合著的技術報告,textGrain 屬「無偏」浮水印:

  1. 以密鑰驅動抽樣:模型逐個詞元生成文字時,系統以秘密密鑰及前文產生偽隨機數,再透過最佳傳輸(optimal transport)問題,把詞元抽樣與這些隨機數耦合;成本函數基於 Gumbel 隨機變數,並加入 KL 散度正則化。
  2. 熵預算可量化:報告指出 KL 散度正好等於條件熵的減少量,因此「浮水印強度」可直接理解為犧牲多少抽樣隨機性,開發方可按預算校準,避免同一提示重覆生成一模一樣的答案。
  3. 詞彙分塊加速:把最佳傳輸套用於詞彙「區塊」而非逐個詞元,降低運算維度,同時保留區塊內詞元的相對機率。
  4. 偵測只需文字與密鑰:偵測器毋須知道生成時所用的預算,只憑文字及秘密密鑰即可進行統計檢驗。

OpenAI 表示,在其評測中 textGrain 表現與包括 Google SynthID 文字版在內的其他方法相若或更佳,並計劃日後開源。

對輸出質素的影響

官方以最新前沿模型 Astra 測試,有無浮水印的基準成績差異不大,例如:Artificial Analysis Intelligence Index 49.57 對 49.76 分、GPQA Diamond 94.44% 對 93.94%、DeepSWE v1.1 72.80% 對 71.68%、Terminal-Bench 4.0 53.90% 對 56.06%(前者為無浮水印,後者為有浮水印)。

三、日常應用場景

1. 開發者與技術團隊

以 OpenAI API 建構內容生成產品的團隊,現可選擇為輸出開啟浮水印,作為履行透明度義務的其中一項技術措施。不過需注意:浮水印對短文、數學等用字彈性低的內容偵測率明顯較低,產品設計不應只依賴浮水印,仍要配合介面標示、日誌與政策。

2. 企業與隱私敏感行業

OpenAI 列明浮水印「不能說明」的事項:不量度人類參與程度、不判定擁有權或法律責任、不識別用戶、不核實內容真偽;而「未偵測到浮水印」亦不代表由人類撰寫,因文字可能太短、經編輯或翻譯,或來自其他公司的模型。法務、合規與人事部門在處理「AI 代寫」爭議時,不宜把偵測結果當作單一證據。

3. 一般用戶

歐盟用戶日後在 ChatGPT 與 Codex 取得的文字,將帶有肉眼看不見的統計訊號;改寫或翻譯會削弱訊號。官方數據顯示,400 詞元文字替換一成字詞後偵測率由約 92% 降至 66%,替換兩成半則降至約 17%。

4. 香港與亞洲市場視角

香港不少電商、媒體、教育及專業服務公司透過網站或應用程式服務歐盟用戶。若產品向歐盟市場提供 AI 生成文字,便須評估《AI 法案》第 50 條的標示要求,並決定是否在 API 層面開啟浮水印。內地方面,《人工智能生成合成內容標識辦法》已於 2025 年 9 月起施行,同時面向內地與歐盟的香港團隊,更需要一套可按地區切換標示策略的內容管線。

四、專業評價與潛在考量

優勢

  • 以分階段、地區試行方式落實法規要求,並公開技術報告及詳細的偵測限制數據,透明度較高。
  • API 預設關閉、由客戶自行開啟,讓企業按自身合規需要取捨。
  • 對前沿模型基準成績影響輕微,並承諾開源,有利業界建立共同標準。

需要留意的地方

  • 文字浮水印本質上容易被改寫、翻譯削弱,對短文與數學類內容效果有限。
  • 偵測器初期只限獲批機構使用,一般企業暫時無法自行驗證文字來源。
  • 浮水印只能識別 OpenAI 模型的輸出,無法作通用 AI 文字偵測;不同供應商的方案互不相通。

結語

OpenAI 這次把文字浮水印定位為「有限訊號」:配合歐盟法規先行,但坦白承認技術上限。對香港企業而言,真正要做的是把 AI 生成內容的標示、紀錄與審核納入產品流程,而非依賴單一技術。如需在香港部署可自行控制生成與審計紀錄的私有 AI,可參考 YSK Limited 的企業私有 LLM 全託管(https://ysk.hk/services/ai-automation),年費 HK$88,000 起、數據不出境;若需要開發團隊把浮水印開關、地區標示及內容審核整合進現有系統,亦可參考遠端開發者外判服務(https://ysk.hk/services/outsourcing),HK$2,000/月起。


參考來源

  1. OpenAI 官方:Our approach to EU text provenance rules(2026 年 10 月 5 日)https://openai.com/index/eu-text-provenance/
  2. OpenAI 技術報告:textGrain: Entropy-Calibrated Watermarking for Language Model Text(2026 年 10 月 5 日)https://cdn.openai.com/pdf/e9508624-d767-41b6-a26d-e34ca798ada6/textgrain-entropy-calibrated-watermarking-for-language-model-text.pdf
  3. 歐盟委員會:Code of Practice on Transparency of AI-generated Content https://digital-strategy.ec.europa.eu/en/policies/code-practice-ai-generated-content
  4. OpenAI 開發者文件:Content provenance https://developers.openai.com/api/docs/guides/content-provenance
  5. 發現來源:OpenAI 官方 RSS(openai.com/news/rss.xml)

Related services & products