OpenAI 為歐盟 ChatGPT 及 Codex 文字加入隱形水印並開放 API 試用

OpenAI 於 2026 年 10 月 5 日發表文章,交代其回應歐盟《人工智慧法案》文字溯源要求的做法。該法案要求生成式 AI 供應商須以機器可讀方式,標示由模型生成的文字。OpenAI 宣布,即日起全球 API 客戶可選擇為指定模型的輸出加入文字水印;至於歐盟境內合資格的 ChatGPT 與 Codex 文字輸出,則會在未來數星期陸續加上隱形水印[1]。

水印以統計訊號藏於文字之中

OpenAI 的文字水印技術名為 textGrain,並非插入可見符號,而是在模型選擇用字時嵌入隱形統計訊號,偵測器只要掌握文字與密鑰,便可判斷段落是否帶有該公司的水印[2]。公司同日發表技術報告,交代方法的數學基礎:技術把詞彙劃分成組,透過以 Gumbel 隨機變數定義成本的最優傳輸問題,令符號生成與密鑰隨機性互相耦合,並以 KL 正則化限制熵的損耗,使水印強度參數具備直接的資訊理論意義。偵測器只需生成文字及密鑰,無須知道生成時所設的熵預算,亦不涉及模型本身。

偵測效果受文字長度與改寫影響

OpenAI 指出,技術在理想條件下表現良好,但偵測效果會隨文字長度縮短而下降,亦會受改寫、翻譯及代碼混合等操作影響。公司承認水印並非萬能方案,但在提高 AI 內容可辨識性方面是重要一步。OpenAI 表示將持續改進技術,並呼籲行業共同制定標準[2]。

參考資料

[1] Text Watermarking for the EU AI Act(OpenAI,2026 年)

[2] textGrain Technical Report(OpenAI,2026 年)

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

*