技術

ChatGPT在歐盟文字加入隱形浮水印,OpenAI曾於2024年擱置這項技術

Adrian Kessler
在 Google 中新增我們

OpenAI 曾花了很長時間公開解釋,為何不會在 ChatGPT 生成的文字中加入浮水印。如今,它卻打算這麼做。讓它改變主意的不是技術,而是一項設有期限、違者須付罰款的法律。

OpenAI 表示,ChatGPT 和 Codex 為歐盟使用者生成的文字,將帶有看不見的統計特徵,並在接下來幾週分階段推行至所有方案。在其他地方,同樣的標記只會以開關形式出現在開發者 API 中,而且預設為關閉。OpenAI 劃下的界線,正好沿著有權對它開罰的司法管轄區邊界延伸。

ChatGPT 的浮水印如何運作

這套名為 textGrain 的方法,不會在輸出內容上留下任何可見標記。當好幾個後續詞語放進句子裡都同樣合適時,系統會透過一把秘密金鑰,讓其中一個詞語更有機會被選中。單次偏移毫無意義,但文章中累積數百次偏移,就會形成一種模式;持有金鑰的偵測器可以據此進行檢驗。由於這項訊號存在於文字本身,即使複製貼上也會保留下來。OpenAI 與賓夕法尼亞大學及耶魯大學的研究人員共同撰寫技術報告。報告指出,這項方法不會造成明顯的品質損失:在 Artificial Analysis Intelligence Index 上,帶有浮水印的輸出得分為 49.76,未加標記的則為 49.57。

OpenAI 早已具備的工具

這些做法對 OpenAI 來說並不新鮮。2024 年夏天,《華爾街日報》報導,該公司已經開發出可用的文字浮水印,內部文件評估其有效率達 99.9%,但 OpenAI 選擇暫緩推出。OpenAI 當時回應,自己採取的是「審慎的做法」。它提出的理由涵蓋技術與社會層面:這種方法「很容易被不法人士透過翻譯,或交由另一個模型改寫來規避」,而且可能讓非英語母語者把 AI 當作寫作輔助工具一事蒙上污名。TechCrunch 在報導本週的公告時,也提到當時的第三項考量:OpenAI 擔心使用者會轉向不加浮水印的競爭對手。

對照這些過往紀錄來看,這次推出浮水印,顯示 OpenAI 真正處理了哪些疑慮。根據該公司自己的數據,規避問題依然存在;至於商業考量,則被限制在單一市場之內。

OpenAI 的數據,而非批評者的說法

在理想條件下,若偽陽性率為 1%,偵測器大約能抓出 80% 長度為 200 個詞元、帶有浮水印的文章;文章長度達 400 個詞元時,偵測率則約為 95%。若將 10% 的詞語替換成同義詞,偵測率會從 92% 降至 66%;替換四分之一的詞語後,偵測率更會跌至 17%。簡短回覆、數學內容和翻譯文字,幾乎都很難被偵測出來。OpenAI 自己也提醒,即使在理想條件下表現良好,「也不代表在日常使用中能可靠地偵測」,而沒有浮水印並不能證明文字出自人類之手。該公司還表示,標記無法用來識別使用者。

這代表 textGrain 對付懶得改動、直接複製貼上的人還算有用,但只要有人願意花一分鐘編修文字,它就難以發揮作用。在一個使用多種語言閱讀和寫作的區域裡,翻譯造成的偵測落差並非無關緊要的細節。

為何是歐盟,又為何是現在

推動這項措施的法律依據,是《人工智能法案》第 50 條;該條的透明度規定已於 8 月 2 日生效。規定要求生成式系統的供應商,以機器可讀的方式標示合成文字、音訊、影像和影片,並提供偵測機制。ChatGPT 等在該日期前已上市的系統,必須在 12 月 2 日前遵守規定。根據 Cooley 律師事務所的分析,違規者最高可被處以 1,500 萬歐元罰款,或全球年度營業額的 3%,以金額較高者為準。

有兩個細節顯示,這次推出措施緊扣的是法律義務,而非某種原則。第一個是偵測器。法律要求提供偵測機制;OpenAI 已經打造了相關工具,但只交給獲批准的研究人員和專業機構,而且申請者必須提出申請。據 The Decoder 報導,OpenAI 表示,等到「我們認為結果能以負責任的方式解讀時」,才會擴大使用權限,卻沒有給出時間表。如今,在里斯本或華沙的教師或編輯若拿到一段可疑文字,仍無法自行查驗。

第二個細節是推出範圍。Anthropic 從 8 月起便在 Claude 的文字中加入浮水印,不論使用者透過什麼方式使用其模型,標記都會在全球生效,因此招來部分使用者反彈。OpenAI 選擇了相反做法:在監管機構可以開罰的地方預設開啟,其他地方則只供開發者選擇啟用,推出時不採全球預設開啟。如果 OpenAI 早先擔心使用者流向未加浮水印的競爭對手這件事已不復存在,就沒有太多理由如此劃定範圍。

接下來會如何發展

OpenAI 表示,將以開放原始碼方式發布 textGrain,並稱它的表現不遜於、甚至勝過 Google 的 SynthID 等方法。等到程式碼公開,這兩項說法都能接受檢驗。布魯塞爾方面面對的問題則更明確:一種只要稍加編修就會逐漸失效、而且幾乎沒有人能使用偵測器讀取的標記,是否符合一項要求其他系統能辨識 AI 生成文字的規定?

12 月 2 日之後,預設會在文字中帶有 OpenAI 標記的 ChatGPT 使用者,將只剩下那些監管機構有權向 OpenAI 開罰的人。

標籤: , , , ,

在 Google 中新增我們

討論

共有 0 則留言。