FB 建議貼文

選取貼文複製成功(包含文章連結)!

ChatGPT 生成內容也將加入「文字浮水印」,不過 OpenAI 坦言:改幾個字就可能失效

ChatGPT 生成內容也將加入「文字浮水印」,不過 OpenAI 坦言:改幾個字就可能失效

繼 Anthropic 在 Claude 生成文字中加入「隱形浮水印」後,OpenAI 也於 5 日宣布,為符合歐盟人工智慧法案的要求,將正式導入文字溯源與浮水印技術。OpenAI 表示,這項新政策採取分階段推進的策略,在確保技術透明度的同時,也審慎評估目前文字浮水印技術所面臨的侷限性。

歐盟與全球市場的推行藍圖

根據 OpenAI 的規劃,文字浮水印與偵測機制的實施重點包含:在未來幾週內,「歐盟地區」的 ChatGPT 與 Codex 用戶,其符合條件的文字輸出將自動加入隱形浮水印;全球的 API 客戶則是自即日起可選擇是否為特定模型的文字輸出開啟浮水印,預設狀態下則保持關閉,讓開發者能依自身需求評估透明度義務。

OpenAI 將開放浮水印偵測工具的申請,初期僅限經審核的專家組織與研究人員使用,藉此協助評估與改進技術,暫不全面對外公開。

技術挑戰:編輯與文本特性影響準確率

OpenAI 推出的文字浮水印技術名為 textGrain,其原理是在模型的字詞選擇中加入隱含的統計訊號。然而,官方坦言文字浮水印仍屬早期技術,在實際應用上面臨諸多考驗,像是在數學等缺乏字詞選擇彈性的領域中,偵測率顯著低於心理學等敘述性內容。此外,文字越短也越難被準確識別。

ChatGPT 生成內容也將加入「文字浮水印」,不過 OpenAI 坦言:改幾個字就可能失效

ChatGPT 生成內容也將加入「文字浮水印」,不過 OpenAI 坦言:改幾個字就可能失效

測試也顯示,若將文章中 10% 的字詞替換為同義詞,偵測率就會從 92% 下降至 66%;若替換 25%,偵測率更驟降至 17%。

釐清文字浮水印的適用邊界

OpenAI 強調,文字浮水印僅能提供有限的訊號,無法完全代表內容的全部面貌。偵測結果存在以下「無法得知」的限制:

  1. 無法衡量人類貢獻度:無法得知人類在編輯、判斷或創意發揮上佔了多少比重。
  2. 無法確立所有權或責任:無法判定文字的合法授權歸屬或法律責任。
  3. 無法辨識使用者身分:不會將文字與特定個人、帳號或對話紀錄進行綁聯。
  4. 無法驗證內容真實性:無法保證文本內容是否正確、具誤導性或是否被斷章取義。

面對多元且複雜的內容溯源需求,OpenAI 表示未來將持續改良檢測技術,並隨法規與標準演進調整策略,致力在保障隱私與落實產業透明度之間取得平衡。

ycr
作者

T 客邦網站、PChome 雜誌編輯,同時負責 T 客邦影新聞 YouTube 頻道及 FB、IG 等社群平台短影音製作。專注於 AI 應用、產業趨勢與軟體教學等科技內容報導。(大頭貼為 AI 生成)

發表回應
謹慎發言,尊重彼此。按此展開留言規則