科技調查媒體《404 Media》揭露,OpenAI 內部正在推動一項代號為「Project Lily」的專案,聘用了數百名約聘審查人員直接讀取並評估用戶與 ChatGPT 的真實對話紀錄。更令人擔憂的是,官方宣稱能隱去敏感個資的防護技術存在顯著漏洞,讓高度機密的個人隱私面臨被真人看光的嚴峻風險。
數百名約聘審查員進駐:匿名處理難掩記憶摘要,居住地資訊恐遭拼湊

要讓大型語言模型(LLM)的回答更加精準、自然且符合人類期望,除了前期投餵海量訓練資料,後期由人類進行反饋與標註的監督式微調至關重要。為了評估 ChatGPT 在真實使用情境下的應答品質與潛在偏差,OpenAI 啟動了規模龐大的「Project Lily」,將真實用戶的大量即時對話分發給數百名外部約聘人員,由他們逐條審核 AI 的回應是否恰當。

然而,這些被審查的對話早已遠遠超出一般的技術提問。《404 Media》與《The Next Web》進一步指出,即便審查後台刻意隱去了使用者的帳號名稱,但在特定情況下,系統卻會直接顯示 ChatGPT 為該用戶建立的「記憶摘要」(Memory Summary)。這意味著審查人員不僅能看到當下的提問,還能同步查閱用戶過往的使用背景偏好,甚至包含使用者所在的大致地理區域與居住城市。
當具體的日常對話、特定人際脈絡與地域資訊交織在一起時,去識別化的匿名保護便形同虛設,審查員只要稍加比對,便極有可能推導出螢幕另一端的真實身分。
不抓事實錯誤只管「說教與 AI 味」:時薪 50 美元
這批參與「莉莉計畫」的外包合約工時薪據稱超過 50 美元,但日常工作本質上相當機械且繁瑣。令人意外的是,審核員的核心任務並非核對回答的事實真相,而是替回答的品質與語氣打分。他們必須逐條檢視模型給出的回應是否切題、字裡行間是否有過於濃厚的「AI 味」、語調是否流於說教、表情符號是否過度氾濫,以及是否存在刻意討好用戶的諂媚態度;另一項關鍵審核指標,則是避免模型將自己描繪成具備真實人生經歷的人類。
至於模型給出的回答是否存在事實性錯誤?這完全不在審核員的職責範圍內。外包員工並非百科全書,無法查核所有事件的完整真相。這也意味著即使經過人工評分篩選,使用者在 ChatGPT 上看見事實性錯誤的回答依然十分常見。
去識別化防線破功:OpenAI 坦承隱私過濾器存有技術盲區
為了平息個資外洩的疑慮,OpenAI 對外強調,在對話派發給人工審查員之前,系統會先經過一道內部開發的「隱私過濾器」(OpenAI Privacy Filter)自動進行脫敏處理。這套過濾演算法的設計目的,是自動偵測並將對話中的真實姓名、住家地址、電子郵件信箱、電話號碼及特定帳號等敏感識別標籤,替換為中性的代碼標籤。
但問題在於,現有演算法根本無法完美理解人類語言的複雜性。OpenAI 官方在技術說明中也不得不坦承,若個人識別資訊屬於罕見格式,或者其敏感性高度依賴對話上下文語境,過濾器就極有可能出現誤判或遺漏。《404 Media》更直接證實,OpenAI 內部已經承認確實存在「未被完全過濾的高度機密個人資料直接傳遞給外部審查人員」的技術風險。
面對媒體質疑 OpenAI 究竟在哪個環節明確告知用戶「你的對話會被真人閱讀」,官方僅能拿出深藏在技術支援中心的說明文件作為回應。這種將重大隱私條款藏匿在層層點擊之後的作法,顯然無法讓蒙在鼓裡的廣大用戶信服。
個人版用戶預設全面授權:手動關閉「改善模型」選項切斷外洩管道
對一般使用者而言,最大的陷阱在於 ChatGPT 帳號的「預設機制」。根據 OpenAI 的隱私權政策,個人用戶(包含免費版與付費的 ChatGPT Plus 方案)在註冊完成後,系統預設即勾選同意將對話內容用於模型訓練與品質改善。換言之,只要你沒有主動變更設定,每一句對話都自動被列入隨時可能被抽檢的潛在名單中。
相較之下,專為企業與學術單位設計的 ChatGPT Business、Enterprise 與 Edu 方案,在預設狀態下均已全面關閉資料分享,確保商業機密不被用於模型反饋。此外,若用戶使用「臨時聊天」(Temporary Chat)模式,對話同樣不會被提取用於改善模型,且紀錄通常會在 30 天內從伺服器徹底清除。
若你使用的是個人帳號,想要徹底防堵私密對話流入外包審查員手中,自保的第一步就是主動檢查帳號設定:點擊個人頭像進入「設定」,切換至「資料控制」(Data Controls),並將「為所有人改善模型」(Improve the model for everyone)的選項切換為關閉。
- 延伸閱讀:免排隊等工程師開票!OpenAI Data agent 強勢登場,直接用嘴巴叫 ChatGPT 操控 Tableau 畫圖表、分析大數據
- 延伸閱讀:OpenAI工程師翻車了!用AI「全抄」經典網遊被抓包,慘遭原廠律師函光速下架
- 延伸閱讀:宿敵竟在此刻達成共識!從OpenAI到Anthropic,揭開矽谷科技巨頭集體「降速」的背後動機
請注意!留言要自負法律責任,相關案例層出不窮,請慎重發文!