以人工方式手動檢閱用戶與 AI 對話紀錄
【小心 ⚠️】外媒踢爆,OpenAI 內部正推行名為「Project Lily」的專案,聘用數百名外聘合約員工,逐一以人工方式手動檢閱 ChatGPT 與用戶的真實對話紀錄,以改善模型回應質素。儘管相關數據在交由人員審查前會經過匿名化處理,但 OpenAI 亦坦承,部分包含個人私隱的內容可能仍會「漏網」,甚至連用戶與 AI 傾訴的私密對話與個人背景摘要,都可能已被第三方人員看光。
據《Tom's Hardware》報導,這批被稱為「提示詞審查員」(Prompt Reviewers)的人員,工作內容主要是檢視匿名化後的真實對話,評估 ChatGPT 的回應表現。
審查準則並非著重在事實查核或安全性審查,而是針對語言風格與回答質素進行評分。人員需檢視 AI 是否切題、有無過度使用「AI 腔調」、語氣是否過於高高在上、濫用 Emoji 或是阿諛奉承(Sycophancy)。
此外,OpenAI 嚴格禁止模型出現擬人化現象,例如系統可以回答「我找到一些資料」,但不可宣稱自己具有人類背景或情感(例如「作為廚師,我喜歡……」或「我感同身受」)。這項機械式審查工作雖然單調,但傳出時薪高達 50 美元以上;不過有內部審查員反映,公司的評分指引經常變動且充滿矛盾。
最引發外界擔憂的是私隱漏洞,許多用戶經常將 ChatGPT 當作傾訴對象、心理諮詢工具,甚至在輸入框內千叮嚀萬囑咐「請保持秘密」,但事實上這些對話依然會流入審查流程。
目前市面上多數生成式 AI 服務均預設開啟「允許使用對話紀錄以改善產品」的選項,ChatGPT 個人免費版與多數付費版亦不例外(僅企業版、商業版及教育版預設為關閉)。然而,這項設定並無追溯效力:即使使用者現在手動關閉資料共享或刪除歷史紀錄,已經被抓取、匿名化並存入訓練資料集的舊對話,仍可能長久留存在伺服器與資料庫中。
資料來源: