
OpenAI 正因究竟是哪些人可以閱讀你的 ChatGPT 對話而遭到起訴。
本月提交至美國加州北區聯邦地方法院的一項擬議集體訴訟指控,OpenAI 在未事先妥善告知用戶的情況下,將真實用戶聊天內容轉交給外部承包商。OpenAI 已於 9 月 2 日收到送達。
這起訴訟矛頭指向 OpenAI 一項名為 Project Lily 的內部計畫,該計畫最早由媒體 404 Media 於 9 月 14 日揭露。根據訴狀,透過第三方人力公司聘用、擔任「AI 資料審查員」與「聊天機器人評估員」等職務的承包商,會閱讀真實的 ChatGPT 提示詞與完整對話,摘要用戶想完成的事情,接著對四種不同模型回覆進行 1 到 7 分的評分與評論。
這個流程,基本上就是像 ChatGPT 這類聊天機器人實際變得更聰明的基礎版本。簡單來說,由人類替 AI 回答打分,這些分數再回饋進訓練流程,讓模型學會人們偏好哪些回覆;業界稱此技術為 RLHF,也就是「來自人類回饋的強化學習」。訴訟的核心主張是,用戶從未被清楚告知,閱讀他們對話的可能是人,而不只是機器。
OpenAI 的確會在任何人類查看對話之前,先透過自動化系統進行篩選。但訴狀指稱,該過濾機制並非總能攔下所有內容,意味著個人細節有時仍會流向承包商。
404 Media 發現,審查人員使用的儀表板包含一項「用戶記憶摘要」功能,也就是對個人過往聊天紀錄的整理,儘管用戶名稱已被移除,仍可能揭露像是大致所在地、職業或私人生活等資訊。OpenAI 表示,這些審查的目的在於減少兩種特定行為:其一是聊天機器人表現得過於像真人;其二是聊天機器人過度迎合,用研究人員的術語來說就是「諂媚性」(sycophancy),也就是 AI 不是提供準確資訊,而是傾向告訴用戶它認為對方想聽的內容。
ChatGPT 每週用戶已超過 9 億,且其中很多人把它當成日記、心理諮商師,或是一個只有自己看得到的搜尋引擎。
人們會輸入健康症狀、分手訊息、稅務問題、法律困擾。這起訴訟主張,OpenAI 的隱私政策確實列出某些可接觸用戶資料的外部對象類別,但從未明確指出資料標註或人工評估供應商也是其中之一。
訴狀共提出八項獨立法律主張,包括違反加州《不公平競爭法》、加州《消費者隱私法》,以及普通法上的主張,例如「侵擾隱私」(intrusion upon seclusion)——這是一種隱私侵權,指他人以一般合理人會認為具冒犯性的方式窺探你的私人事務。
原告尋求損害賠償、返還利益,以及懲罰性賠償。
在禁制令部分,原告提出的要求相當具體。他們要求 OpenAI 在任何對話送交外部審查員之前,必須先取得用戶明確選擇加入的同意;將「為所有人改進模型」設定的預設值由開啟改為關閉;在聊天視窗內加入清楚警示;並可能刪除與已審查對話相關的工作成果,同時重新訓練所有曾使用這些內容的模型。
OpenAI 須於 10 月 13 日前提交回應。