發生了什麼事
Breitbart 報告稱,一名名叫 Jane Doe 的女性起訴了 Elon Musk 的 xAI(該報告稱該公司現已成為 SpaceX 的一部分),指控 Grok 接受過有關描述她的兒童性虐待材料的培訓。該報告稱,該訴訟涉及多伊學齡前兒童時創建的濫用圖像,後來使用圖像哈希進行追蹤。
Breitbart 報導,簡·多伊 (Jane Doe) 對 Elon Musk 的 xAI 提起集體訴訟,指控該公司用描繪她的兒童性虐待材料訓練其 Grok 聊天機器人。根據該報告,潛在的虐待發生在 2000 年代初,當無名氏還是學齡前兒童時,當時成年男子製作了後來在網路上流傳的照片。報導稱,國家失蹤和受虐兒童中心和加拿大兒童保護中心對這些圖像進行了哈希處理,以便服務機構能夠在副本再次出現時識別它們。
根據 Breitbart 對投訴的描述,加拿大兒童保護中心告訴 Doe,人工智慧生成的描繪她的 CSAM 出現在 xAI 上。 Breitbart 引用和總結的投訴稱,與描述 Doe 的圖像相關的已知雜湊值是 xAI 使用的資料集的一部分。該報告還表示,投訴將所指控的行為與關於創建人工智慧生成的描繪已知倖存者的 CSAM 的線上討論聯繫起來。這些是訴訟中的指控,而不是法院的結論。
Breitbart 報告稱,投訴稱 xAI 儲存 Grok 生成的圖像,並重複使用它們來訓練或進一步訓練模型。文章還稱,Grok 的服務條款預設將 X 上的公開貼文和 Grok 自己的輸出視為訓練資料。投訴稱,這可能會讓公開發布或系統產生的濫用材料進入培訓管道並影響以後的輸出。該消息來源沒有提供獨立驗證的技術證據來準確顯示任何特定圖像如何影響 Grok。
報告稱,xAI 從訓練資料中過濾暴力資料,但其術語並未明確排除 CSAM、未經同意的親密影像或其他性資料。 Doe 的訴訟指控 xAI 違反聯邦兒童色情法規和瑪莎法。 Breitbart 報告稱,該訴訟為能夠證明 Grok 根據真實照片生成 CSAM 的受害者尋求損害賠償,並要求 xAI 銷毀存儲的或與訓練相關的生成的 CSAM 並防止下一代生成。消息人士沒有說任何法院已經批准了這些請求。
為什麼這很重要
如果這些指控得到證實,該案件可以測試人工智慧公司如何處理訓練資料、產生的輸出和用戶上傳的內容中已知的濫用材料。它還可以澄清當模型複製或轉換與已確定的倖存者相關的材料時適用的法律義務。
這些指控涉及產生人工智慧安全的一個核心問題:在公司發現或刪除底層檔案之前,模型可能會受到有害材料的影響。 Breitbart 報告稱,投訴認為從公共來源刪除圖像可能不會消除其對已訓練模型的影響。該技術點在申請中作為權利要求提出;消息來源並未確定 Grok 是否透過所描述的機制保留、記憶或複製了任何特定圖像。
已知的 CSAM 通常使用雜湊值進行跟踪,因此平台可以檢測副本,而無需重複分發資料進行審查。該報告稱,投訴稱 xAI 的資料集中使用了具有長期已知哈希值的圖像。如果得到證實,這將引發以下問題:在資料收集過程中是否應用了現有的偵測系統、資料管道中是否存在異常或差距,以及產生的輸出是否被單獨掃描和刪除。
此案例的影響可能超出 xAI 範圍,因為許多生成系統結合了大規模網路資料、使用者內容和模型生成的資料。 Breitbart 引用了一項涉及 LAION 圖像索引的早期研究,該研究在人工智慧資料庫中識別出了 3,200 多張疑似虐待兒童的圖像。前面的例子是 Breitbart 報告的背景,並不能證明 Grok 使用了相同的資料,也不能證明所有可疑影像都被確認為 CSAM。
法律主張也對資料使用條款進行了審查。如果預設將公開貼文和模型輸出用於培訓,則使用者和倖存者對如何複製、保留或重複使用有害材料的實際控制可能有限。消息來源沒有確定 xAI 在本案中如何解釋其術語、是否更改了這些術語、它適用於 CSAM 的哪些保護措施,或者所指控的圖像是否是故意、意外或透過第三方資料集取得的。
互動機制:它實際上是如何運作的
以互動方式探索這項發展背後的基礎技術。
crm_get_transaction(id='4092').Why can ethical evaluation not be reduced to one model score?
接下來看什麼
關鍵問題是投訴的技術主張是否能得到支持,xAI是否對指控作出回應或反駁,以及法院是否下令對Grok進行保存、刪除、過濾或其他更改。該案例也可能引起人們對公共貼文和模型輸出的預設資料使用條款的關注。
xAI 的回應非常重要,包括該公司是否否認這些影像進入了 Grok 的訓練數據,對 Grok 輸出與 Doe 真實影像之間所謂的關係提出爭議,或描述任何調查和補救措施。 Breitbart 的報告不包括 xAI 的回應,也沒有引用任何獨立的技術審計來驗證投訴的說法。
法院文件和裁決應澄清原告必須提供哪些證據才能將產生的材料與特定倖存者的圖像聯繫起來並確定 xAI 的知識或行為。消息人士稱,該訴訟被提議作為集體訴訟,但它沒有確定該集體訴訟是否會獲得認證,索賠是否會在早期動議後繼續存在,或者法院是否已就責任問題做出調查結果。
需要注意的實際保護措施包括資料集攝取期間的雜湊匹配、阻止涉及真實兒童或已知倖存者的提示和輸出、生成影像的保留和刪除策略以及使用模型輸出作為訓練資料的控制。該報告沒有說明 xAI 目前正在實施哪些措施,也沒有說明自提交文件以來是否有任何變更。
所要求的補救措施也可能影響 Grok 更廣泛的性內容政策。 Breitbart 報告稱,該投訴尋求限制,可能涵蓋未經同意的親密圖像和其他性化輸出,包括文章中與 Grok 推廣的 NSFW 功能相關的資料。目前尚不清楚法院是否會施加如此廣泛的限制,xAI 是否會自願採用這些限制,或如何在產生的內容和培訓系統中執行任何命令。