发生了什么
Breitbart 报道称,一名名叫 Jane Doe 的女性起诉了 Elon Musk 的 xAI(该报告称该公司现已成为 SpaceX 的一部分),指控 Grok 接受过有关描述她的儿童性虐待材料的培训。该报告称,该诉讼涉及多伊学龄前儿童时创建的滥用图像,后来使用图像哈希进行跟踪。
Breitbart 报道称,简·多伊 (Jane Doe) 对埃隆·马斯克 (Elon Musk) 的 xAI 提起集体诉讼,指控该公司用描绘她的儿童性虐待材料训练其 Grok 聊天机器人。根据该报告,潜在的虐待发生在 2000 年代初,当无名氏还是一名学龄前儿童时,当时成年男子制作了后来在网上流传的照片。报告称,国家失踪和受虐儿童中心和加拿大儿童保护中心对这些图像进行了哈希处理,以便服务机构能够在副本再次出现时识别它们。
根据 Breitbart 对投诉的描述,加拿大儿童保护中心告诉 Doe,人工智能生成的描绘她的 CSAM 出现在 xAI 上。 Breitbart 引用和总结的投诉称,与描述 Doe 的图像相关的已知哈希值是 xAI 使用的数据集的一部分。该报告还表示,投诉将所指控的行为与关于创建人工智能生成的描绘已知幸存者的 CSAM 的在线讨论联系起来。这些是诉讼中的指控,而不是法院得出的结论。
Breitbart 报道称,投诉称 xAI 存储 Grok 生成的图像,并重复使用它们来训练或进一步训练模型。文章还称,Grok 的服务条款默认将 X 上的公共帖子和 Grok 自己的输出视为训练数据。投诉称,这可能会让公开发布或系统生成的滥用材料进入培训渠道并影响以后的输出。该消息来源没有提供独立验证的技术证据来准确显示任何特定图像如何影响 Grok。
该报告称,xAI 从训练数据中过滤暴力材料,但其术语并未明确排除 CSAM、未经同意的亲密图像或其他性材料。 Doe 的诉讼指控 xAI 违反联邦儿童色情法规和玛莎法。 Breitbart 报道称,该诉讼为能够证明 Grok 根据真实照片生成 CSAM 的受害者寻求损害赔偿,并要求 xAI 销毁存储的或与训练相关的生成的 CSAM 并防止下一代生成。消息人士没有说任何法院已经批准了这些请求。
为什么这很重要
如果这些指控得到证实,该案件可以测试人工智能公司如何处理训练数据、生成的输出和用户上传的内容中已知的滥用材料。它还可以澄清当模型复制或转换与已确定的幸存者相关的材料时适用的法律义务。
这些指控涉及生成人工智能安全的一个核心问题:在公司发现或删除底层文件之前,模型可能会受到有害材料的影响。 Breitbart 报道称,投诉认为从公共来源删除图像可能不会消除其对已训练模型的影响。该技术点在申请中作为权利要求提出;消息来源并未确定 Grok 是否通过所描述的机制保留、记忆或复制了任何特定图像。
已知的 CSAM 通常使用哈希值进行跟踪,因此平台可以检测副本,而无需重复分发材料进行审查。该报告称,投诉称 xAI 的数据集中使用了具有长期已知哈希值的图像。如果得到证实,这将引发以下问题:在数据收集过程中是否应用了现有的检测系统、数据管道中是否存在异常或差距,以及生成的输出是否被单独扫描和删除。
该案例的影响可能超出 xAI 范围,因为许多生成系统结合了大规模网络数据、用户内容和模型生成的材料。 Breitbart 引用了一项涉及 LAION 图像索引的早期研究,该研究在人工智能数据库中识别出了 3,200 多张疑似虐待儿童的图像。前面的例子是 Breitbart 报道的背景,并不能证明 Grok 使用了相同的材料,也不能证明所有可疑图像都被确认为 CSAM。
法律主张还对数据使用条款进行了审查。如果默认情况下将公共帖子和模型输出用于培训,则用户和幸存者对如何复制、保留或重复使用有害材料的实际控制可能有限。消息来源没有确定 xAI 在本案中如何解释其术语、是否更改了这些术语、它适用于 CSAM 的哪些保护措施,或者所指控的图像是否是故意、意外或通过第三方数据集获取的。
互动机制:它实际上是如何运作的
以交互方式探索这一发展背后的基础技术。
crm_get_transaction(id='4092').Why can ethical evaluation not be reduced to one model score?
接下来看什么
关键问题是投诉的技术主张是否能得到支持,xAI是否对指控作出回应或反驳,以及法院是否下令对Grok进行保存、删除、过滤或其他更改。该案例还可能引起人们对公共帖子和模型输出的默认数据使用条款的关注。
xAI 的回应非常重要,包括该公司是否否认这些图像进入了 Grok 的训练数据,对 Grok 输出与 Doe 真实图像之间所谓的关系提出争议,或者描述任何调查和补救措施。 Breitbart 的报告不包括 xAI 的回应,也没有引用任何独立的技术审计来验证投诉的说法。
法院文件和裁决应澄清原告必须提供哪些证据才能将生成的材料与特定幸存者的图像联系起来并确定 xAI 的知识或行为。消息人士称,该诉讼被提议作为集体诉讼,但它没有确定该集体诉讼是否会得到认证,索赔是否会在早期动议后继续存在,或者法院是否已就责任问题做出调查结果。
需要注意的实际保护措施包括数据集摄取期间的哈希匹配、阻止涉及真实儿童或已知幸存者的提示和输出、生成图像的保留和删除策略以及使用模型输出作为训练数据的控制。该报告没有说明 xAI 目前正在实施哪些措施,也没有说明自提交文件以来是否有任何改变。
所要求的补救措施还可能影响 Grok 更广泛的性内容政策。 Breitbart 报道称,该投诉寻求限制,可能涵盖未经同意的亲密图像和其他性化输出,包括文章中与 Grok 推广的 NSFW 功能相关的材料。目前尚不清楚法院是否会施加如此广泛的限制,xAI 是否会自愿采用这些限制,或者如何在生成的内容和培训系统中执行任何命令。