xAI因Grok训练数据面临新的法律挑战

在一项新的诉讼中,xAI被指控在与Grok图像和视频功能相关的数据中使用了儿童性虐待材料,简称CSAM。根据Ars Technica于2026年8月27日的报道,这起诉讼围绕一名被标识为Jane Doe的原告展开。她表示,自己遭受虐待的图像多年前曾在网上流传,后来又成为用于识别已知非法材料的系统的一部分。

据原始报道,这份诉状指称xAI不仅使针对该原告的AI生成CSAM得以创建,还存储了这些输出,并将其用于进一步训练Grok。如果这一指控最终得到证实,该案可能成为AI公司如何处理非法或高度有害材料进入训练流程、模型输出或两者兼有这一风险的重要检验。

诉状内容

原告称,她在2000年代初还是学龄前儿童时遭到虐待,而相关图像随后被出售到网上。Ars Technica报道称,这些图像后来被包括美国国家失踪与受虐儿童中心以及加拿大儿童保护中心在内的机构进行了哈希处理,从而形成一种可在数字系统中识别已知材料的方法。

诉状称,原告后来收到加拿大儿童保护中心的通知,称xAI上的AI生成CSAM描绘了她。根据报道,这一通知使她再次受到创伤,并带来了新的恐惧:AI工具可能正在通过生成与已知受害者相关的新合成变体,延长旧虐待材料的寿命。

这起诉讼所主张的不只是输出层面的伤害。它进一步指称,xAI将原始虐待图像以及较新的AI生成版本都纳入了Grok持续训练流程。Ars Technica指出,这是首起明确指控xAI训练中使用CSAM的案件,而诉状本身对这一训练数据主张的具体支持细节有限。

关于输出、存储与模型开发的案件

这份诉状的法律意义,不仅在于Grok据称生成了虐待图像。更广泛的主张是,同一系统可能将此类材料纳入了模型开发过程。这一区分很重要。AI公司如今已面临越来越大的压力,要求其说明训练数据来源、如何过滤有害内容,以及有问题的输出是否会被保留用于后续产品改进。

在本案中,原告认为xAI让施害者更容易创建新的剥削性图像,而且如果这些输出随后被存储并复用,公司的行为可能进一步加重伤害。这使得该案不仅是对内容审核的挑战,也是对数据治理和生成后处理的挑战。

Ars Technica的报道称,诉状引用了网络论坛中的消息,其中施害者讨论了利用AI生成针对该原告及其他已知受害者的CSAM。根据所提供的原始文本,这一指控有助于解释为何原告认为问题远不只是一般性的安全失效。真正的担忧是通过生成系统对特定受害者进行反复、定向的二次伤害。

已知与未知

原始材料谨慎指出,关于训练数据的指控仍存在不确定性。Ars Technica表示,没有迹象表明xAI曾训练过一个此前被报道、但研究人员在发现其中含有CSAM后已清理过的争议数据集。该文还称,诉状并未详细说明xAI如何训练于原告的虐待图像这一说法。

这意味着,指控的严重性与文章中公开描述的证据之间仍存在缺口。尽管如此,报道中的诉状声称,该主张与这样一个事实有关:原告的图像被纳入了NCMEC维护的CSAM哈希清单,而原告律师则指称,同一材料也是用于构建Grok图像和视频生成能力的数据集的一部分。

目前,这些只是已提交诉状中的指控,而非法院认定的事实。但即便在任何裁决之前,此案也进一步加剧了外界对AI模型构建者是否拥有足够控制措施的审视,以防止非法材料进入训练语料、在输出中重新出现,或通过反馈循环再次被吸收。

为何这不仅关乎xAI

这份诉状出现之际,监管机构、法院和执法部门已经在调查生成式AI系统如何被用于生产剥削性内容。此案还凸显了模型开发者面临的一项尤为棘手的问题:一旦系统能够生成衍生的虐待内容,伤害就不再只取决于原始数据集中有什么。它可能会通过合成复制不断扩大。

这引出了若干行业层面的现实问题:

  • 公司如何筛查训练数据集中已知的非法材料。
  • 生成输出是否被保留、审核,或复用于模型改进。
  • 当哈希值、受害者举报或监督机构警示识别出虐待内容时,平台如何应对。
  • 防护措施是否足以阻止对已知个体进行定向的合成性二次伤害。

这些问题并非某一家公司的专属,也不只属于某一个模型家族。但xAI这起诉讼把它们摆在了异常鲜明的位置上,因为它把历史虐待材料、AI生成衍生内容以及据称的再训练,串成了一条完整的伤害链。

接下来会怎样

眼下的下一步很可能是法律和程序上的:xAI将有机会回应这些指控,而法院程序将决定有多少证据会公开。根据所提供的原始文本,这份诉状标志着xAI首次在法庭上被明确指控曾用CSAM训练Grok。

对更广泛的AI行业来说,这一案件再次表明,内容安全争议正从假设性的滥用场景,转向围绕运营记录、数据来源,以及公司能否证明被禁止材料不仅被排除在公开输出之外,也被排除在内部开发流程之外的争议。

如果这些指控在法庭上获得事实支持,其后果可能远超声誉受损。它们还可能塑造未来在数据集审计、输出保留、受害者通知以及生成式AI系统法律责任方面的标准。

本文根据Ars Technica的报道改写。阅读原文.

Originally published on arstechnica.com