一名化名Jane Doe的女性起诉xAI,称Grok用其幼年遭性虐待时拍摄、已列入哈希清单的影像及AI生成版本训练。这是首桩指控xAI训练数据含儿童色情的诉讼。
xAI被指控用儿童性虐待影像训练Grok,此时该公司图像生成系统正承受持续的监管与司法审视,据报还有部分Grok用户因此被捕。
8月26日提交的起诉书草案中,原告化名Jane Doe。本世纪初她还上幼儿园时,成年男性反复性侵她,并制作儿童性虐待影像在网上卖给犯罪者。包括国家失踪与被剥削儿童中心和加拿大儿童保护中心在内的机构,后来对她的影像做了哈希标记。
Doe订阅了美国司法部受害者通知系统的提醒。收到许多通知后,加拿大儿童保护中心告诉她,发现xAI上有AI生成的、以她为原型的儿童性虐待影像,她十分震惊,说这带来了新的创伤。起诉书还称,网络论坛上的消息显示,犯罪者在讨论创建涉及她和其他已知受害者的AI生成儿童性虐待影像。
Doe担心xAI既助长了更多虐待影像的产生,又保留生成内容用于进一步训练模型。基于此,她相信Grok可能既从原始虐待影像、也从较新的AI生成版本中学到了东西。此案据称是首桩指控xAI用儿童色情训练模型的诉讼。起诉书对该指控的细节着墨有限。Ars Technica此前报道,研究者在一个用于训练图像生成器的争议数据集中发现了儿童色情,该数据集后来被移除,但文章称没有证据表明xAI用过它。
Doe律师的新闻稿称,她的影像出现在国家失踪与被剥削儿童中心的儿童色情哈希清单上,并指控同一批材料被纳入xAI开发Grok图像与视频生成功能的数据集。起诉书同样指控,带有她长期为人熟知的哈希值的儿童性虐待影像,构成xAI训练数据集的一部分。
起诉书对AI生成儿童色情的指控着墨更多。它说,按Grok的条款,X上的公开帖子和Grok生成的输出通常被当作训练数据。因此,发布一张图片既会让它被观众看到,也会进入xAI的模型改进流水线。起诉书称xAI会过滤训练数据中的暴力内容,却没有把儿童色情、未经同意的私密影像或不宜工作内容明确列为排除类别。
它还论证,训练后移除训练数据未必能消除数据的影响。除非xAI已做过这种移除,而它并未公开声称做过,否则先前摄取的儿童色情可能持续影响模型输出。
原文:https://arstechnica.com/tech-policy/2026/08/elon-musks-xai-used-child-porn-to-train-grok-models-lawsuit-says/