摘要:
美国人工智能公司Anthropic近日发布威胁情报报告,指控包括阿里巴巴、Moonshot AI、DeepSeek、小米以及另外数家中国AI实验室在内的机构,曾通过大规模调用Claude的方式提取其模型能力,并将生成结果用于训练和改进自己的人工智能模型。Anthropic将这种行为称为未经授权的“蒸馏攻击”(distillation attack)。

所谓模型蒸馏,是指利用能力更强、规模更大的模型生成大量回答,再将这些输出作为训练数据,用于训练成本更低、规模更小或者能力较弱的模型。对于AI公司而言,这是一种可以减少训练成本、快速提升模型能力的技术路线,但Anthropic认为,此次发现的部分行为已经超出了正常的模型蒸馏范围,属于有组织、大规模地提取其商业模型能力。
Anthropic表示,在2026年5月至7月期间,与阿里巴巴有关的操作产生了超过1.51亿次与Claude的交互,这是该公司迄今发现规模最大的非法蒸馏活动。相关操作使用了超过3500个被Anthropic认定为欺诈性的账户,最高时一天产生的交互次数接近300万次。
Anthropic认为,这些账户主要用于持续向Claude提出大量问题,并获取模型的回答以及更加详细的推理过程,再将这些信息用于改进阿里巴巴的通义千问系列模型。
对于模型开发者而言,推理过程尤其具有价值。相比只获得最终答案,详细的推理记录能够向训练者展示模型如何分析问题、如何分解任务以及如何得出最终结论,因此可以成为训练先进推理模型的重要数据。

Anthropic同时点名了月之暗面 AI,也就是Kimi的开发商。报告称,在2026年5月至7月期间,月之暗面相关账户与Claude产生了超过2300万次交互。
更值得关注的是,Anthropic指控月之暗面不仅仅是利用Claude进行模型蒸馏,还曾将Kimi用户的真实请求转发给Claude处理。
Anthropic称,在其中一个持续10天的时间段内,月之暗面通过一个由5380个账户组成的账户网络,将接近30万条原本提交给Kimi的用户请求转交给Claude,其中大部分请求被发送给Claude Opus系列模型。Anthropic认为,这些账户大多位于新加坡和日本,并被用于隐藏实际请求来源。
这意味着,在部分情况下,Kimi用户以为自己正在与月之暗面自己的模型进行交互,但实际上请求可能被转交给了Anthropic的Claude处理。Anthropic还称,月之暗面保存了其中部分交互内容,并提取Claude的推理记录作为训练数据。
更令人担忧的是,这些被转交的请求并不一定只是普通的聊天内容。Anthropic表示,其中一些请求包含敏感信息,而且用户可能并不知道自己的数据实际上被发送到了另一家AI公司的模型。

报告举出了一个与Kimi有关的案例。一名用户要求Kimi分析来自中国成都的大量监控摄像头画面,以判断某个人的行为。根据Anthropic的说法,这些视频数据最终被转交给Claude处理,而用户原本认为这些数据是在Kimi内部完成分析的。
Anthropic还发现,部分用户提交给Kimi的内容涉及企业登录凭据等敏感信息。在一个案例中,一名工程师为了利用Kimi帮助一家中国企业开发软件,将多个公司的登录凭据提交给了Kimi,而相关信息随后被转交给了Claude。
Anthropic表示,用户并没有明确得知自己的请求会被转发给Anthropic的模型,因此这种做法除了涉及模型蒸馏问题之外,还可能产生严重的隐私和数据安全风险。
DeepSeek同样被Anthropic指控采取了类似方式。报告称,DeepSeek在2026年7月的一段14天时间内,被发现进行了超过1200万次与Claude有关的蒸馏交互。
Anthropic认为,DeepSeek同样曾将用户的真实请求转交给Claude,而这些请求中的部分内容包含敏感信息。随后,Claude的回答又被用于训练和改进DeepSeek自己的模型。
除了阿里巴巴、月之暗面和DeepSeek之外,Anthropic还点名了智谱以及小米等中国AI企业。报告称,小米曾记录用户与自身MiMo模型之间的聊天内容,并将这些对话交给Claude,以生成用于模型训练的数据。
Anthropic表示,在其此次报告涉及的时间范围内,共有7家中国AI实验室被发现实施了针对Claude的模型蒸馏活动。相关活动并非全部采用完全相同的方式,但共同特点都是试图通过大量获取Claude的输出,学习其模型能力,并将这些信息用于自身AI系统的训练。
Anthropic认为,这些活动已经呈现出越来越强的组织化和规模化特征。与普通开发者偶尔调用其他AI模型进行测试不同,这些操作使用大量账户、代理和中间平台隐藏真实身份,并以工业化规模持续产生模型交互。

其中阿里巴巴相关活动尤其引人关注。超过1.51亿次交互意味着,相关操作并不是简单的实验性测试,而是持续数月进行的大规模数据获取行动。Anthropic认为,这些数据主要被用于帮助训练和提升阿里巴巴的通义千问模型。
对于月之暗面和DeepSeek而言,问题则更加复杂,因为Anthropic指控它们不仅从Claude获取训练数据,还把自己用户的请求转交给竞争对手的模型。这意味着用户提交给一家AI公司的内容,可能在未经明确告知的情况下进入另一家AI公司的系统。
Anthropic表示,它已经采取措施阻止这些活动,包括封禁相关账户、加强身份验证,并进一步限制Claude输出详细推理过程的能力。由于详细推理记录对于模型蒸馏具有很高价值,减少这类内容的输出能够降低竞争对手通过大量自动化请求复制Claude能力的效率。
Anthropic还表示,对于来自中国、俄罗斯和伊朗等Claude目前不提供正式服务的国家或地区、但疑似试图绕过限制访问Claude的用户,公司将加强身份验证措施。




此次报告并不是Anthropic第一次公开指控中国AI企业进行模型蒸馏。今年6月,Anthropic政策负责人莎拉·赫克曾致信美国国会议员,称阿里巴巴在4月22日至6月5日期间与Claude产生了约2880万次交互,并认为这些交互被用于未经授权的模型蒸馏。
此次最新报告显示,Anthropic认为相关活动的规模在之后进一步扩大。仅阿里巴巴一家在5月至7月期间的交互次数就超过1.51亿次,远远高于此前披露的数字。
与此同时,这一事件发生在中美AI竞争日益激烈的背景下。中国AI公司近年来凭借相对较低的训练和推理成本迅速提升模型能力,DeepSeek、Kimi以及通义千问等产品已经成为全球AI行业的重要参与者。而美国AI公司则拥有包括Claude、GPT系列等先进基础模型。

模型蒸馏本身并不是一种违法或者不合理的技术。AI开发者可以在获得授权的情况下使用教师模型生成的数据,用于训练自己的模型。但Anthropic认为,此次涉及的操作之所以构成严重问题,在于相关企业被指通过大量虚假账户、代理平台以及隐蔽的数据转发机制,在未经Anthropic授权的情况下系统性获取Claude的能力。
更重要的是,Anthropic认为部分行为已经触及用户数据安全问题。对于正常使用AI服务的用户来说,他们通常会认为自己提交给Kimi、DeepSeek等平台的数据会按照这些平台自身的隐私政策进行处理。如果平台实际上把这些请求转交给第三方模型,那么用户可能并不知道自己的数据已经进入另一家公司的系统。




截至报告发布时,阿里巴巴、月之暗面、DeepSeek、小米以及Anthropic均没有立即回应相关置评请求。中国外交部则表示并不了解Anthropic发布的这份报告,并重申中国政府认为人工智能应该用于造福人类,同时反对歪曲事实以及对中国进行抹黑。


Anthropic此次披露的事件也使AI行业长期存在的模型蒸馏争议再次浮出水面。对于拥有先进基础模型的公司而言,如何防止竞争对手通过自动化、大规模调用获取模型能力,已经成为商业和安全领域的重要问题;而对于AI应用公司而言,如何处理用户数据以及是否应该明确告知用户请求被转交给第三方模型,同样可能成为未来监管关注的重点。
从行业竞争的角度来看,Anthropic此次公布的数字尤其值得注意。超过1.51亿次阿里巴巴相关交互、超过2300万次月之暗面相关交互以及超过1200万次DeepSeek相关交互,显示出先进AI模型之间的竞争已经不再只是传统意义上的算法和芯片竞争,而正在扩展到训练数据、模型能力获取以及模型蒸馏等领域。
而随着各家AI模型之间的能力差距不断缩小,如何在合法使用公开技术、正常模型蒸馏与未经授权的大规模能力复制之间划清界限,也将成为未来全球AI产业必须面对的一个越来越棘手的问题。
评论