摘要:
中国AI公司月之暗面旗下Kimi K3近日再次卷入模型蒸馏争议。OpenAI公布的一份调查显示,一场针对其模型受保护推理内容的协调提取活动与月之暗面相关人员存在关联。相关活动曾在单日产生约1.6万次请求,并涉及超过1.5万名用户。
OpenAI表示,这些操作并没有突破其加密系统、入侵数据库或直接获取用户历史对话,而是通过精心设计的多轮模型交互,试图让原本隐藏的推理过程以请求者可以看到的形式重新生成。
OpenAI将这次事件称为一次“协调的模型蒸馏活动”。所谓模型蒸馏,是指利用能力更强的教师模型生成大量输出,再将这些结果用于训练规模或成本更低的学生模型,从而让后者学习教师模型的行为模式和能力。蒸馏本身是机器学习领域的常见技术,但如果未经授权大规模提取商业模型输出并用于训练竞争模型,就可能违反服务条款甚至引发知识产权争议。
根据OpenAI公布的调查结果,相关活动最早出现在2026年7月1日,当时请求数量还比较低。随后活动逐渐扩大,并在7月24日和25日出现明显的高峰。仅在这两天,OpenAI检测到约1.6万次采用特定提取模式的请求,这些请求来自超过4000名用户。
OpenAI进一步表示,类似的提示词和操作模式并不仅仅出现在上述4000多名用户中,而是分布在一个超过1.5万名用户组成的更大用户群体中。公司通过分析这些请求之间的模式和关联,判断它们并非完全独立的普通用户行为,而是属于一个具有协调特征的活动。
其中一种关键操作尤其引人关注。OpenAI称,相关人员首先从一个对话中复制模型返回的加密推理内容,然后在另一个独立对话中要求模型对这些隐藏内容进行解密和转录。换句话说,他们并不是直接破解OpenAI用于保护推理过程的加密机制,而是尝试利用模型自身的能力,让模型处理另一段受保护内容,从而间接恢复其中的信息。
OpenAI强调,这次活动并没有成功“破解加密”,也没有攻破OpenAI的数据库,更没有获得存储在服务器上的用户聊天记录。其成功之处主要在于操纵模型之间的交互,让原本不会直接展示给用户的受保护推理信息以另一种形式重新出现。
OpenAI最终在7月28日前后完全阻断了这类活动。公司表示,在调查过程中发现,其中一个核心活动集群与月之暗面相关人员存在关联。OpenAI在公开声明中称,其能够将该核心集群归因于“与Kimi开发商月之暗面有关的个人”。
月之暗面是中国AI企业,旗下Kimi系列模型近年来迅速发展。2026年7月,公司发布Kimi K3,这是一个拥有约2.8万亿参数的开放权重模型,并将其定位为面向代码编程、复杂推理和AI智能体任务的新一代模型。Kimi K3发布后迅速受到全球AI开发者关注,其性能在部分第三方测试中接近美国领先闭源模型。
此次OpenAI的调查,也让此前美国政府对Kimi模型来源提出的质疑再次受到关注。美国白宫科技政策办公室主任兼首席科技与技术顾问迈克尔·克拉齐奥斯今年7月底曾表示,美国政府掌握相关信息,认为月之暗面曾利用Anthropic的模型对Kimi K3进行蒸馏。月之暗面方面并未承认这一指控。
除了政府方面的说法之外,近期也出现了其他研究人员对Kimi K3模型训练来源的分析。一项研究发现,只需要将Claude Opus 4.8经过解码后的部分推理内容输入Kimi K3,就可能明显改变Kimi K3后续的思考过程和最终回答,使其呈现出与Claude更加接近的表达方式。研究人员据此认为,某些特定Claude和GPT推理内容在Kimi K3中的提取难度明显低于其他模型。
不过,这些研究并不能单独证明Kimi K3整体就是通过未经授权的方式从其他模型蒸馏得到的。大型语言模型之间出现相似的回答方式、推理结构和知识表达,也可能来自公开数据、相似训练目标、强化学习方法以及模型架构等多种因素。因此,模型存在部分行为相似,并不等同于已经证明其训练数据来源存在违规行为。
Kimi K3本身也包含月之暗面自行研发的技术。该模型采用Kimi Delta Attention等架构设计,并针对大规模推理任务进行了优化。月之暗面还通过减少KV缓存以及优化每个Token的内存占用来降低推理成本,这些技术使Kimi K3能够在大规模数据中心硬件上运行。
此次争议的特殊之处在于,OpenAI指控的行为本身并不是简单地复制模型回答,而是试图主动获取模型通常不会直接展示的“受保护推理”。随着越来越多AI公司采用隐藏推理或加密推理机制,这类信息已经成为模型能力保护的重要组成部分。如果竞争模型能够通过大规模自动化请求恢复其中的内容,那么模型厂商用于保护训练成果和推理能力的机制就可能面临新的挑战。
OpenAI近年来已经多次针对类似的模型蒸馏行为采取行动。公司认为,大规模自动化调用商业模型、收集其输出并用于训练竞争模型,会让拥有大量计算资源的一方能够以较低成本复制其他模型经过长期研发形成的能力。
与此同时,这次事件也说明AI模型蒸馏正在成为中美人工智能竞争中的一个敏感问题。美国政府此前已经多次警告中国AI企业可能利用美国公司的模型输出加速自身模型开发,而中国企业则持续强调自主研发能力和开放权重模型的重要性。对于目前公开的信息而言,OpenAI已经确认发现了大规模提取活动,并称其核心活动集群与月之暗面相关人员有关,但这一归因以及相关活动最终是否确实被用于训练Kimi K3,仍需要更多公开证据加以证明。
了解更多:
https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign/
评论