美华头条7月23日综合报道 美国白宫科技政策官员当地时间7月22日在华盛顿指称,中国人工智能企业月之暗面在开发Kimi K3过程中,可能大规模使用美国人工智能模型生成的输出数据,并可能通过泰国境内服务器获得受出口管制的先进计算资源。

截至7月23日,美方尚未公开账户访问记录、训练数据、服务器日志或模型比对报告等完整证据。月之暗面也未就Kimi K3是否使用Anthropic最新模型输出、是否建立批量调用系统以及是否通过境外服务器使用英伟达GB300设备等具体问题作出详细公开回应。

目前,事件仍停留在企业指控和政府审查阶段,尚未形成司法裁决、监管调查结论或针对月之暗面的正式制裁决定。

美方提出模型蒸馏与芯片使用指控

白宫科学与技术政策办公室主任迈克尔·克拉齐奥斯表示,美方掌握的信息显示,月之暗面曾建立内部平台,对美国前沿人工智能模型实施大规模蒸馏,并可在不同访问渠道之间切换,以降低集中调用行为被发现或阻止的可能性。

克拉齐奥斯将Anthropic旗下Claude Fable列为可能被使用的模型之一,并认为相关输出可能帮助月之暗面改善Kimi K3在编程、推理和工具调用等方面的能力。他同时称,月之暗面可能直接获得或通过泰国的服务器使用英伟达GB300计算设备。

克拉齐奥斯承认,模型蒸馏本身是人工智能行业的常见研发方法,但认为通过隐蔽账户、自动化访问或规避检测措施大规模获取竞争者模型能力,可能越过正常技术学习的边界。美国财政部长斯科特·贝森特此前表示,如果知识产权违规行为得到确认,美国政府可能考虑采取限制或制裁措施。

不过,美方目前没有公开说明有关服务器的购买者、实际控制人和最终使用者,也没有披露Kimi K3训练任务在相关设备上运行的直接记录。因此,设备是否存在、月之暗面是否实际使用以及相关行为是否违反美国出口规定,仍是需要分别查明的问题。

Kimi K3发布后迅速受到关注

月之暗面于7月16日发布Kimi K3。该公司公布的资料显示,Kimi K3拥有2.8万亿个总参数,采用稀疏混合专家架构,支持约100万Token的上下文,并面向长期编程、知识工作、多模态处理和复杂推理等任务。

月之暗面称,Kimi K3采用自主设计的注意力机制和模型架构,并计划于7月27日前后公开完整模型权重。模型目前已通过月之暗面的应用程序和接口提供服务,但完整权重尚未发布,外部研究机构因此还不能对其全部架构、运行效率和技术说明进行充分独立验证。

Kimi K3在部分编程和前端开发测试中取得较高成绩,被认为已接近部分美国领先闭源模型。但不同测试平台、提示方法和评分标准可能产生不同结果,个别排行榜成绩不能代表模型在所有任务上全面领先,也不能单独证明或否定其训练数据来源。

模型发布后用户需求快速增加,月之暗面一度暂停新的付费订阅,以应对计算资源压力。该情况表明Kimi K3已获得一定市场关注,但服务需求上升与技术来源争议属于两个不同问题,不能相互作为证明。

Anthropic此前曾指控三家中国企业违规调用Claude

今年2月23日,Anthropic发布说明,指控DeepSeek、月之暗面和MiniMax通过约2.4万个违规账户,与Claude产生超过1600万次交互,以获取模型在推理、编程和工具使用等方面的能力。

Anthropic称,与月之暗面有关的交互超过340万次,部分活动具有系统性收集模型输出的特征。该公司将相关行为称为“工业规模”的蒸馏活动,并表示这些账户违反了服务条款和地区访问限制。

这些数据来自Anthropic对自身平台访问记录的调查,可以解释美国政府为何进一步关注月之暗面,但不能单独证明相关输出进入了Kimi K3的训练流程。Anthropic尚未公开全部账户记录、归因方法和数据流向,外界也无法据此判断相关交互在Kimi K3开发中的具体作用。

发布时间线成为判断指控的重要因素

Fable 5于6月公开,而Kimi K3于7月16日发布。训练一款拥有数万亿总参数的大型模型,通常需要提前完成架构设计、数据准备、基础训练、后训练和模型评估。

因此,即使月之暗面曾调用Fable 5,也不能仅凭模型性能接近,推断Kimi K3的基础模型全部来自对Fable 5的复制。相关输出在技术上可能用于后训练、特定能力优化、结果评估或数据筛选,但目前没有公开证据说明其是否实际进入Kimi K3训练流程。

另一方面,模型蒸馏不要求获得教师模型的源代码或参数权重。开发者可以通过收集大量输入与输出样本,使另一模型学习教师模型的部分行为。时间线上的疑问因此不能完全排除后期蒸馏的可能,最终判断仍取决于调用时间、数据规模和训练记录。

“蒸馏”是否构成侵权尚无统一标准

模型蒸馏是人工智能领域长期存在的技术。企业使用自有模型、授权模型或符合许可规定的数据实施蒸馏,通常属于正常研发活动。争议主要集中在数据如何获得、是否规避访问限制以及是否违反模型服务商的使用条款。

即使确认存在违规调用,其法律性质仍需进一步区分。违反服务协议、侵犯商业秘密、不正当竞争、规避技术措施和版权侵权并非相同概念,各自需要不同的证据和法律标准。

美国政府和部分前沿模型企业认为,大规模提取专有模型输出可能削弱原创企业的研发回报,并使先进编程、网络安全和自动化能力在缺乏同等安全控制的情况下扩散。

质疑这一立场者则认为,美国人工智能企业自身使用了大量网络文章、书籍、代码和图片训练模型,并正面临多起版权诉讼。由此产生的问题是,模型企业主张使用公开内容具有转换性质时,应如何界定其他开发者使用模型输出的权利边界。

相关观点还指出,中国已经形成规模较大的人工智能研究和工程人才体系,Kimi K3公开披露的架构设计表明其开发过程不应被简单归结为复制。即使存在外部模型输出,也需要评估这些数据在基础架构、训练效率、后训练和工程优化中的实际贡献。

与此同时,也有观点认为,开放权重和低价服务不应成为忽视知识产权、数据安全和出口管制的理由。中国企业开放模型可能扩大开发者选择,也可能降低高风险能力被不当使用的门槛。围绕事件形成的意见主要集中于知识产权一致性、中国自主研发能力、开放模型的市场价值以及安全监管等方面。

美国科技行业对限制中国模型存在分歧

美国大型前沿模型企业倾向于要求加强模型访问保护、芯片出口管制和知识产权执法,认为中国开放模型可能借助美国技术削弱本国企业的竞争优势。

英伟达首席执行官黄仁勋则持不同立场。他认为,美国开发者应能够研究和使用中国开放模型,全面限制相关模型可能减少美国企业接触先进技术的机会,并削弱市场竞争。

近200家美国初创企业也向美国政府表达担忧,认为来自中国的低成本开放权重模型已成为部分小型企业的重要开发工具。它们主张,如确有违规行为,应采取针对具体企业和行为的限制,而不是全面禁止所有中国开放模型。

这种分歧反映出美国政策面临的两项目标:一方面保护前沿技术和国家安全,另一方面维持开发者选择、市场竞争和创新成本优势。

争议正从芯片管制延伸至模型能力

过去,美国对华人工智能限制主要集中于先进芯片、制造设备和实体数据中心。此次争议显示,监管关注范围正在扩大到模型输出、合成训练数据、云端算力和跨境服务器服务。

如果高质量模型输出能够减少部分训练成本,那么模型访问本身可能被美国政策部门视为一种需要保护的战略资源。相应地,未来监管措施可能不再局限于禁止硬件出口,还可能涉及账户验证、模型接口访问、云计算服务和训练数据流向。

但这种监管如果缺乏透明证据和统一标准,也可能被用于保护少数大型闭源企业,增加中小开发者的使用成本,并加快全球人工智能技术体系分化。

截至7月23日,美方尚未公布对月之暗面的正式调查结果,Kimi K3的服务和模型权重发布计划也未因争议出现公开变化。事件下一步将取决于美方是否披露账户调用、模型水印和境外服务器使用证据,以及月之暗面是否通过技术报告、完整权重或独立审计回应相关质疑。