美机构指控六家中国AI公司大规模蒸馏美国模型
美国国家安全局等三大机构联合指控DeepSeek、月之暗面、阿里巴巴等六家中国AI公司自2024年底起对美国前沿模型发动工业规模蒸馏攻击,以低成本复制能力并节省数十亿美元研发费用,凸显AI知识产权竞争升级。
驱动中国9月10日消息,据外媒报道,美国国家安全局(NSA)、网络安全和基础设施安全局(CISA)与联邦调查局(FBI)近日联合发布声明,点名六家中国AI公司,指控它们自2024年底以来对美国前沿大模型发动了“工业规模”的蒸馏攻击,以极低成本复制其能力,或为自身节省了数十亿美元的研发投入。被点名的企业包括深度求索(DeepSeek)、月之暗面(Moonshot AI)、阿里巴巴(Alibaba)、MiniMax、阶跃星辰(StepFun)和Z.AI。
这份联合声明称,上述中国企业持续对美国模型发起蒸馏攻击,提取包括Claude、GPT、Gemini和Grok变体在内的核心能力。美方机构认为,这些公司“很可能”是在中国政府知情的背景下实施相关操作的。声明还指出,开展工业规模蒸馏的中国AI企业,在训练前沿模型时显著缩短了开发时间,并大幅降低了财务支出。
所谓“蒸馏”,是指利用成熟大模型的输入输出作为训练数据,让新模型在较短时间内学会类似能力,是AI领域常见的模型压缩和迁移方法。通常情况下,小型团队通过蒸馏可以在有限算力下获得接近顶级模型的表现,而“工业规模”蒸馏则意味着大量、系统性地抓取和利用目标模型的输出,这在业界引发过不少版权与合规争议。
此次被点名的六家公司覆盖中国AI赛道最具代表性的一批玩家。DeepSeek、月之暗面、MiniMax、阶跃星辰与Z.AI均为头部大模型创业公司,阿里巴巴则是中国科技巨头之一,旗下AI产品与云计算业务深度绑定。此次被美方集中点名,无疑将加剧外界对美国前沿模型技术外流的担忧。
在AI竞赛持续升温的背景下,美国监管机构对前沿技术流向海外的警惕性明显上升。此前,美国已通过出口管制等手段限制高性能AI芯片对华出口,此次针对模型蒸馏的指控,将技术转移的焦点从硬件延伸到了算法和模型本身。业内普遍认为,蒸馏行为是否构成侵权在技术上存在模糊地带,但一旦被认定为“工业规模”的系统性攫取,就可能面临法律制裁或更严格的监管措施。
这一事件折射出AI行业围绕基础模型知识产权的新博弈。前沿模型凝聚了高昂的算力、数据与工程投入,蒸馏则可能让后来者以极小代价绕过漫长研发过程。对于开源与闭源模型共存、模型输出二次使用是否合规等问题,业界尚未形成统一共识。美方此次高调点名,或将对跨境AI合作与技术授权模式产生深远影响。
声明并未透露是否会采取后续执法行动,也未提及被点名企业的回应情况。可以预见的是,随着大模型能力持续提升,围绕模型蒸馏的争议与监管博弈会越来越频繁,中国AI企业在出海和合作过程中,也需要更加审慎地处理模型训练的数据来源与技术合规问题。