中国国防研究人员正在将美国AI模型输出作为训练材料

据路透社对80多篇学术论文和专利的审查,与中国军方有关联的研究人员一直在利用领先美国人工智能系统的输出,帮助训练国内国防模型。路透社通过《Defense News》分享的报道所引用的这些文件显示,隶属中国人民解放军以及其他安全机构的研究人员,正在将来自OpenAI和Anthropic等美国公司的模型回复纳入专门AI系统的研究工作中。

这篇报道指向一种名为模型蒸馏的技术。在这一过程中,更大、能力更强的模型输出会被用来训练一个更小的系统,后者运行成本更低,也更容易在本地部署。蒸馏是AI开发中的标准方法,但报道所描述的争议不在于这一基础技术本身,而在于未经授权的提取以及其后续军事用途。

其战略意义在于。美国出口管制一直高度聚焦于限制中国获取先进半导体和其他计算基础设施,这些资源是从零开始训练前沿AI模型所必需的。路透社审阅的论文显示,一些与中国国防相关的团队正把西方AI系统视为捷径,借助其回答和推理模式缩小能力差距,而无需自行构建同等规模的基础模型。

为何蒸馏对国防AI至关重要

蒸馏可以将强大模型的实际价值压缩到更小的封装中。对于军事或安全机构来说,这会形成明确的激励。小模型可以针对更窄的任务进行定制,在更普通的硬件上运行,并在训练完成后保持在国内控制之下。在一个受制裁、出口限制和供应链压力影响的环境中,这种组合尤其具有吸引力。

根据审阅材料,与军方机构有关联的中国研究人员并不只是想从美国系统中获得正确答案。他们似乎还在试图捕捉这些模型如何推理问题。这一区别很重要,因为当目标是为复杂作战任务构建系统时,推理轨迹往往比单纯输出更有价值。

詹姆斯敦基金会的Sunny Cheung审阅了路透社报道中超过60篇论文,他表示,这些文件显示出一种努力,即把代价高昂的专有推理转移到更小的国内系统中。报道称,这些系统的用途包括监视、网络战和战术决策支持。若这一情况属实,那么被提取的价值就不只限于原始语言生成,还延伸到工作流程、结构以及可被重新用于国防场景的问题解决行为。

AI治理与出口管制的焦点

这些发现出现在美中科技政策的敏感时刻。华盛顿正越来越将先进AI视为与芯片、电信基础设施和量子技术并列的战略能力。对模型蒸馏的担忧为这场讨论增加了新层面,因为它们表明,如果国家相关行为体能够通过商业模型接口或其他间接渠道捕获有用能力,仅靠硬件访问控制可能并不足够。

这一问题也出现在美中AI治理与安全对话之前。这一时间点赋予了该报道更广泛的分量。AI对话通常围绕对齐、滥用和自主升级等抽象担忧展开。而这起案例更为具体。它关注的是,一个国家创建的前沿商业系统,是否正在在贸易限制原本意在减缓其进展的情况下,实质性加速对手国家的防务AI发展。

据报道总结,美国官员认为,一些中国实体正在利用蒸馏从美国模型中提取能力,这可能削弱出口管制并引发知识产权担忧。中国方面则否认这些指控,并认为美国正在追求技术主导地位,同时忽视AI行业中类似做法的存在。这一回应表明,一场关于训练方法的技术争论如何迅速演变为围绕合法性、互惠与基础技术控制权的地缘政治争端。

这些论文对中国AI战略的启示

路透社的审查提供了一个难得的文献窗口,观察在资源受限条件下,与中国国防相关的机构可能如何推进AI发展。前沿模型训练成本高、算力消耗大,并且高度依赖先进硬件的获取。蒸馏改变了经济模型。如果一个研究团队能够查询更强的模型,并用其输出塑造一个专门化的本地模型,就可能绕开部分独立构建能力所需的成本和时间。

这并不意味着蒸馏后的模型会与原系统等同。小模型仍然更狭窄,也不那么通用。但在国防场景中,广度往往不如对特定任务的可靠性重要。一个针对情报分拣、网络分析、传感器融合支持或战场规划辅助而调优的模型,不需要成为一个通用聊天机器人。它只需要在一个明确的作战角色中表现足够好。

因此,这些报道中提到的论文表明了一种务实策略:吸收当前最强外国系统中的高价值推理模式,然后把这些模式改造为可在本地部署、并用于范围明确任务的工具。对于政策制定者来说,这提出了一个令人不安的问题。即便出口管制成功限制了顶级芯片的获取,如果模型输出本身也能成为战略资源,那这些管制是否足够?

对AI公司和监管机构的压力

这份报道很可能会加大外界对AI提供商的审视,重点将放在访问控制、客户筛查、速率限制、监测以及防止模型输出被滥用的安全措施上。前沿AI公司已经承受越来越大的压力,需要证明其系统不容易被用于网络、 生物或军事目的。此次报道又增加了另一类担忧:输出被系统性用于为对手国家相关系统“搭底”的情况。

这一挑战之所以棘手,是因为普通使用与提取之间的界限很难界定。蒸馏在整个AI行业中因效率和部署等合法原因被广泛使用。政策问题不在于蒸馏这一方法本身的存在,而在于审阅论文中所描述的规模、意图以及关联背景。监管机构和提供商现在可能面临要求,需要区分良性的模型使用与涉及国防相关行为体的组织化能力转移。

对更广泛的AI行业而言,这一故事也是一个提醒:模型访问本身就是一个战略卡口。芯片仍然至关重要,但顶级模型的输出可能正在成为围绕军事AI竞争中的第二道控制面。如果各国政府认定商业访问渠道可被用来加速外国防务项目,那么围绕推理环节的技术保障,或将获得与硬件出口规则几乎同等的关注。

更大的启示在于,AI竞争正在超越“谁先训练出最大模型”的问题。如今,竞争越来越关乎谁能最快捕捉、适配并将有用能力投入实际运用。路透社审阅的论文表明,对于一些与中国军方有关联的研究人员来说,美国前沿模型不仅是远观的产品,更是这场打造专门防务AI竞赛中的训练工具。

本文基于《Defense News》的报道。阅读原文

Originally published on defensenews.com