中国军方利用美国AI模型提升国防能力
2026-08-01 04:25:06 · chineseheadlinenews.com · 来源: 法广
在八一建军节中国国家主席习近平强调要“高质量推进国防和军队现代化,如期实现建军一百年奋斗目标”的前夕,据路透社独家对80多篇中国学术论文和专利的审查显示,中国军事研究人员利用OpenAI和Anthropic开发的美国领先人工智能模型的输出结果,训练国内人工智能系统,以加速提升中国的国防能力。

中国军事研究人员利用美国人工智能模型训练国防系统 ? 路透社制图
此前未曾报道的调查结果罕见地揭示了中国军事和安全相关机构如何利用美国尖端人工智能模型作为捷径,开发出自己的专用系统,尽管华盛顿方面努力限制北京获取先进芯片和其他战略技术。
文件显示,一种名为“模型蒸馏”的技术得到了广泛应用,该技术利用强大的 AI 系统的输出来训练更小、更专业的模型,这些模型可以在本地部署,而无需从头开始构建前沿 AI 系统所需的巨大计算需求。
中国军方广泛应用“模型蒸馏”技术
路透社的审查包括了位于华盛顿的詹姆斯敦基金会(Jamestown Foundation)汇编并独家提供给新闻机构的数据,显示出蒸馏技术被与中国人民解放军和其他军事机构有关的研究人员广泛使用。
这些文件表明,中国国防机构将美国领先的人工智能模型视为技术洞察力的来源,以及缩小与美国竞争对手差距的一种方式。
路透社指出,争议的焦点在于未经授权的提取,而不是蒸馏本身,蒸馏是一种广泛使用的行业做法。
在中美即将就人工智能治理和安全问题展开会谈之际,人工智能问题已成为一个主要的爆发点。美国官员指责一些中国实体利用“蒸馏”技术从美国人工智能模型中提取宝能,这可能破坏出口管制并侵犯知识产权。
中国驳斥了这些指控,反指控华盛顿正在推行人工智能“霸权主义”,并辩称美国公司也从事过类似的做法。
中国开发者也驳斥了有关其人工智能技术进步依赖于外国模型的说法。人工智能初创公司“月之暗面”上周否认了川普政府关于它的 Kimi K3 模型采用蒸馏法构建的指控,称该模型是由自主创新驱动的。
詹姆斯敦大学研究员张昆阳(Sunny Cheung)分析了 60 多篇论文后表示,中国军事科学家正在系统地捕捉西方模型的推理步骤,并将其应用于监视、网络战和战术决策。
张昆阳说:“教模型正确的答案是一回事,但教它答案背后的原因就难得多。” 他进一步指出,“这些论文表明,与中国军方有关联的研究人员正试图将西方模型中昂贵且专有的推理方法转移到他们可以控制并在本地部署的小型系统中。”
路透社核实了学术文献,并找到了另外二十多个与军事相关的案例研究。
去年,解放军96941部队(北京的军事情报和网络战部队)的研究人员发表了一篇论文,描述了如何使用 OpenAI 的GPT-3.5来处理敏感的军事源代码。
研究人员表示,第三方模型不适合处理机密信息。为了克服这一局限性,他们使用 GPT-3.5 对软件代码进行摘要,并基于这些摘要训练了一个国产模型,使其完全在中国军用网络内运行。
白宫、五角大楼、中国外交部、解放军和 OpenAI 均未回应置评请求。
用途广泛,从监控到军事领域
路透社和詹姆斯敦基金会对相关论文的审查显示,中国研究人员已将蒸馏技术应用于从内容监控到军事部署等各种用途。
与中国军工企业联系紧密的中北大学(前华北工学院),研究人员使用 Anthropic 的 Claude 3 Haiku 生成合成训练数据,用于社交媒体监控和内容审核的文本分类模型。
Anthropic 表示,该公司并未向由中国或北京控制的公司提供 Claude 商业服务,并使用监控系统来检测违反政策的行为。
该公司补充说,精简后的模型可能会失去原始系统的安全保障,从而有可能将敏感功能转移到其控制范围之外的模型中。
2024 年,解放军国防科技大学发表了一篇论文,描述了如何利用蒸馏技术缩小图像处理模型,以便将其部署到无人机上,使无人机即使在通信中断的情况下也能分析实时视频并支持导航和目标选择决策。
今年早些时候发表的一项研究表明,中国军事科学院的研究人员也利用蒸馏技术,在涉及无人机、舰船和无人潜艇的模拟海上作战中,对战术硬件运行目标识别模型。
益处与局限
中国在寻求与美国在尖端人工智能领域展开竞争的同时,也面临着因华盛顿对高端芯片的出口管制而导致的先进计算资源短缺问题,因此大力推进数据蒸馏技术。中央和地方政府积极推广“模型轻量化”和边缘计算,并将补贴和研究经费投入到能够使人工智能模型在无人机、卫星和其他处理能力有限的设备上运行的技术中。
然而,专家提醒说,蒸馏法其实存在很大的局限性。
随着中国人工智能模型与美国同类模型之间的差距缩小,军事研究人员也在研究蒸馏技术作为一种潜在的安全风险。
今年一月,陆军工程大学的研究人员发表了一篇关于“无数据蒸馏”威胁的论文,这是一种无需直接访问模型核心参数即可逆向工程模型功能的方法。
为了应对这种漏洞,他们提出了防御机制,旨在掩盖模型公共输出中暴露的隐藏逻辑信息。
但精简后的模型也只能继承部分功能,无法完全复制前沿系统的广泛智能。
路透社最后援引 AI 数据公司 Sapien 的联合创始人克威尔科(Trevor Koverko)表示,提炼模型的能力仍然不如它们的教师模型。他认为,“最好将其理解为将特定功能转移到更便宜、本地控制的系统中,而不是实现对前沿人工智能的独立。”
总而言之,中美之间的人工智能战争如今已正式打响。