中国抄捷径 以美AI模型训练国防系统
路透七月卅一日报道揭露,OpenAI、Anthropic等美国顶尖人工智慧(AI)公司开发的模型,遭中国军事研究人员用于训练本土AI系统,提升国防、监控与审查能力。尽管华府持续限制北京取得先进芯片及关键技术,中国军方与安全机构仍透过美国尖端AI“抄捷径”,依自身需求开发特定模型。
路透检视美国智库“詹姆斯敦基金会”研究及逾八十份中国学术论文、专利文件发现,与解放军有合作或联系的机构广泛采用“模型蒸馏”技术,以大型AI模型训练可在本土运作的小型模型,降低打造先进AI的庞大运算成本。
分析逾六十篇相关论文的詹姆斯敦基金会研究员指出,中国军事科学家正系统性研究西方AI模型的推理方式,调整应用于监控、网络战及战略决策。
蒸馏模型能力不及原始模型
负责军事情报与网络战的解放军96941部队曾以OpenAI的GPT-3.5生成程式码摘要,训练可在中国军事网络运作的本地模型。与军工体系关系密切的中北大学,则利用Anthropic的Claude 3 Haiku模型产生训练资料,培养社群监控与内容审查模型。Anthropic表示,并未在中国或向北京控制企业提供Claude服务。
此外,中国人民解放军国防科技大学一篇二〇二四年论文指出,研究人员利用蒸馏技术将影像模型缩小至可部署于无人机,使其即使在通讯中断下,仍能即时分析影像、协助导航与目标锁定。
不过,专家也认为,蒸馏模型能力仍不及原始模型,本质上是将挑选过的能力转移到成本较低、可由本地控制的系统,而非复制完整的先进AI能力。

