中国军事研究人员使用OpenAI和Anthropic模型的API输出训练国内防御AI系统。
路透社对80多篇中国学术论文和专利的调查发现,隶属于中国军事和安全机构的研究人员使用了来自美国先进AI模型(包括OpenAI和Anthropic开发的系统)的输出,来训练规模较小的国内系统,用于防御和监视应用。这些发现表明,模型蒸馏这一广泛使用的AI技术可能为中国研究人员提供了绕过芯片和技术限制的捷径,而不是彻底突破这些限制的方式。
模型蒸馏是AI行业的标准实践。它涉及使用强大的"教师"模型的输出来训练一个更小的"学生"系统,该系统可以在远少得多的计算能力上运行,同时保留原始模型选定的推理或分类能力。该技术是推动全球高效、设备端AI部署的基础。
引起关注的是该技术在何处以及如何被使用的。根据路透社与位于华盛顿的詹姆斯敦基金会联合进行的审查,解放军96941部队的科学家去年发表的一篇论文——该部队被描述为军事情报和网络战争单位——详细说明了使用OpenAI的GPT-3.5来总结军事相关软件代码,随后训练一个完全能够在中国军事网络内运行的国内模型。该论文指出外部AI服务不适合直接处理涉密信息,这表明蒸馏步骤是被专门用来规避该限制的。
另一项研究发现,与该国防工业紧密相关的北方中国大学的研究人员使用了Anthropic的Claude 3 Haiku模型来生成合成训练数据,用于为社交媒体监测和内容审核构建的文本分类系统。Anthropic告诉路透社,它不在中国或向北京控制的公司提供Claude的商业访问权限,并表示主动监测违反其使用政策的行为。该公司警告说,蒸馏模型可能会丧失原系统中内置的安全保障——这一警告凸显了为什么监管机构将该技术视为出口执法中的潜在盲点。
防御应用远远超出文本和社交媒体分析的范围。解放军国防技术大学2024年的一篇论文描述了压缩图像处理模型以在无人航空器上部署,使无人机能够分析实时视频、辅助导航和支持瞄准,而无需主动通信链接。另一项研究记录了蒸馏目标识别系统在涉及无人机、海军舰艇和无人潜艇的模拟海上作战中的测试,展示了民用AI技术一旦适应,如何迅速转入战场应用。
这些发现出现在AI供应链对峙加剧的背景下。华盛顿正在收紧对中国先进半导体的访问限制,而基于蒸馏的解决方案似乎规避了这些限制旨在创造的计算约束。值得注意的是,路透社的发现紧随Anthropic自身披露之后,该公司披露其检测到了与中国科技集团阿里巴巴相关的大规模蒸馏活动,针对Claude,涉及通过数千个虚假账户进行的数百万次自动交换——这表明对前沿模型的未授权提取尝试既非孤立事件,也不限于国家关联的防御研究。
Algoritha Security的一位AI研究人员指出,蒸馏是整个行业公认的合法和广泛接受的训练技术,但具体的关注点在于当专有能力被未经授权地提取或在敏感军事背景下应用时。该研究人员补充说,蒸馏系统通常无法复制其来源的前沿模型的完整智能、推理深度或性能——这一限制在某种程度上缓解了(虽未消除)该实践的安全影响。
对于同时建立自己的AI治理框架并扩大本土计算能力的印度而言,这一事件提醒人们AI安全和知识产权保护问题已不再局限于此类调查中直接提及的国家。随着全球关于出口管制、模型访问和防御相关AI应用的讨论加剧,蒸馏辩论可能会成为各国试图管控不再能够完全控制在自身边界内的技术时的持久分界线。