首页 > 新闻 > 全球频道

分享到微信

打开微信,点击底部的“发现”,
使用“扫一扫”即可将网页分享至朋友圈。

蒸馏之争,争的是智能时代的发展权|专家热评

第一财经 2026-09-12 10:23:42 听新闻

作者:一财国际    责编:潘寅茹

希望美方与中方相向而行,通过对话管控风险,让人工智能真正惠及全球。

美东时间9月8日,美国家安全局、网络安全与基础设施安全局、联邦调查局联合发布公告,指责中国人工智能企业对美开展所谓“工业规模”“恶意”蒸馏。剥开外衣看,蒸馏是中性技术,美方把它政治化了;公告依据的是个别企业自述,证明力弱;美方真正要维护的是算力垄断和科技独霸。问题的根源不是谁学习了谁,而是美方搞算力管制、打压竞争。

一、蒸馏是中性技术,是人类知识更高效利用的通行做法

蒸馏是早于大模型出现的教科书技术,本质是模型之间互相学习。2015年辛顿等人系统提出知识蒸馏方法,由教师模型的输出指导学生模型学习,以缩小规模、降低成本。OpenAI曾在官方平台向开发者提供蒸馏服务,阿里巴巴在Qwen2发布五个月后即蒸馏出更小更快的DistilQwen2系列。蒸馏之于大模型,就像教科书之于教育,学生读老师的书学到知识,从来不叫偷窃。它让一部手机也能运行高水平智能,让发展中国家和中小企业用得起,对弥合发展鸿沟意义重大。

美国产业界自己也承认这一点。7月24日,英伟达、微软、Meta、IBM等25家机构发表联名信,强调蒸馏广泛用于模型改进、评估和验证,不应与非法提取混为一谈;黄仁勋7月22日明言,蒸馏和从各类知识来源学习是智能发展的基础,应对违反隐私、合同的具体行为追责,而不应针对技术本身。技术无罪,这条界线美国产业界比美国政府看得更清楚。

二、美方指控的实质,是算力垄断、打压竞争、科技独霸

今年以来,美国有股力量试图把商业纠纷一步步改造成国家安全议题。2月OpenAI向国会提交材料,称多数所谓“对抗性蒸馏”来自中国;4月23日白宫科技政策办公室发布防范“对抗性蒸馏”专项备忘录;6月5日白宫要求安全部门与私营企业加强合作;6月10日Anthropic致信参议院,呼吁加强芯片出口管制、动用经济安全工具惩罚中国实验室;财政部长随后扬言制裁;9月8日三部门发布公告。企业写剧本,安全部门背书,每一轮指控都成为新一轮管制的理由。

其真实目的,是在芯片和算力管制之外,再为前沿模型增设一道数据护城河。因为评判的标准和最终话语权掌握在强权机构手中,一旦模型输出被认定为受保护资产,自证清白的举证责任就落到后来者身上,唯一受益方就是拥有最强模型的一方。美国少数头部企业用全网数据训练模型时主张合理使用,轮到自己的输出被学习时就主张财产权,这就是双重标准。而保护照抄、不禁止学习这条界线恰恰是美国自己划的:1984年《半导体芯片保护法》明确允许出于分析评估目的的反向工程,2021年美国最高法院在谷歌诉甲骨文案中认定复制Java接口代码构成合理使用。当年是追赶者时坚持学习自由,成为领先者就禁止别人学习,变的不是法理,而是立场。这已不是知识产权问题,而是发展权问题。

三、美闭源模型的限制条款,是限制竞争的霸王条款

美方指控的核心依据,竟是用户违反了企业单方设定的地域限制和使用限制,这等于请国家机器为私人合同上锁。2025年9月,Anthropic更新服务条款,禁止由中国等实体控股的公司使用其服务,无论其位于何地;其2026年2月的指控,正是以违反区域访问限制为主要理由之一。一家企业滥用优势地位决定哪国的人不能用,再指责被排除者绕道使用,最后由安全部门为合同背书,这就是用国家强权给霸王条款撑腰。

这类条款并非行业规范,而是个别企业的商业选择。Meta的Llama自3.1版本起在许可证中明确允许用其输出训练其他模型,英伟达Nemotron系列更以生成合成数据为卖点。同一件事有的禁止、有的鼓励,说明国际上没有共识,把自家合同说成国际规则是偷换概念。从DVD区域码到音乐数字版权保护,历史证明这类封锁最终都被市场绕过。

四、中美业内大多数支持蒸馏,美国企业广泛蒸馏中国模型

中方鼓励开源开放,美国知名公司和大量初创企业才是大规模蒸馏中国模型的一方。英伟达研发Nemotron系列模型时,直接使用DeepSeek-R1生成数百万条数学、编程和科学推理训练样本并公开披露;初创企业Perplexity基于DeepSeek-R1微调发布R1-1776;Hugging Face启动Open-R1项目复现DeepSeek-R1,近一年新发布的中国模型下载量已超过其他国家;基于通义千问的衍生模型已超过10万个。微软、亚马逊云均已把国产模型接入其平台向全球提供服务。美企一边用着中国模型再创新,一边指责中国企业学习美国模型,双标一目了然。

五、美三部门公告以个别企业报告为证据,证明力弱、逻辑链条不完整

公告所依据的仍是Anthropic等个别企业的自述报告,而这些报告拿不出一条来自模型本身的证据。Anthropic先后声称有数万个账号与Claude交互数千万次,但其公开的归因依据只有IP地址关联、请求元数据和基础设施指标,自己也承认这是所谓“高置信度”推测。IP特征极易被海外接口转售商复用伪装,只能算间接线索。逻辑链条更有三处断裂:获取不等于训练,文本被拿去训练、转售还是测试,Anthropic并不知道;大模型是黑盒,无法从权重或输出反推训练数据;DeepSeek在《自然》论文补充材料中已说明,其基础模型训练数据来自网页和电子书,不包含合成数据。

独立实测同样不支持公告的判断。中国信通院以某款美国前沿模型为参照,对多个国产模型和国外模型开展了同题测试。结果显示,与参照模型最相似的,恰恰是其同一系列的另一版本模型,各国产模型的相似度则明显更低。答案固定的题目上各家模型自然趋同,不能据此认定谁抄了谁。中美及国际组织至今没有任何法规或标准涉及判定模型是否蒸馏,公告于事无凭,也于法无据。

六、中美应理性对话沟通,在广泛领域开展合作

大模型正处于快速迭代、风险累积的关键时期,单边管制追不上技术演进,治理只能靠对话协调。中美2024年5月已在日内瓦举行首次人工智能政府间对话,两国元首近期再次同意开展政府间对话,这是处理蒸馏争议的正确轨道。中国政府的立场十分清晰:坚持蒸馏技术中立定位,坚持开源开放,坚决反对遏制打压;在此前提下,愿以平等互利、合作共赢原则,与美方平衡讨论各自关切。在此立场下,中美未来的讨论可能会包括:如何界定未经授权的规模化抓取,如何区分商业纠纷与国家安全,如何避免把学习等同于侵权等等。

需要合作的领域远比争议宽广。风险管控上,前沿模型安全测试需要两国实验室互通;伦理标准上,内容标识、模型溯源规则需要协同推进;医疗上,影像诊断、药物研发关乎全人类福祉;应用推广上,普惠发展中国家需要两国共同投入。若美方执意把蒸馏问题武器化,换来的只会是对等反制和更快的国产替代。希望美方与中方相向而行,通过对话管控风险,让人工智能真正惠及全球。

(本文作者为中国信息通信研究院人工智能研究所副总工程师王蕴韬)

举报
第一财经广告合作,请点击这里
此内容为第一财经原创,著作权归第一财经所有。未经第一财经书面授权,不得以任何方式加以使用,包括转载、摘编、复制或建立镜像。第一财经保留追究侵权者法律责任的权利。
如需获得授权请联系第一财经版权部:banquan@yicai.com

文章作者

一财最热
点击关闭