• 最近访问:
发表于 2026-09-12 10:34:30 股吧网页版
蒸馏之争 争的是智能时代的发展权|专家热评
来源:第一财经 作者:一财国际

  美东时间9月8日,美国家安全局、网络安全与基础设施安全局、联邦调查局联合发布公告,指责中国人工智能企业对美开展所谓“工业规模”“恶意”蒸馏。剥开外衣看,蒸馏是中性技术,美方把它政治化了;公告依据的是个别企业自述,证明力弱;美方真正要维护的是算力垄断和科技独霸。问题的根源不是谁学习了谁,而是美方搞算力管制、打压竞争。

  一、蒸馏是中性技术,是人类知识更高效利用的通行做法

  蒸馏是早于大模型出现的教科书技术,本质是模型之间互相学习。2015年辛顿等人系统提出知识蒸馏方法,由教师模型的输出指导学生模型学习,以缩小规模、降低成本。OpenAI曾在官方平台向开发者提供蒸馏服务,阿里巴巴在Qwen2发布五个月后即蒸馏出更小更快的DistilQwen2系列。蒸馏之于大模型,就像教科书之于教育,学生读老师的书学到知识,从来不叫偷窃。它让一部手机也能运行高水平智能,让发展中国家和中小企业用得起,对弥合发展鸿沟意义重大。

  美国产业界自己也承认这一点。7月24日,英伟达、微软、Meta、IBM等25家机构发表联名信,强调蒸馏广泛用于模型改进、评估和验证,不应与非法提取混为一谈;黄仁勋7月22日明言,蒸馏和从各类知识来源学习是智能发展的基础,应对违反隐私、合同的具体行为追责,而不应针对技术本身。技术无罪,这条界线美国产业界比美国政府看得更清楚。

  二、美方指控的实质,是算力垄断、打压竞争、科技独霸

  今年以来,美国有股力量试图把商业纠纷一步步改造成国家安全议题。2月OpenAI向国会提交材料,称多数所谓“对抗性蒸馏”来自中国;4月23日白宫科技政策办公室发布防范“对抗性蒸馏”专项备忘录;6月5日白宫要求安全部门与私营企业加强合作;6月10日Anthropic致信参议院,呼吁加强芯片出口管制、动用经济安全工具惩罚中国实验室;财政部长随后扬言制裁;9月8日三部门发布公告。企业写剧本,安全部门背书,每一轮指控都成为新一轮管制的理由。

  其真实目的,是在芯片和算力管制之外,再为前沿模型增设一道数据护城河。因为评判的标准和最终话语权掌握在强权机构手中,一旦模型输出被认定为受保护资产,自证清白的举证责任就落到后来者身上,唯一受益方就是拥有最强模型的一方。美国少数头部企业用全网数据训练模型时主张合理使用,轮到自己的输出被学习时就主张财产权,这就是双重标准。而保护照抄、不禁止学习这条界线恰恰是美国自己划的:1984年《半导体芯片保护法》明确允许出于分析评估目的的反向工程,2021年美国最高法院在谷歌诉甲骨文案中认定复制Java接口代码构成合理使用。当年是追赶者时坚持学习自由,成为领先者就禁止别人学习,变的不是法理,而是立场。这已不是知识产权问题,而是发展权问题。

  三、美闭源模型的限制条款,是限制竞争的霸王条款

  美方指控的核心依据,竟是用户违反了企业单方设定的地域限制和使用限制,这等于请国家机器为私人合同上锁。2025年9月,Anthropic更新服务条款,禁止由中国等实体控股的公司使用其服务,无论其位于何地;其2026年2月的指控,正是以违反区域访问限制为主要理由之一。一家企业滥用优势地位决定哪国的人不能用,再指责被排除者绕道使用,最后由安全部门为合同背书,这就是用国家强权给霸王条款撑腰。

  这类条款并非行业规范,而是个别企业的商业选择。Meta的Llama自3.1版本起在许可证中明确允许用其输出训练其他模型,英伟达Nemotron系列更以生成合成数据为卖点。同一件事有的禁止、有的鼓励,说明国际上没有共识,把自家合同说成国际规则是偷换概念。从DVD区域码到音乐数字版权保护,历史证明这类封锁最终都被市场绕过。

  四、中美业内大多数支持蒸馏,美国企业广泛蒸馏中国模型

  中方鼓励开源开放,美国知名公司和大量初创企业才是大规模蒸馏中国模型的一方。英伟达研发Nemotron系列模型时,直接使用DeepSeek-R1生成数百万条数学、编程和科学推理训练样本并公开披露;初创企业Perplexity基于DeepSeek-R1微调发布R1-1776;Hugging Face启动Open-R1项目复现DeepSeek-R1,近一年新发布的中国模型下载量已超过其他国家;基于通义千问的衍生模型已超过10万个。微软、亚马逊云均已把国产模型接入其平台向全球提供服务。美企一边用着中国模型再创新,一边指责中国企业学习美国模型,双标一目了然。

  五、美三部门公告以个别企业报告为证据,证明力弱、逻辑链条不完整

  公告所依据的仍是Anthropic等个别企业的自述报告,而这些报告拿不出一条来自模型本身的证据。Anthropic先后声称有数万个账号与Claude交互数千万次,但其公开的归因依据只有IP地址关联、请求元数据和基础设施指标,自己也承认这是所谓“高置信度”推测。IP特征极易被海外接口转售商复用伪装,只能算间接线索。逻辑链条更有三处断裂:获取不等于训练,文本被拿去训练、转售还是测试,Anthropic并不知道;大模型是黑盒,无法从权重或输出反推训练数据;DeepSeek在《自然》论文补充材料中已说明,其基础模型训练数据来自网页和电子书,不包含合成数据。

  独立实测同样不支持公告的判断。中国信通院以某款美国前沿模型为参照,对多个国产模型和国外模型开展了同题测试。结果显示,与参照模型最相似的,恰恰是其同一系列的另一版本模型,各国产模型的相似度则明显更低。答案固定的题目上各家模型自然趋同,不能据此认定谁抄了谁。中美及国际组织至今没有任何法规或标准涉及判定模型是否蒸馏,公告于事无凭,也于法无据。

  六、中美应理性对话沟通,在广泛领域开展合作

  大模型正处于快速迭代、风险累积的关键时期,单边管制追不上技术演进,治理只能靠对话协调。中美2024年5月已在日内瓦举行首次人工智能政府间对话,两国元首近期再次同意开展政府间对话,这是处理蒸馏争议的正确轨道。中国政府的立场十分清晰:坚持蒸馏技术中立定位,坚持开源开放,坚决反对遏制打压;在此前提下,愿以平等互利、合作共赢原则,与美方平衡讨论各自关切。在此立场下,中美未来的讨论可能会包括:如何界定未经授权的规模化抓取,如何区分商业纠纷与国家安全,如何避免把学习等同于侵权等等。

  需要合作的领域远比争议宽广。风险管控上,前沿模型安全测试需要两国实验室互通;伦理标准上,内容标识、模型溯源规则需要协同推进;医疗上,影像诊断、药物研发关乎全人类福祉;应用推广上,普惠发展中国家需要两国共同投入。若美方执意把蒸馏问题武器化,换来的只会是对等反制和更快的国产替代。希望美方与中方相向而行,通过对话管控风险,让人工智能真正惠及全球。

  (本文作者为中国信息通信研究院人工智能研究所副总工程师王蕴韬)

郑重声明:用户在财富号/股吧/博客等社区发表的所有信息(包括但不限于文字、视频、音频、数据及图表)仅代表个人观点,与本网站立场无关,不对您构成任何投资建议,据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容,远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息,谨防上当受骗!
作者:您目前是匿名发表   登录 | 5秒注册 作者:,欢迎留言 退出发表新主题
温馨提示: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。《东方财富社区管理规定》

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-34289898 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:021-54509966/952500