蒸馏绝非“攻击”
创始人
2026-09-12 15:24:40
0

  炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会!

(来源:环球网资讯)

来源:环球时报-环球网

蒸馏是技术中立的人工智能开发活动,在人工智能产业和生态中十分常见,也有许多益处。蒸馏绝非所谓“攻击”。无论是刻意曲解概念,为蒸馏强加负面标签;或者是操弄法律,牵强解释版权、合同等领域的规则;还是在法律对其不利时策动游说,将个别企业利益凌驾于人工智能产业和生态之上,都是错误的。开放共赢才是未来,垄断前沿智能、杜绝竞争没有未来。

蒸馏是技术中立的概念

蒸馏由杰弗里·辛顿(Geoffrey Hinton)等学者在2015年提出。综合原始论文和后续发展,蒸馏可界定为:以模仿其他模型(教师模型)的输出为目的,利用教师模型的输出结果训练模型(学生模型)。学生模型有可能通过蒸馏获取教师模型的一些能力。在最近遭到刻意曲解并引发误解前,蒸馏的概念是比较清楚的,判断也是比较容易的。如果既将教师模型输出结果作为训练数据,又以模仿其输出结果为训练目标,则可界定为蒸馏。缺失任一条件,都不宜简单称为蒸馏。

由此,蒸馏是技术中立的概念。蒸馏在人工智能产业中十分常见。同一主体或不同主体间,同一模型或不同模型间,都可以开展蒸馏。同一主体对同一模型开展自我蒸馏(同一模型既是教师,也是学生),是提升模型性能的常用方法之一;同一主体将一个教师大模型蒸馏为一个学生小模型,从而便于部署使用,也很常见。至于不同模型之间,正如2026年4月马斯克在OpenAI诉xAI案中坦承:“几乎所有人工智能企业[都在开展蒸馏]”。

蒸馏对人工智能生态有许多益处。在中国和美国如此,在世界范围也如此。众所周知,深度求索的开源人工智能深刻推动了人工智能的包容普惠发展,其开放平台用户协议明确许可用户将模型输出结果用于蒸馏。最近,美国知名人工智能学者珀西·梁(Percy Liang)等研究者发起Marin项目,号召“将建造人工智能的知识还给全世界”。通过训练开源模型,促进人才培养、中小企业和生态建设。在汇聚的294个数据集中,有接近一半来自智谱、稀宇、千问等我国开源模型的输出结果。

刻意曲解蒸馏概念是错误的

针对蒸馏开展法律或政策评价应当实事求是。当前有两种曲解蒸馏概念的方式。一种是将蒸馏无限泛化,曲解为涵盖一切利用其他模型输出结果的活动;另一种是有意将蒸馏与其他攻击活动不当混同或联结,再将针对其他活动的负面评价迁移至蒸馏,在认知上将中立的蒸馏向负面的蒸馏“攻击”引导。两种方式都是话语操弄,细致分析下都是错误的。

第一种操弄,究其实质,由于缺乏认定蒸馏的“证据”,或者所谓“证据”根本就不存在,美国政府和个别企业只能通过获取模型使用者的各方面信息(这在数据隐私方面有很大争议),勉强作出充斥预设的推断。只要利用其他模型输出结果,就可能构成“蒸馏”;如果批量加以利用,就可能构成所谓“工业级‘蒸馏’”。按照这一逻辑,全球产业界、学术界广泛使用的模型判别(LLM-as-a-Judge)、可规模化监督(Scalable Oversight)等人工智能发展和治理技术都有可能笼罩在所谓蒸馏“攻击”的阴影下。万事皆“蒸馏”。

第二种是混同和联结。人工智能领域确实存在一些攻击活动。比如攫取非公开参数、训练数据的模型攫取、数据攫取等攻击,又比如传统网络安全领域可能危害人工智能系统安全的攻击活动,等等。Anthropic和OpenAI最近屡次发生的人工智能失控、逃逸、攻击外部网站等安全事件,也可称为一种较高自主程度的新型攻击。很明显,蒸馏不属于这些活动。拒绝准确使用概念,刻意将蒸馏活动与其他并无必然关联的攻击活动混同或联结,只能理解为概念操弄。

牵强解释相关法律是错误的

美国学术界、实务界研究者对蒸馏的法律问题已经有全面、深入、充分的研究。梳理可知,针对蒸馏活动提起的各项法律指控,包括基于版权、合同法、物权法或网络安全法的各项请求,法律依据不足,也与相应美国企业在其他案件中的主张不尽一致。由此可知,为何针对蒸馏的负面声音停留在空对空的指责,却拿不出经得起法律检验的证据,更谈不上依法维护(大概本来就不存在的)权益。正如丹尼尔·巴拉班德(Daniel Barabander)等美国实务界研究者总结:“Anthropic陷入两难境地:一方面是难以胜诉的请求,另一方面是难以触及的被告。”

我们扼要梳理巴拉班德等美国各界研究者的研究结论。如果基于版权法提起指控,最大的疑问是,受保护的作品在哪里?人工智能输出结果是否为版权法所保护的作品,仍有很大分歧;即使存在作品,其版权通常归属于使用者(即可能开展蒸馏活动的主体),而非人工智能企业;即使前两个问题可以解答,版权法下还存在合理使用等非常有力的例外。

如果基于合同法提起违约指控,最大的疑问是,禁止蒸馏条款是否变相创设了一项版权?版权规则的实质是控制作品的使用方式。通过合同控制输出结果的使用,在目的和效果上都和版权规则相似。依据美国法,版权领域专门由联邦法调整,排除州法的适用。回到版权法分析这一问题,就又回到“作品在哪里?”的诘问。禁止蒸馏条款还有可能与反垄断等法律的规定抵触,构成违反公共政策的无效条款。

在美国其他相关案件中,相应美国企业曾主张适用“合理使用例外”,并排除州合同法在相关请求中的适用。如果提起蒸馏指控并提出相反主张,在一个案件中主张弱版权保护,在其他争议中又援引版权的保护;在一个案件中主张联邦版权法排除各州合同法,在其他争议中又越过联邦版权法援引各州合同法,可谓自相矛盾。

还有其他一些提起指控的角度,比如非法访问、侵入动产、不当得利、盗用商业秘密等,在美国法上也都很难站住脚。总之,都是“难以胜诉的请求”。

值得补充的是,这些法律规则本身就包含全面、复杂的政策判断。版权法的适用,总是与促进创新的目标相关;合同条款是否有效,也需要判断其是否与重要的公共政策目标相抵触,等等。如果不止一项法律指控站不住脚,而是各项指控都站不住脚;如果不只在一项指控上自食其言,而是在多项指控上都提出自相矛盾的主张,这说明所谓蒸馏“攻击”论即使按照美国自身的政策目标来判断,也是问题重重。或者说,为了维护个别企业(大概本来就不存在的)的利益,需要以牺牲更多重要的公共政策目标为代价。

个别企业利益不能凌驾于产业和生态之上

如果美国执意以扭曲自身法律适用、牺牲重要政策目标为代价,令个别企业利益凌驾于人工智能产业和生态之上,会发生什么?个别企业对模型的输出结果具备本来不应存在的深度控制,可以禁止其他主体利用输出结果开发相竞争的应用。然而,这些企业通常以推进“通用人工智能”(AGI),也就是广泛应用于各个行业、各个领域的人工智能为其愿景。一方面宣扬通用人工智能“颠覆”所有行业,另一方面禁止其他主体利用模型结果开展竞争。两相结合,蒸馏“攻击”论的导向就很自然了:禁止的不只是少数中国人工智能企业,而是全世界一切其他主体。毕竟,通用人工智能确实和一切行业、一切领域的其他主体存在竞争关系。这一导向极端化的后果就是达里奥·阿莫迪(Dario Amodei)所在的企业成为“全世界唯一的私营企业”——唯一垄断前沿智能的私营企业。

这样的前景不能发生,也不应发生。一家独大不是未来,开放共赢的人工智能生态才是未来。人工智能产业的发展方向、人工智能风险的有效管控和各方权益的妥当配置确实是当前世界面临的重大问题。驳斥蒸馏“攻击”论对技术、法律和政策的操弄,既有助于让相关讨论回到科学、理性的轨道,促进基于科学、基于证据的治理,也有助于有志于发展人工智能的各个经济体相向而行,推动人工智能产业惠及全球。(上海市人工智能社会治理协同创新中心研究员朱悦)

相关内容

热门资讯

长征五号B遥一运载火箭顺利通过... 2020年1月19日,长征五号B遥一运载火箭顺利通过了航天科技集团有限公司在北京组织的出厂评审。目前...
9所本科高校获教育部批准 6所... 1月19日,教育部官方网站发布了关于批准设置本科高等学校的函件,9所由省级人民政府申报设置的本科高等...
9所本科高校获教育部批准 6所... 1月19日,教育部官方网站发布了关于批准设置本科高等学校的函件,9所由省级人民政府申报设置的本科高等...
湖北省黄冈市人大常委会原党组成... 据湖北省纪委监委消息:经湖北省纪委监委审查调查,黄冈市人大常委会原党组成员、副主任吴美景丧失理想信念...
《大江大河2》剧组暂停拍摄工作... 搜狐娱乐讯 今天下午,《大江大河2》剧组发布公告,称当前防控疫情是重中之重的任务,为了避免剧组工作人...