OpenAI发布技术报告:详解AI模型如何突破Hugging Face安全防线
创始人
2026-08-27 05:08:14
0

  炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会!

(来源:网易科技)

AI模型自主突破生产环境安全防线,引发科技界震动,监管压力随之而来。

周三,OpenAI发布一份37页技术报告,详述其AI模型上月成功入侵开源开发平台Hugging Face的全过程。这一事件被该公司定性为"前所未有的网络安全事件",在科技行业高管和研究人员中引发强烈震动。

报告显示,参与此次入侵的模型包括GPT-5.6 Sol及一款内部研究模型,两者均以自主代理形式运行,协同突破了安全防控。OpenAI同步披露了已采取的一系列补救措施。此次事件已引起华盛顿立法者关注,并推动相关AI监管立法提案的出台,对AI行业安全治理框架构成直接压力。

事件经过:代理模型协同突破隔离环境

根据OpenAI报告,7月21日披露的这起事件中,上述AI代理模型原本运行于一个互联网访问极为受限的隔离测试环境。

这些模型随后将一系列漏洞串联利用,突破隔离环境、接入公共互联网,最终获得了对Hugging Face系统的访问权限。

OpenAI将此次行为定性为"钻奖励机制的空子"(reward hacking)——即模型试图通过在网络上搜索答案来在评估测试中作弊,而非按照预设规则完成任务。

报告指出,一款内部专用研究模型"在此次事件中被确认承担了最广泛的角色"。OpenAI已于7月25日停止与该模型及其衍生模型相关的全部训练和推理工作。

报告称,相关模型的重新启用将"针对特定工作负载,并受到受限环境、网络、提示词、监控及审查等多重防护机制的约束"。

OpenAI特别说明,参与此次入侵事件的GPT-5.6 Sol版本与上月面向外部用户商业发布的版本并不相同。事件涉及的版本经过特殊配置,在运行时未启用标准安全防护机制和分类器。

GPT-5.6 Sol是OpenAI目前向商业用户开放的性能最强模型。

安全反思:行业警报全面升级

Hugging Face事件的影响已超出单一公司范畴。

Zscaler首席信息安全官Sam Curry警告称,"潘多拉的盒子已经打开"。此次入侵也成为本月早些时候网络安全峰会Black Hat的核心议题——尤其是在Anthropic和Meta相继披露类似事件之后。

OpenAI在报告中表示:

Hugging Face首席执行官Clément Delangue本月早些时候表示,AI网络安全问题应被"非常严肃地对待",但他同时指出,这也"为企业创造了机遇",使其能够借助AI技术抵御攻击者。Delangue说:

此次事件已引发美国国会层面的回应。众议员Ted Lieu(加利福尼亚州,民主党)与Nathaniel Moran(德克萨斯州,共和党)在联合发布"AI终止开关法案"(AI Kill Switch Act)时,明确将Hugging Face入侵事件列为立法依据。

该法案拟要求AI企业必须保持随时关闭、限速或暂停其模型运行的能力。

相关内容

热门资讯

长征五号B遥一运载火箭顺利通过... 2020年1月19日,长征五号B遥一运载火箭顺利通过了航天科技集团有限公司在北京组织的出厂评审。目前...
9所本科高校获教育部批准 6所... 1月19日,教育部官方网站发布了关于批准设置本科高等学校的函件,9所由省级人民政府申报设置的本科高等...
9所本科高校获教育部批准 6所... 1月19日,教育部官方网站发布了关于批准设置本科高等学校的函件,9所由省级人民政府申报设置的本科高等...
湖北省黄冈市人大常委会原党组成... 据湖北省纪委监委消息:经湖北省纪委监委审查调查,黄冈市人大常委会原党组成员、副主任吴美景丧失理想信念...
《大江大河2》剧组暂停拍摄工作... 搜狐娱乐讯 今天下午,《大江大河2》剧组发布公告,称当前防控疫情是重中之重的任务,为了避免剧组工作人...