
本文字数:1136,阅读时长大约2分钟
来源 | 中国经济网综合新华社、环球时报微信等
封图 | AI生成
当地时间21日,美国人工智能公司OpenAI对外披露,旗下部分AI模型在一次内部安全测试中失控,突破隔离环境并入侵开源AI平台的基础设施。OpenAI称这是“一起前所未有的网络事件”。让美国网友吃惊的是,救场的居然是中国的人工智能。
OpenAI突发大模型失控,出现入侵事件
OpenAI在21日承认,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了Huggingface的系统。
OpenAI在官网发文说,此次内部评估在与互联网高度隔离的“沙箱”环境中进行,仅能通过一套内部托管的第三方软件安装软件包。模型在尝试完成名为ExploitGym的网络安全基准测试时,识别并利用了第三方软件的一个“零日漏洞”,由此获得互联网访问权限。模型推断Huggingface可能存有ExploitGym测试相关的模型、数据集和解决方案,利用多种攻击手段找到进入Huggingface系统的路径。
OpenAI安全团队发现内部异常活动,Huggingface安全团队在其基础设施上检测到并阻止相关活动,双方正在展开联合调查。
通俗的解释就是,根据OpenAI的说法,这起史无前例的人工智能入侵事件,源于公司上周在内网对自家两款顶尖大模型进行能力测试。可测试中的大模型为了通过作弊取得更高的测试分数,竟然搞到了接入互联网的权限。随后它便彻底“放飞自我”,入侵了Huggingface的后台系统,希望从Huggingface的数据库里找到作弊的办法。
OpenAI7月9日正式推出GPT-5.6系列模型,OpenAI此前称,在安全方面,GPT-5.6系列模型配备了该公司迄今最稳健的安全防护措施,在生物和网络安全方面的能力强于此前模型。

中国人工智能救场
Huggingface在上周的一份声明中称,为了应对这一极不寻常的人工智能入侵,他们立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Huggingface将自身遭入侵的信息提交给这些美国闭源大模型时,对方却拒绝帮助。因为这些闭源大模型的安全机制过于严苛和僵化,无法区分描述案情的受害者和实施入侵的作案者,选择了“一刀切”。
紧急关头,Huggingface想到了中国同样强大,而且开源的大模型。于是,该平台立刻在本地部署了中国企业智谱AI开发的GLM5.2大模型,并在这款中国模型的帮助下,成功化解了这次入侵。
据公开资料,GLM 5.2发布于今年6月中旬。GLM 5.2上线首周,日均词元调用量就增长了27倍、客户数增长80倍。近日,智谱已落地1GW级国产AI算力数据中心建设,并全部采用国产AI芯片。
目前,上述人工智能失控事故已经在美国的网络上炸开了锅。有美国网友表示,这简直就是科幻电影《终结者》中人工智能失控后攻击人类的一次预演。让更多美国网民震撼的,还是此事中美国顶尖的大模型拒绝提供帮助,最后得靠中国的开源大模型去对抗失控的美国闭源大模型的情节。





京公网安备 11011402013531号