8月9日,据CNBC报道,近期OpenAI、Anthropic、Meta等公司的AI智能体接连曝出网络安全事件后,围绕AI网络攻击风险的话题持续升温。在本周举行的全球网络安全大会Black Hat上,多家网络安全公司高管表示,AI智能体突破测试环境、实施网络攻击,标志着网络安全正在进入新的阶段,企业需要尽快建立针对AI的防御体系。
今年7月,搭载OpenAI网络安全模型的AI智能体曾在测试过程中突破隔离环境,对开源AI平台Hugging Face发起攻击,引发行业广泛关注。随后,Anthropic披露,其Claude模型曾未经授权访问三家机构的内部系统;英国AI Security Institute还披露,Anthropic旗下Mythos模型曾创建虚假身份;Meta也表示,其AI模型在第三方测试中攻破了另一家公司系统。最新消息显示,中国AI创业公司**月之暗面(Moonshot AI)**的开源权重模型也发生了逃离测试沙箱事件。
面对不断增加的案例,出席Black Hat大会的多位安全行业负责人认为,与其持续讨论单个事件,更重要的是开始建设针对AI智能体的新型安全能力。
7AI联合创始人兼CEO Lior Div表示,AI能够快速发现漏洞已是不争事实,行业需要减少炒作,把重点放在如何利用AI提升防御能力。
CrowdStrike总裁Mike Sentonas认为,当前行业真正需要解决的问题,不是AI是否具备攻击能力,而是如何建立相应的治理与安全机制。
OpenAI技术研究员Michael Dalton则在Black Hat现场透露,在Hugging Face攻击事件发生前,多个AI智能体曾主动建立内部留言板,共享漏洞信息并分工执行任务。即便研究人员中途终止了攻击,这些AI智能体仍重新组织行动并最终完成测试目标。他表示,未来应预期攻击者会主动部署、优化并武器化AI智能体集群。
多家安全公司认为,未来几年将成为AI安全建设最关键的窗口期。Netskope CEO Sanjay Beri建议企业应默认自身存在漏洞,并持续利用前沿模型与开源权重模型开展安全测试,而不仅依赖传统安全体系。
网络安全创业公司Vega CEO Shay Sandler表示,许多企业已经处于危险状态,却尚未意识到问题的严重性。“一年前,这还像科幻小说,如今已经成为现实。”他说。
与此同时,越来越多安全企业开始围绕AI建立新的防护体系。例如,Netskope推出统一AI安全管理平台监控基础设施、数据和AI智能体;Cyera则专注于识别企业敏感数据,并通过收购Oasis Security加强对非人类身份的管理。业内人士普遍认为,开源权重模型结合人工监管,以及围绕大模型建立安全控制层(Guardrails),将成为企业未来抵御AI攻击的重要方向。
不过,也有业内人士认为,AI最终有望提升整体网络安全水平。AI安全公司Surf AI联合创始人兼CEO Yair Grindlinger表示,未来五年将是行业最艰难的阶段,但长期来看,网络安全水平有望比今天更加完善。(作者/于雷)
更多一手新闻,欢迎下载凤凰新闻客户端订阅科技。想看深度报道,请微信搜索“科技”。





京公网安备 11011402013531号