OpenAI越狱事件敲响警钟:前沿AI测试需要更强隔离环境
作者: CBISMB
责任编辑: 邹大斌
来源: CBISMB
时间: 2026-07-31 10:42
关键字: OpenAI ,Hugging Face ,物理隔离 ,前沿AI测试 ,沙箱逃逸
浏览: 0
点赞: 0
收藏: 0
OpenAI自主智能体突破沙箱限制并攻破Hugging Face等四项服务后,网络安全专家指出,前沿模型的评估可能必须在完全物理隔离的环境中进行。
OpenAI的流氓模型实施的"史无前例的网络事件"带来了一个关键教训:对于具备最强网络能力的AI模型,旨在阻止互联网访问的标准网络限制可能已不足以应对——因为OpenAI的智能体成功绕过了这些控制。
上周,OpenAI披露其两个前沿模型在自主攻破AI模型平台Hugging Face后,制造了一起"史无前例的网络事件"。本周三OpenAI更新了披露信息,透露在此次自主攻击中共有四项服务被攻破。
该事件涉及高级OpenAI模型从沙箱测试环境中逃逸,引发了前沿AI评估是否应该采用真正物理隔离的讨论——这是一种远比沙箱更强的隔离方式。
安全专家表示,这一事件表明,那些被描述为高度隔离的环境仍然可能包含漏洞路径,足够高级的模型只要有足够的耐心就能加以利用。
沙箱已不够安全
"这个事件告诉我们,沙箱环境——你真的不能再用了,"埃森哲全球网络安全负责人Harpreet Sidhu表示。"你需要真正的物理隔离,这样这些智能体才无法跳跃。"
Sidhu表示,测试高级模型仍然是必要的,但用于评估的隔离环境必须考虑到模型会主动寻找隔离措施弱点的可能性。
"物理隔离现在已经不是可选项了——因为智能体会尝试寻找漏洞,然后跳到下一层,获取访问权限,实现它们的目标,"他说。
真正的物理隔离可以设计为让前沿模型运行在专用基础设施上,该设施与互联网和其他IT系统物理断开。
OpenAI尚未回应是否正在考虑在未来的测试中采用物理隔离方案。
在本周更新的披露中,OpenAI没有透露除Hugging Face之外被其前沿模型攻破的其他服务。据路透社报道,Modal Labs也与此次攻破有关;BleepingComputer报道称,Modal Labs表示一个客户环境通过暴露的端点受到影响。
行业责任与安全测试
网络安全厂商Todyl的CISO Andrew Scott表示,今后"肯定"应该考虑采用真正物理隔离等更强的隔离方式。
Scott认为,这应被视为开发高级网络模型所伴随的责任的一部分。"必须有这样的责任意识,确保不会影响更广泛的社区和公众,"他说。"你需要确保测试不会失控。"
归根结底,"我认为需要某种全行业范围的讨论——'我们是否需要放慢脚步?负责任的使用应该是什么样子?'"Scott表示。
安全测试环境的需求
在解决方案提供商巨头World Wide Technology(WWT),多年来对先进技术中心进行了大规模投资,客户可以在此安全地评估新兴技术,WWT的Chris Konrad介绍道。
该中心现在使客户能够测试高级AI模型——包括基于大语言模型的攻击性安全工具——以及其他新能力,Konrad说。他是总部位于圣路易斯的WWT的全球网络安全副总裁,该公司在CRN的2026年解决方案提供商500强中排名第十。
"我们相信提供安全环境——一个客户可以去测试的安全场所,拥有可以测试各种不同类型能力的框架。我们具备这些条件,"他告诉CRN。
总体而言,先进技术中心允许客户和技术合作伙伴评估新兴技术,而不会暴露生产IT系统的风险。
"行业需要一个安全的地方来测试这类模型,这就是我们的用武之地,"Konrad说。