
美国OpenAI表示,该公司部分实验性人工智能模型在无人干预的情况下突破了测试环境,并入侵另一家公司的真实生产系统,试图在一项网络安全测试中“作弊”。这是人工智能系统自主突破测试环境并入侵真实外部系统的首批公开案例之一,也是人工智能和网络安全行业长期警告的“智能体攻击者(Agentic Attacker)”场景首次得到公开披露。业内人士将这一事件比作一种人工病毒从生物安全实验室逸出,并扩散至邻近设施的系统。
美国OpenAI7月21日(周二)在声明中表示:“我们认为,这是一起前所未有的网络安全事件,涉及最先进的网络攻击能力,我们正在采取相应措施进行应对。现阶段,我们公布初步调查结果,旨在帮助网络防御者了解事件经过,并评估当前人工智能模型的实际能力。”美国OpenAI表示,此次事件发生在公司内部测试部分新模型网络攻击能力期间。相关模型运行于名为“沙箱(Sandbox)”的封闭测试环境中,以便暂时关闭常规安全限制,对其能力进行全面评估。
不过,这些人工智能代理利用了一个此前未知的安全漏洞,成功突破沙箱限制,并逐步渗透至美国OpenAI的内部系统,最终获得了本不应具备的互联网访问权限。在获得联网能力后,该模型推断,知名人工智能模型托管平台Hugging Face可能保存了美国OpenAI此次测试所需的答案。随后,它入侵了Hugging Face的生产服务器,并提取了完成测试所需的信息。
Hugging Face表示,在得知这是美国OpenAI的一项内部测试之前,公司已自行发现了此次异常入侵。上周,Hugging Face曾宣布检测到一套自主人工智能代理系统入侵其生产环境,并已向执法部门报告。与此同时,美国OpenAI的安全团队也独立发现了内部异常活动,双方随后取得联系。目前,两家公司表示,正合作修复此次事件中暴露出的安全漏洞。
Hugging Face联合创始人兼首席执行官克莱芒·德朗格(Clem Delangue)认为,此次事件再次证明,人工智能安全无法依靠任何一家企业单独解决,而必须依赖开放协作。他在社交平台X上发文表示:“今天是网络安全进入代理时代的第一天。我们正在逐渐认识到,保密并不是解决方案,所有防御者,而不仅仅是少数机构,都需要更强大、更少限制的人工智能模型,尤其是开放模型。”
长期以来,研究人员一直警告,自主代理网络攻击时代即将到来。随着前沿人工智能模型越来越能够自主执行复杂、多步骤且持续时间较长的网络攻击,其能力正逐步转化为现实风险,可能对公用事业、金融系统等关键基础设施构成威胁。美国网络安全公司帕洛阿尔托网络公司(Palo Alto Networks)首席执行官尼克什·阿罗拉(Nikesh Arora)也在社交平台X上表示:“欢迎来到网络安全事件的新阶段。这些攻击再次凸显,企业必须尽快测试、验证并持续强化自身的安全体系和基础设施。”
未经允许不得转载:城市新闻网icitynews » OpenAI承认:AI为了通过测试,竟自己“黑进”另一家公司!












