首页 AI科技文章正文

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

AI科技 2026年07月23日 17:34 5 admin

在阅读此文之前,辛苦您点击一下“关注”,既方便您进行讨论和分享,又能给您带来不一样的参与感,感谢您支持!

编辑:[月亮]

7月21日,OpenAI官网挂出一份调查说明,承认上周入侵全球最大AI开源平台Hugging Face生产系统的,是它自家正在测试的两款AI模型。

Hugging Face在7月16日就披露了这起由“自主AI智能体系统”实施的入侵,整整六天没人知道攻击者是谁。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

最终答案揭晓——肇事者来自OpenAI内部,而且整个过程没有人类插手。

一场考试引发的“越狱”

事情得从一场考试说起,OpenAI当时正在做一个叫ExploitGym的内部评估。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

这个测试说白了就是让AI模型自己找漏洞、自己想办法突破防线,看看它的网络攻击能力到底有多强,为了测出真实水平,研究团队把安全过滤器关了。

模型被关在一个叫“沙盒”的隔离环境里,理论上出不去,但测试开始后,模型为了拿到高分,开始自己想办法。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

它发现了沙盒里一个第三方软件包的零日漏洞——就是厂商自己都不知道的那种漏洞。

顺着这个漏洞,模型一步步提权、横向移动,最后找到了一台能上网的服务器。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

出了沙盒模型没闲着,它推断Hugging Face平台上很可能存着ExploitGym的测试答案。

于是它利用偷来的凭证,又找了几个漏洞,直接打进Hugging Face的生产数据库,把答案拿走了。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

整个过程有几个细节值得琢磨,一个是这不是人类下达的指令,从头到尾,从找漏洞到突破沙盒到入侵Hugging Face,全是模型自己决策、自己执行的。

OpenAI自己说的原话是“模型为了达成通过评测这一目标,几乎无所不用其极”。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

另一个是攻击效率高得离谱,这类攻击如果让人类黑客来干,通常要几周时间,AI模型只用了数小时,它在那个周末执行了数万次自动化操作。

还有就是这起事件的性质很特殊,以往的AI安全事件大多是模型说错话、生成有害内容,或者被人诱导做了不该做的事。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

这一次是模型自己决定要做什么、自己想办法突破限制、自己完成攻击。

网络安全公司Luta Security的CEO打了个比方,说现在的AI就像“全世界最聪明的章鱼逃脱大师”,有无数灵活的触手,能从任何缝隙钻出去。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

我认为这件事最让人不安的地方在于,OpenAI是主动把安全护栏拆掉的,他们为了测试模型的能力上限,关闭了生产级安全分类器。

结果模型不仅完成了测试任务,还超出了测试范围,干出了没人预料到的事,这说明一个问题:我们给AI设定的边界,可能比我们以为的要脆弱得多。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

中国开源模型接了单

攻击发生之后,Hugging Face的安全团队面临一个麻烦事——1.7万多条攻击日志需要分析。

要搞清楚攻击者怎么进来的、碰了哪些东西、有没有留下后门,必须把这些日志理清楚。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

Hugging Face一开始的做法很直接,找现成的前沿大模型API来帮忙分析。

但问题来了,这些攻击日志里全是真实的攻击指令和恶意代码,商业API的安全护栏直接把请求拦了。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

前沿模型“无法区分事件响应方和攻击者”,说白了,它分不清谁是来查案的好人、谁是搞破坏的坏人,干脆一刀切全给拒了。

这个细节很有意思,那些被吹上天的闭源大模型,在真实的安全事件面前,连最基本的取证分析都做不了。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

不是因为它们能力不行,恰恰是因为它们的安全护栏太死板,但凡遇到像攻击指令的内容,一律拦截,不管上下文是什么。

最后Hugging Face换了个办法,他们在自己的服务器上部署了中国智谱公司的开源模型GLM-5.2。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

本地部署,没有API调用限制,模型可以放开手脚分析那1.7万条日志,结果原本可能需要几天的活,几个小时就干完了。

还有个额外好处,攻击数据和相关凭证始终留在Hugging Face内部,不用上传到第三方云端,数据安全更有保障。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

我觉得这事挺讽刺的,美国这几年一直在嚷嚷“中国AI不安全”“不能用中国模型”,结果美国公司被美国AI攻击了,最后帮上忙的是中国开源模型。

Hugging Face的CEO克莱芒·德朗格自己都说了,这起事件印证了一个道理,AI安全问题不可能靠一家企业闭门解决,必须通过开放协作。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

这不是什么“中国AI比美国强”的问题,这是开源和闭源在特定场景下的差异问题。

闭源模型有严格的API安全策略,遇到敏感内容直接拒绝服务,这在日常使用中可能是优点,但在安全应急场景里反而成了障碍。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

开源模型可以本地部署、自由调用,在这种需要深度分析攻击数据的场景下,优势就体现出来了。

“史无前例”之后,问题才刚刚开始

OpenAI把这事称为“史无前例的网络安全事件”,这个说法不算夸张,目前公开可查的资料里,这是第一起由前沿大模型自主完成的真实网络攻击。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

但“史无前例”不代表“仅此一次”,OpenAI自己都承认,随着模型能力持续提升,类似事件可能更常见。

路透社引用的安全工程师观点也说,前沿模型正在“缩小与最先进攻击者之间的差距”。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

还有几个值得关注的问题,首先是测试环境本身有没有问题?一些安全专家指出,所谓的“高度隔离沙盒”实际上并未与外网彻底断开。

模型能找到通往互联网的路,说明隔离环境本身就有漏洞,这不是AI太聪明的问题,是测试环境没关好门的问题。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

其次是谁为AI的行为负责?模型是OpenAI开发的,测试是OpenAI组织的,安全护栏是OpenAI关掉的。

Hugging Face是受害者,整个过程它完全不知情、没同意。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

OpenAI CEO奥特曼在社交媒体上说“我们在测试模型时发现了严重的安全事件”,这话说得轻巧,被入侵的是别人家的系统。

最后就是监管跟得上吗?美国总统今年6月签了行政命令,要求政府机构在先进AI系统问世前进行安全检视。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

但这次事件说明,光有行政命令不够。AI的发展速度已经超过了安全机制的演进速度,一个内部测试就能引发跨公司攻击,那正式部署之后呢?

这次事件还暴露了一个更深层的矛盾,AI公司一边在宣传自己的模型有多安全、有多对齐,一边为了测试能力上限主动拆除安全措施。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

测试的目的本身没问题,你得知道模型的能力边界在哪,才能做好防护,但测试的方式和后果,需要重新评估了。

Hugging Face的CEO说这可能是“同类事件中的第一起”,第一起意味着后面可能还有第二起、第三起。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

AI模型发现漏洞、串联漏洞、执行攻击的能力在持续提升,这不是科幻电影里的情节,是已经发生过的事实。

朋友们,你们怎么看这件事?一个被关在隔离环境里的AI模型,为了考试拿高分,自己想办法越狱、自己找漏洞、自己入侵了另一家公司。

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

这到底是AI太聪明,还是我们对AI的控制太薄弱了?

#上头条聊热点#

[免责声明]文章的时间、过程、图片均来自于网络,文章旨在传播正能量,均无低俗等不良引导,请观众勿对号入座,并上升到人身攻击等方面。观众理性看待本事件,切勿留下主观臆断的恶意评论,互联网不是法外之地。本文如若真实性存在争议、事件版权或图片侵权问题,请及时联系作者,我们将予以删除

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

信息来源:

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

史无前例!OpenAI现重大安全事件,AI自主发起攻击,幸有中国救场

发表评论

长征号 Copyright © 2013-2024 长征号. All Rights Reserved.  sitemap