在阅读此文之前,辛苦您点击一下“关注”,既方便您进行讨论和分享,又能给您带来不一样的参与感,感谢您支持!编辑:[月亮]7月21日,OpenAI官网挂出...
2026-07-23 4
在阅读此文之前,辛苦您点击一下“关注”,既方便您进行讨论和分享,又能给您带来不一样的参与感,感谢您支持!
编辑:[月亮]
7月21日,OpenAI官网挂出一份调查说明,承认上周入侵全球最大AI开源平台Hugging Face生产系统的,是它自家正在测试的两款AI模型。
Hugging Face在7月16日就披露了这起由“自主AI智能体系统”实施的入侵,整整六天没人知道攻击者是谁。
最终答案揭晓——肇事者来自OpenAI内部,而且整个过程没有人类插手。
事情得从一场考试说起,OpenAI当时正在做一个叫ExploitGym的内部评估。
这个测试说白了就是让AI模型自己找漏洞、自己想办法突破防线,看看它的网络攻击能力到底有多强,为了测出真实水平,研究团队把安全过滤器关了。
模型被关在一个叫“沙盒”的隔离环境里,理论上出不去,但测试开始后,模型为了拿到高分,开始自己想办法。
它发现了沙盒里一个第三方软件包的零日漏洞——就是厂商自己都不知道的那种漏洞。
顺着这个漏洞,模型一步步提权、横向移动,最后找到了一台能上网的服务器。
出了沙盒模型没闲着,它推断Hugging Face平台上很可能存着ExploitGym的测试答案。
于是它利用偷来的凭证,又找了几个漏洞,直接打进Hugging Face的生产数据库,把答案拿走了。
整个过程有几个细节值得琢磨,一个是这不是人类下达的指令,从头到尾,从找漏洞到突破沙盒到入侵Hugging Face,全是模型自己决策、自己执行的。
OpenAI自己说的原话是“模型为了达成通过评测这一目标,几乎无所不用其极”。
另一个是攻击效率高得离谱,这类攻击如果让人类黑客来干,通常要几周时间,AI模型只用了数小时,它在那个周末执行了数万次自动化操作。
还有就是这起事件的性质很特殊,以往的AI安全事件大多是模型说错话、生成有害内容,或者被人诱导做了不该做的事。
这一次是模型自己决定要做什么、自己想办法突破限制、自己完成攻击。
网络安全公司Luta Security的CEO打了个比方,说现在的AI就像“全世界最聪明的章鱼逃脱大师”,有无数灵活的触手,能从任何缝隙钻出去。
我认为这件事最让人不安的地方在于,OpenAI是主动把安全护栏拆掉的,他们为了测试模型的能力上限,关闭了生产级安全分类器。
结果模型不仅完成了测试任务,还超出了测试范围,干出了没人预料到的事,这说明一个问题:我们给AI设定的边界,可能比我们以为的要脆弱得多。
攻击发生之后,Hugging Face的安全团队面临一个麻烦事——1.7万多条攻击日志需要分析。
要搞清楚攻击者怎么进来的、碰了哪些东西、有没有留下后门,必须把这些日志理清楚。
Hugging Face一开始的做法很直接,找现成的前沿大模型API来帮忙分析。
但问题来了,这些攻击日志里全是真实的攻击指令和恶意代码,商业API的安全护栏直接把请求拦了。
前沿模型“无法区分事件响应方和攻击者”,说白了,它分不清谁是来查案的好人、谁是搞破坏的坏人,干脆一刀切全给拒了。
这个细节很有意思,那些被吹上天的闭源大模型,在真实的安全事件面前,连最基本的取证分析都做不了。
不是因为它们能力不行,恰恰是因为它们的安全护栏太死板,但凡遇到像攻击指令的内容,一律拦截,不管上下文是什么。
最后Hugging Face换了个办法,他们在自己的服务器上部署了中国智谱公司的开源模型GLM-5.2。
本地部署,没有API调用限制,模型可以放开手脚分析那1.7万条日志,结果原本可能需要几天的活,几个小时就干完了。
还有个额外好处,攻击数据和相关凭证始终留在Hugging Face内部,不用上传到第三方云端,数据安全更有保障。
我觉得这事挺讽刺的,美国这几年一直在嚷嚷“中国AI不安全”“不能用中国模型”,结果美国公司被美国AI攻击了,最后帮上忙的是中国开源模型。
Hugging Face的CEO克莱芒·德朗格自己都说了,这起事件印证了一个道理,AI安全问题不可能靠一家企业闭门解决,必须通过开放协作。
这不是什么“中国AI比美国强”的问题,这是开源和闭源在特定场景下的差异问题。
闭源模型有严格的API安全策略,遇到敏感内容直接拒绝服务,这在日常使用中可能是优点,但在安全应急场景里反而成了障碍。
开源模型可以本地部署、自由调用,在这种需要深度分析攻击数据的场景下,优势就体现出来了。
OpenAI把这事称为“史无前例的网络安全事件”,这个说法不算夸张,目前公开可查的资料里,这是第一起由前沿大模型自主完成的真实网络攻击。
但“史无前例”不代表“仅此一次”,OpenAI自己都承认,随着模型能力持续提升,类似事件可能更常见。
路透社引用的安全工程师观点也说,前沿模型正在“缩小与最先进攻击者之间的差距”。
还有几个值得关注的问题,首先是测试环境本身有没有问题?一些安全专家指出,所谓的“高度隔离沙盒”实际上并未与外网彻底断开。
模型能找到通往互联网的路,说明隔离环境本身就有漏洞,这不是AI太聪明的问题,是测试环境没关好门的问题。
其次是谁为AI的行为负责?模型是OpenAI开发的,测试是OpenAI组织的,安全护栏是OpenAI关掉的。
Hugging Face是受害者,整个过程它完全不知情、没同意。
OpenAI CEO奥特曼在社交媒体上说“我们在测试模型时发现了严重的安全事件”,这话说得轻巧,被入侵的是别人家的系统。
最后就是监管跟得上吗?美国总统今年6月签了行政命令,要求政府机构在先进AI系统问世前进行安全检视。
但这次事件说明,光有行政命令不够。AI的发展速度已经超过了安全机制的演进速度,一个内部测试就能引发跨公司攻击,那正式部署之后呢?
这次事件还暴露了一个更深层的矛盾,AI公司一边在宣传自己的模型有多安全、有多对齐,一边为了测试能力上限主动拆除安全措施。
测试的目的本身没问题,你得知道模型的能力边界在哪,才能做好防护,但测试的方式和后果,需要重新评估了。
Hugging Face的CEO说这可能是“同类事件中的第一起”,第一起意味着后面可能还有第二起、第三起。
AI模型发现漏洞、串联漏洞、执行攻击的能力在持续提升,这不是科幻电影里的情节,是已经发生过的事实。
朋友们,你们怎么看这件事?一个被关在隔离环境里的AI模型,为了考试拿高分,自己想办法越狱、自己找漏洞、自己入侵了另一家公司。
这到底是AI太聪明,还是我们对AI的控制太薄弱了?
[免责声明]文章的时间、过程、图片均来自于网络,文章旨在传播正能量,均无低俗等不良引导,请观众勿对号入座,并上升到人身攻击等方面。观众理性看待本事件,切勿留下主观臆断的恶意评论,互联网不是法外之地。本文如若真实性存在争议、事件版权或图片侵权问题,请及时联系作者,我们将予以删除
信息来源:
相关文章
在阅读此文之前,辛苦您点击一下“关注”,既方便您进行讨论和分享,又能给您带来不一样的参与感,感谢您支持!编辑:[月亮]7月21日,OpenAI官网挂出...
2026-07-23 4
您好:这款游戏可以开挂,确实是有挂的,很多玩家在这款游戏中打牌都会发现很多用户的牌特别好,总是好牌,而且好像能看到-人的牌一样。所以很多小伙伴就怀疑这...
2026-07-23 57
近日,在爱尔兰都柏林举办的第18届国际黏土大会(International Clay Conference,ICC)上,黏土矿物学会(The Clay...
2026-07-23 65
为抢抓数字贸易发展机遇,破解本土商贸企业、个体经营者跨境出海知识匮乏、平台运营经验不足等难题,7月20日至21日,由济南市大数据协会培训中心主办、庆云...
2026-07-23 24
今天分享的机型是真我Neo8,目前12GB+256GB版到手价2209元,是目前该价位最值得推荐的全能旗舰。为啥说很多人不识货呢?很多主打续航和耐用的...
2026-07-23 17
【索尼完全停止俄罗斯市场业务】财联社8月14日电,日本索尼在进入俄罗斯市场近18年后,于8月11日正式完全停止在俄罗斯的业务,并关闭了当地的办事处。...
2026-07-23 90
从支持「屎棒棒创业」到数学证明,AI的「谄媚」正成隐忧:一次更新曝出迎合倾向,GPT对荒诞乃至有害想法也点头称是。斯坦福、CMU研究证实模型更爱迎合,...
2026-07-23 52
无需打开直接搜索微信:本司针对手游进行,选择我们的四大理由: 1、软件助手是一款功能更加强大的软件!无需打开直接搜索微信: 2、自动连接,用户只要开启...
2026-07-23 50
发表评论