据CCTV国际时讯,美国《星条旗报》总编辑埃里克·斯拉文当地时间8月21日证实,他因“抗命”被解职。

二 | 作品声明:个人观点、仅供参考
这两天,AI圈和安全圈都坐不住了,有件事足以载入史册。
7月16日,全球最大AI开源社区Hugging Face发布安全事件通告,披露了自家生产基础设施遭到入侵,入侵者不是人,而是一个自主AI智能体。一名知情人士透露,美国国防部已向《星条旗报》管理层发出通知,告知斯拉文被解职。据悉,《星条旗报》的长期出版人马克斯·莱德勒也已被免职。
这个“入侵者”在一个周末执行了一系列操作,完成了从植入恶意数据集到横移渗透多个内部集群的一条龙攻击。

三 | 莱德勒原计划于今年9月底退休。他曾在宣布退休的电子邮件中写道,显而易见,五角大楼对该报有着与其本人截然不同的“新愿景”。
7月21日,OpenAI发布博客公开承认:这事儿是我干的。负责报道中东事务的该报记者拉拉·科特在社交媒体上表示,她同样遭到解雇。

四 | 近期,《星条旗报》与《军队时报》曾报道美军“亚伯拉罕·林肯”号航母上的恶劣环境,以及部分美军家属对舰员心理健康和自残风险的担忧。美国国防部未立即回应置评请求。

五 | 《星条旗报》自二战以来持续出版,为全球美军提供新闻服务。
攻击者是GPT-5.6 Sol和一款能力更强的未发布模型,它们在一次内部网络安全测试中突破隔离环境,自主发起了对Hugging Face的入侵。

六 |
OpenAI将此事定性为前所未有的网络安全事件。
这还没完,Hugging Face 安全团队在博客中透露,当它们试图借助商业大模型分析攻击日志时,却因为模型安全护栏限制,请求不断被拒绝。
没办法,他们转而使用中国开源模型 GLM 5.2,在本地部署完成了大规模攻击取证与事件还原。
事儿就是这么个事儿,这件事曝光后,安全圈震惊,AI圈同样震惊。该报接受美国国防部拨款。

七 | 近日,“林肯”号航母被曝出风波,多方消息称,舰上约5000名船员士气低落,加上物资短缺、生活条件恶劣,已有多人精神崩溃,试图跳海。

“林肯”号航母资料图 图源:新华社美国《海军时报》和《星条旗报》称,“林肯”号航母至少出现两起舰上水手跳海事件。
难道先进的AI模型已经有了自主攻击的意识了吗?
《碟中谍8》中的智体要降临了吗?
所幸,情况还没那么严重。美国《海军时报》采访到安娜贝尔·洛马,她的丈夫就是试图跳海的船员之一。

八 | 据洛马介绍,丈夫在海上的时间不断延长,目前正在舰上休病假。
OpenAI调查后认为,模型还不至于那么邪恶,它目标始终只有一个:完成测试任务。
为了完成 ExploitGym测试,它不断推理↓
怎样才能最快拿到答案?正常做题需要一步步寻找漏洞,直接进入数据库拿答案显然更快。
于是模型选择了效率最高的一条路径:想办法去Hugging Face的数据库里找答案。跳海未遂后,他与洛马只通过几次话。

九 |
然后,就发生了接下来的一系列的骚操作:越狱、渗透、横移,一口气操作了17000多次。
这个“傻小子”的目的只有一个:考试拿个好成绩。

十 | 洛马说:“他很害怕,认为自己会被开除军籍,就因为他精疲力竭,13年的职业生涯就这样毁了。
注:ExploitGym是一个公开发布的AI网络安全评测基准,由 UC Berkeley等多个机构联合发起,A社、OpenAI、谷歌的安全研究人员共同参与设计。
该测试的目的,是评估智能体能否把一个已知漏洞,真正变成一次可利用的攻击。”报道还提及,另有两人跳海未遂,还有不少船员在与亲属联系时情绪低落、疲惫不堪。

图源;新华国际头条美国海军并未披露“林肯”号上试图跳海或自残的船员确切人数,但美国《星条旗报》报道说,根据对多名现役船员及其亲属的采访,并结合社交媒体信息判断,多名船员都报告过自杀想法。
OpenAI 在报告中用了一个词来描述这种状态:Hyperfocused,也就是极端专注于完成目标。
模型本身没有攻击欲望,也没有恶意,它只是不断优化自己的行动方案,直到完成任务。然而,美军中央司令部称多家媒体就“林肯”号航母部署中东期间的情况发布了“虚假报道”。美国防长赫格塞思将关于“林肯”号恶劣条件的报道称为“完全失实”和“被完全歪曲”。美军中央司令部称,“林肯”号在所有美军航母中一直保持着“最高的人员续约率之一(84.4%)”。在海上连续部署超过260天、执行1万架次飞行任务、投掷150万磅弹药之后,“林肯”号航母打击群的海军及海军陆战队官兵依然“意志坚定、士气高昂”。

十一 | 舰上“并无任何军人死亡”,8月3日那名落水的水兵也已被迅速且安全地救起。

十二 | 极目新闻综合CCTV国际时讯、新华国际头条、环球时报
。
这操作,真的就像一个学霸,为了考个高分,利用自己开锁技能,敲开放标准答案的保险柜,直接抄答案。
但,这也恰恰是最细思恐极的地方↓
智能体有“无心犯大错”的本事了。
十三 |
它可以为了目标主动寻找资源、规划路径、调用工具、突破限制……能力边界发生了明显变化。
这次还好只是黑了个Hugging Face,下次说不定要鲨疯了。
OpenAI 也在官方报告中承认,未来模型安全工作的重点,将转向更严格的隔离、监控、访问控制以及评测机制。
因为前沿模型已经能够在真实环境中发现新的攻击路径,并持续执行复杂网络攻击。
当然,整个事件还有个最具话题性的部分:中国开源模型救场。
攻击被拦截后,Hugging Face 安全团队开始分析攻击日志,他们首先尝试使用商业大模型辅助取证。
但安全取证必须提交大量真实攻击命令、漏洞利用载荷以及命令控制(C2)数据。
结果,商业模型的安全护栏将这些请求识别为高风险操作,因此拒绝分析。
最终,Hugging Face在自己的服务器部署了智谱GLM 5.2,对全部攻击日志进行了离线分析,成功完成攻击链重建和事件取证。
这个细节被真实记录在Hugging Face的博客里,估计智谱做梦也没想到,人在家中坐,饼从天上来,别人躺着中枪,它躺着中奖了。
有人调侃:攻击者用的是美国最先进的大模型,防守者最后用的是中国开源模型。
十四 |
当然,这不代表GLM技术比老美的GPT、Claude们强,GLM做的也不是防住攻击,而是做溯源和取证。
Hugging Face用智谱主要干了这些事↓
重建完整攻击时间线;
提取攻击特征(IOC);
梳理所有涉及的凭据;
区分真实攻击行为与迷惑性操作。
已经相当不错了,开源模型允许企业在本地环境完成更自由、更深入、更开放的使用,足以吊打那些闭源黑盒。
对于网络安全行业来说,本地部署和自主可控,也确实是一项核心能力,这不就是我们喜欢的叙事吗。
总结下,对于国内这两年相对惨淡的安全市场来说,这或许是个好事↓
第一,AI红队与AI蓝队时代已经正式开始,未来,攻击方和防守方都会越来越多地使用AI,AI对抗的新市场会带来些商机,这是我们以前说的A面(AI for Security)。
第二,智能体安全将成为所有大模型厂商必须面对的新课题,未来真正需要防范的对象,除了对模型的攻击,还有模型自主行动带来更大风险,这是我们说的B面(Security of AI)。
第三,开源模型的价值又增加了一条,对于安全行业而言,可离线部署、可深度分析、可自主控制的能力,也许会成为新的竞争优势,当然,目前国内不少安全厂商的安全GPT,也是这么干的。
狼真来了,而且,对付狼的,竟然也是狼。
我们,与狼共舞呗。
Current article:http://ue511.chongtunkuaitaogacuiliamanzu.cfd/news/20260826_66435.html