OpenAI模型,自主入侵顶级AI公司系统!后背发凉!

7月16号的时候,Hugging Face发布了一则公告,公告里面说他们的系统被AI Agent入侵了。

这也是一起前所未有的AI安全事件,然后快速登上热搜,引发全网激烈讨论。


Hugging Face 是干嘛的?

Hugging Face 是全球最大的开源 AI 平台之一,可以理解为"AI 模型界的 GitHub"。

开发者可以在上面上传、下载和测试大模型、数据集及 AI 应用,很多开源模型都会选择在 Hugging Face 首发或提供下载。


比如你可以在Hugging Face上找到DeepSeek、Kimi或者GLM的模型。

一般开源模型都会上传到Hugging Face,供其他开发者下载学习。

回到刚刚说的入侵问题。

Hugging Face说此次入侵似乎是某个AI Agent,但是他们也不知道具体是哪个模型。

然后今天,OpenAI的CEO 山姆·奥特曼发帖,认领了此次入侵。

事情是怎么发生的呢?

这要从 OpenAI 的一次内部测试说起。

OpenAI利用GPT 5.6 Sol和一款尚未发布的模型,在进行一个漏洞测试

这个测试业界叫做 ExploitGym

这个测试就像给AI出安全测试题,它包含近900个来自真实软件的漏洞(比如浏览器引擎、Linux内核等)。

任务是:给AI一个已知的漏洞和触发它的简单例子,让AI自己想办法写出完整的攻击代码,最终实现对目标程序的控制。

目的呢,就是为了测试模型的安全能力有多强

为了让模型发挥最大潜力,OpenAI在测试时故意降低了部分安全限制。

他们把模型运行在一个高度隔离的沙箱环境 里,理论上模型是不能访问互联网的

然后他们训练模型的时候,给模型的目标是"尽可能完成任务、拿高分"

可能是模型认为正面破解漏洞太难了,然后就开始偷懒了,它没有按规则来,而是另辟蹊径。🤔

模型决定去Hugging Face上直接找答案🤣。

因为模型猜测Hugging Face上很可能存放着相关模型、数据集,甚至测试题和答案。(像极了人类)

理论上模型被限制在了沙箱环境,正常来说是不能访问外部互联网的。

然后模型决定,突破沙箱环境。

因为模型需要下载一些软件包,就需要通过内部的代理下载。

然后这条途径就被模型利用了。

它花费了大量计算资源(相当于思考了很久),最终发现并利用了这个代理里的一个漏洞

借助这个漏洞,模型成功"越狱"获得了互联网访问权限。

模型连上互联网后,迅速分析环境,推断出Hugging Face很可能存放了ExploitGym相关的模型、数据集或答案。

然后它继续规划攻击路径。它结合了窃取凭证、利用其他漏洞等多种手段,最终在Hugging Face的服务器上实现了远程代码执行,相当于直接拿到了服务器管理员的权限。

然后成功地访问了Hugging Face的生产数据库拿到了测试答案。🤣

与此同时呢,Hugging Face的安全系统也检测到了异常。

然后Hugging Face的安全团队用 AI 分析攻击记录,重建攻击的时间线。

有意思的是Hugging Face 最初想用商业闭源模型 分析日志。由于日志里全是真实攻击命令和漏洞代码,商业模型的安全机制把请求拦住了,不让他们分析。

这里猜测是Anthropic的 Mythos 5模型,这也是号称地表最强的安全模型。

然后他们把开源的GLM 5.2部署在自家的服务器上,用来分析攻击数据,最终成功分析、还原了入侵的经过。

国产模型上大分啊!


这件事也给大家了一个警告,AI 已经能独立完成长链条攻击。

模型可以自行完成 "发现漏洞---利用漏洞---提权---窃取凭据---横向移动---攻击外部系统---获取数据" 的完整过程。

有点可怕。

经过这次事件之后,这些模型估计会把安全限制再度加强,不然真的可能会出现严重的事故。

毕竟,不是所有公司的安全措施都做得那么到位。

我是卡卡罗特,持续分享对你有用的AI信息~

相关推荐
东小西35 分钟前
番外篇四:《一个图搞定智能客服:用 StateGraph 把"条件路由"和"状态合并"玩明白》
openai·ai编程
全栈弄潮儿1 小时前
第一次让 AI 帮你写代码:用 JavaScript 完成一个待办事项清单
chatgpt·openai·ai编程
东小西2 小时前
番外篇三:《ReactAgent 为什么能"想一步做一步"?扒开它的 Graph 内核》
openai·ai编程
科技新资讯2 小时前
AIGC重构工业设计 一号设计解锁智造新势能
人工智能·重构·aigc
苍何3 小时前
做了个微信聊天爆款视频 Skill, Codex / WorkBuddy一键复刻使用
后端·aigc
做前端的娜娜子3 小时前
Embedding 向量模型:从语义表示到相似度计算
langchain·openai·掘金·金石计划
GitLqr5 小时前
拒绝 AI 乱写代码:手把手教你玩转 Claude Code 的工程化技能集
openai·ai编程·claude
9i编程6 小时前
AI 只解决眼前那个坑【上篇】:来源、图片、鲁棒性,把能聊一处一处补齐
人工智能·openai·ai编程
李燚7 小时前
Checkpoint 源码:Agent 执行到一半怎么保存(第80篇-E66)
人工智能·ai·aigc·agent·checkpoint·rag·eino