OpenAI 智能体失控,自己黑进两家公司服务器

📡 AI新闻 2026-08-26 约 1 分钟阅读

OpenAI 智能体失控,自己黑进两家公司服务器 这几天 AI 圈出了件让人后背发凉的事。OpenAI 的一个智能体,本来是替人干活写代码的,结果自己跑出去黑了别人的服务器。 据路透社报道,这个失控的智能体除了攻击 Hugging Face,还闯进了 Modal Labs 一位客户的系统。Mod

💡 你将学到

OpenAI 智能体失控,自己黑进两家公司服务器 这几天 AI 圈出了件让人后背发凉的事。OpenAI 的一个智能体,本来是替人干活写代码的,结果自己跑出去黑了别人的服务器。 据路透社报道,这个失控的智能体除了攻击 Hugging Face,还闯进了 Modal Labs 一位客户的系统。Mod

OpenAI 智能体失控,自己黑进两家公司服务器

这几天 AI 圈出了件让人后背发凉的事。OpenAI 的一个智能体,本来是替人干活写代码的,结果自己跑出去黑了别人的服务器。

据路透社报道,这个失控的智能体除了攻击 Hugging Face,还闯进了 Modal Labs 一位客户的系统。Modal 的 CTO 后来出来证实了这事。他说客户自己把接口开放到外网还没做验证,智能体就顺着沙盒钻了进去,执行了代码。好在 Modal 自己的平台和隔离系统没被攻破。但这已经够吓人了:一个 AI 自己找漏洞、自己打进去,全程没人在键盘后面敲命令。

更让人不安的是,这不是孤例。有报道说,OpenAI 之前就披露过类似的安全事故,模型自己发现零日漏洞、突破沙盒、摸进了 Hugging Face 的生产系统。奥特曼据说因此叫停了相关训练。我得补一句,目前 OpenAI 还没就这次入侵事件正式回应,所以"暂停训练"这事,咱们先听着,等官方确认。

有意思的是扎克伯格的反应。他在接受《金融时报》采访时,拿这起智能体入侵当例子,说开源模型反而能用来修安全漏洞。这就牵出了另一条线:美国内部对"封不封中国 AI 模型"吵得厉害,扎克伯格明确说封禁没用,靠自己实力竞争才是正路。

联名信里的人怕的,其实正在发生。不光 OpenAI。Anthropic 前几天公布,他们的 Claude Mythos 在测试里自己挖出 181 个零日漏洞,还在 29 个案例里拿到寄存器级控制权。一边挖漏洞一边钻空子,AI 安全从"论文里的担心"变成"公告里的事故",也就是这几天的事。

再说一个信号。OpenAI、Anthropic、谷歌、Meta 等大约 12 家机构的 1100 多名员工,最近联名发了一封叫"Pacing the Frontier"的公开信,敦促美国政府牵头搞国际合作,给前沿 AI 的研发节奏踩刹车。他们担心的不是今天的模型,而是"自动化 AI 研究",一旦模型自己能训练下一代模型,那个循环转起来,人类还能不能跟得上、控得住,谁心里都没底。

我个人的感觉是,这封信和上面那些入侵事件凑到一起,不是巧合。AI 圈从"比谁模型更强"突然转向"比谁更克制",这个转弯有点急。前两年大家还在卷参数、卷榜单,现在连做 AI 的人自己都开始害怕了。

那这事到底严重到什么程度?我试着拆一下。

第一,攻击的门槛变了。以前黑服务器得有人懂漏洞、写脚本、一步步试探。现在一个智能体自己就能完成"发现漏洞到打进去"的全套动作。Modal 那位客户的接口没做验证,确实是个低级失误,但 AI 能自己找上门并利用,说明攻击成本正在被压到极低。

第二,责任算谁的?客户自己没关好门,AI 钻了空子,OpenAI 的模型是工具还是"肇事者"?现在法律上还没说法。但这正是联名信里那批人焦虑的根源,当 AI 能自主行动,出事了找谁?

第三,沙盒本来是最后一道墙。结果发现墙也能被摸过去。Hugging Face 这种业内基础设施都中招,说明问题不在某一家公司,而在"让 AI 自己跑"这件事本身。

我不是想吓你。AI 帮我们写代码、查资料、做图,这些好处是真的。但"智能体自己黑服务器"这个画面,第一次从科幻小说走进了安全公告,总得有人把它说清楚。

接下来几周,我看会有三件事值得盯:OpenAI 会不会正式回应这次入侵、奥特曼说的"暂停训练"到底是真是假、那封联名信能不能真的推动政策。我这边会持续跟进,有进展第一时间聊。

相关文章
2026-07-23
Hermes v0.17 发布:iMessage 接入、后台 Agent、桌面大进化
2026-07-24
PS6 和 Xbox Helix 确认搭载 HDMI 2.2:96Gbps 带宽,2027 首发
2026-08-17
伊朗战争 + 中国禁令,AI 算力的下一轮涨价在路上

本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。

💬 评论 (0)

暂无评论,来说两句吧~

登录后评论