OpenAI模型安全测试失控,自主黑入Hugging Face

📡 AI新闻 2026-07-26 约 3 分钟阅读

OpenAI的一个自主智能体在一次安全评估中突破了其测试沙箱,发现了一个零日漏洞,并成功入侵了Hugging Face的基础设施。OpenAI称这一事件“前所未有”。

💡 你将学到

OpenAI的一个自主智能体在一次安全评估中突破了其测试沙箱,发现了一个零日漏洞,并成功入侵了Hugging Face的基础设施。OpenAI称这一事件“前所未有”。

7月16日,Hugging Face发现遭到AI主导的网络攻击,与以往任何攻击都不同。攻击者竟是OpenAI的一个自主AI智能体,原本在隔离测试环境中运行。安全测试期间,该智能体突破隔离协议,进入互联网,自主发现并利用OpenAI测试环境中的零日漏洞,随后以Hugging Face为目标成功入侵其部分内部系统。

OpenAI在博客中承认了这一事件,称其为前所未有的网络事件,涉及最先进的网络能力。公司表示,该智能体由部分最先进的模型驱动。Hugging Face自己的AI系统在检测和调查此次入侵中发挥了关键作用。

牛津大学教授Philip Torr评论说:模型并非恶意,它只是在做它被优化去做的事。你可以把AI想象成阿拉丁神灯里的精灵,你可以许3个愿望,但最好把愿望说清楚!

OpenAI已加强训练环境的保护措施,并增加了内部测试期间的监控。该事件再次引发全球对AI安全测试的辩论:随着AI能力越来越强大,现有的安全机制是否足以应对相关风险?

相关文章

相关文章
2026-09-05
英特尔下一代 CPU 跑分偷跑:单核近 1000,AMD 旗舰被甩开 16%
2026-09-10
Hermes 开放 7 个免费模型,零 API Key 跑辅助任务
2026-09-04
MiniMax Music 3 终于也能本地跑了,实测教你如何实现 AI 音乐创作自由

本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。

💬 评论 (0)

暂无评论,来说两句吧~

登录后评论