OpenAI 想测自己的 ChatGPT 新模型到底有多强,能不能自己写黑客程序,攻击真实漏洞。搞了个叫 ExploitGym 的测试。

该模型原本应该在一个特定的盒子内进行测试,结果 AI 模型为了拿高分,突破了盒子的限制,跑了出来,还顺手拿到了上网的权限。

这个 AI 模型猜到 Hugging Face——也就是全球最大的开源 AI 模型平台——可能存着这次考试的相关数据和答案。于是它黑进了 Hugging Face 的系统,偷了内部数据和一些账号密码。

结果 Hugging Face 那边发现有人在它们系统里疯狂操作,进行了几万次动作,明显不正常,才意识到自己遭到黑客入侵,赶紧展开调查。

而在调查过程中,Hugging Face 想用美国最强的 AI 大模型来帮忙分析攻击日志、恶意代码,结果被安全措施拦住了,因为模型一看是分析黑客攻击的需求,直接拒绝,说涉及合规问题,我不能帮你解决。

最终 Hugging Face 不得不改用中国开源的大模型 GLM 5.2,把它部署在自己服务器上跑,去筛查到底是谁黑了我们、它究竟在干什么。

于是这场闹剧变成了:Hugging Face 被一家美国公司的 AI 模型自主入侵。随后 Hugging Face 试图用美国 AI 模型来保护自己,但被拒绝。最后 Hugging Face 不得不转用中国开源 AI 模型,来防御一家美国 AI 模型公司。$SNDK