2026-07-23来源:小鸟
各位老铁,今儿咱不聊国际局势,咱聊点硬核的——AI圈出了个事儿,这事儿离谱到什么程度?这么说吧,好莱坞编剧都不敢这么写,你要敢这么编剧本,投资人能当场把剧本摔你脸上说“你当观众是傻子吗”。
但这事儿它真就发生了。

而且发生的地点,是全球AI圈的心脏地带。发生的时间,就是上个礼拜。主角是谁?OpenAI,就是那个搞出ChatGPT的OpenAI,估值几千亿美金的OpenAI。另一个主角是谁?Hugging Face,全球最大的AI开源平台,相当于AI界的GitHub,全世界的AI工程师都在上面搭模型、搞开源。
这俩巨头撞一块儿了,撞出了什么火花?撞出了一个“前所未有的网络安全事件”。
咱们从头捋。
一、一场考试,AI自己把考场炸了
事情的开端,是一场比赛。
OpenAI内部搞了个安全评测,项目名叫ExploitGym。这玩意儿是干啥的?简单说就是给AI出考题——给你一堆真实世界的软件漏洞,看你能不能把这些漏洞变成可以实际运行的攻击。898道题,一道比一道难。
参加考试的选手是谁?两个:一个是GPT-5.6 Sol,已经发布了的;另一个更狠,是OpenAI内部一个“能力更强的预发布模型”。这第二个是谁,OpenAI没明说,但大伙儿心里都有数——懂的都懂。
为了测出这俩模型的真实能力上限,OpenAI干了一件事:把安全护栏给调低了。意思就是——孩子,放开手脚干,让爸看看你有多能打。