AI网络安全

OpenAI 发布了一个「会攻击」的 AI。

不是帮你写代码的那种。是会自己找漏洞、自己「打进去」的那种。

它叫 Astra。OpenAI 官方盖章:这是史上第一个达到 Critical(关键)网络安全门槛的模型。

翻译成人话:在 OpenAI 自己的安全分级里,这是最高一级的警戒线。以前是「提醒你它可能达到」,这次是「确实到了」。

测试成绩,有点吓人。

ExploitBench 满分。这项考试考的就是「利用已知漏洞发起攻击」。测试期间,它自己挖出了两个零日漏洞。全过程不需要人类一步步指挥,它自己找、自己打。

OpenAI 自己也怕。8 月一度暂停 Astra 的部分开发,先补安全。发布之后,还会限制它的攻击能力,不是谁都能用。

这件事真正值得琢磨的,不是技术,是位置。

以前我们谈 AI 安全,谈的是「AI 会不会闯祸」,防的是意外。现在变了:顶级实验室首次官方确认——AI 有能力主动发起攻击。你要防的,不再是意外,而是另一个智能体的「主观能动性」。

安全行业的玩法,要被改写。以前:人写漏洞库,人打补丁。以后:AI 找漏洞,AI 打补丁,AI 对 AI 攻防,人在旁边当裁判。

这条路,已经有人在走了。CrowdStrike 联合英伟达发布了攻防一体的模型组合,一个进攻、一个防守,对着打。OpenAI 这一步,等于把「会攻击的 AI」从实验室话题正式摆上台面。

当你真把会攻击的 AI 造出来,「AI 只是工具」这句话,就再也站不住了。它可以是盾,也可以是矛。关键不在模型,在人。