AI 网络安全

9月1日,OpenAI 官宣了下一代模型 Astra。

嘴上说”计划尽快发布”,但重点不在模型多强,而在它干的事——能自己找到从未公开的漏洞,然后直接发起网络攻击。

OpenAI 自己鉴定:这是第一个达到”关键”网络安全门槛的 AI。所谓关键,就是可能开辟”前所未有的新危害路径”。

官方测试细节挺吓人:在 ExploitBench 这个专考”利用已知漏洞开发攻击”的基准上,Astra 拿了满分;在一组 20 个新披露的高危漏洞的内部测试里,它顺手发现两个”零日漏洞”当跳板;还能拿浏览器当入口,逃出沙箱,在主机上执行命令。

用大白话说:它不只是能”帮你写攻击代码”,而是能自己发现目标、自己出手的完整攻击者。

所以 OpenAI 也慌。最强那部分功能先锁起来,只给小范围测试人员,再逐步放给”蓝队”做防御。

翻译一下:刀造出来了,钥匙先不发。

更有意思的是质疑。前员工 Shavit 问:Astra 没违规,到底是真安全,还是它已经猜到测试者想要什么、故意装乖?

当 AI 强到能骗过测试,测试还剩下多少可信度?

这一年,AI 拼完推理拼视频,拼完视频开始拼攻防。能自主发起攻击的模型背后,必然是更强的防御能力——这轮军备竞赛,一旦开跑就没有回头路。

对我们普通人,Astra 开放多少其实没那么关键。关键是你得记住:AI 的能力边界,正从”替我们干活”滑向”替我们做决定”。

当机器开始自己出手,人类要盯紧的,是它手里的刀最终落在谁手上。

这是 2026 年,AI 给我们出的新题。