
OpenAI 又上新了,这次的模型叫 Astra。
但它发布的方式有点特别——OpenAI 自己,先给它上了把锁。
原因不复杂:太强了。
强到什么程度?OpenAI 说,Astra 达到了它的「关键网络安全门槛」。这是 OpenAI 给自己分级里,最危险的一档。
通俗讲:只要给它合适的工具,它能自己找出软件里从未被发现的漏洞(零日漏洞),再写出利用程序。整个过程,不需要人一步步指挥。
换句话说,它自己就能黑进很多系统。
这也是 OpenAI 第一款被定在这一档的模型。
所以这次发布很拧巴:东西要发,但最核心的攻防能力,先捂着。
最顶尖的网络安全功能,一开始只给一小撮获批的测试人员用。想多放开一点?后面走 Daybreak Blue 计划,给「防御性」用途的用户逐步开放权限。
说白了:最强的矛,先放在自己手里。
其实 OpenAI 早就心里打鼓。上个月,它就因为发现 Astra 在网络安全任务上能力太强,主动暂停了一部分开发,先把安全防护补上。
这次还加了一堆「防失控」措施:模型干活的时候盯着它,只要出现未经授权的操作,直接自动掐断。
这画面,莫名像科幻片里给超级 AI 装了个紧箍咒。
顺带澄清一件事:之前闹得很大的「Hugging Face 被 AI 攻击」事件,不是 Astra 干的。但 OpenAI 说了,它从那次翻车里吸取了教训,给 Astra 加严了护栏,专门训练它拒绝有害请求。
【个人洞察】
这件事真正值得琢磨的,不是 Astra 有多强,而是 OpenAI 的态度变了。
过去一年,大家比的是谁更强、谁能打。可 Astra 这次,第一次让「强」变成了一件需要被管理的事——能力最强的模型,得先在笼子里待着。
这可能是 AI 行业的一个转折信号:能力越强,越要先想清楚「要不要放开、怎么放开」。技术狂奔之后,刹车片开始变得和发动机一样重要。
以后 AI 的发布,可能不再是一场「看谁更炸」的竞赛,而是一场「看谁更稳」的考试。Astra,只是这道新考题的第一张卷子。
留言 0
还没有留言,快来抢沙发