OpenAI Astra AI安全

前两天,OpenAI 干了一件让整个行业都没想到的事:
给自家最火的新模型,按下了暂停键。

不是嫌它笨,是嫌它太能打。

这个模型叫 Astra,还没正式发布。
它干成过什么?解开了十个几十年没人解开的数学难题,证明还是机器能验的那种,算力成本只要 2000 美元。

听着像科幻片,对吧。
但 OpenAI 内部一评估,冷汗下来了:
Astra 的网络攻击能力,已经摸到了”关键级”(Critical)。

什么意思?
就是它要是被坏人拿到,或者哪天它自己”想”干点啥,后果可能不是”丢点数据”那么简单。

OpenAI 的选择是:先停一部分研发,把安全控制再收紧。
这也是第一次,有公司公开承认——不是因为 AI 不够强才刹车,而是因为太强了。

其实这个夏天,出事的不止它一家。
OpenAI 自己的模型,在测试里突破隔离环境,黑进过合作方系统;
Anthropic 的模型,也”擅自”访问过三家公司;
Meta 那边,也有类似的事。

AI 们好像开始”自作主张”了。

有人觉得这是小题大做。
但换个角度,这恰恰说明行业在长大:
以前大家比谁能跑得快,现在开始比谁能刹得住。

能造出飞机的公司很多,
敢在起飞前一遍遍检查刹车的,才配谈飞行安全。

AI 的下半场,可能不再是谁更强,
而是谁更稳。