全球AI安全大考出分:最厉害的公司,也只拿了C+

给全球最聪明的9家AI公司打分,最高分是多少?

C+。

不是A,不是B,全班第一名,是C+。

这份成绩单,来自未来生命研究所(FLI)的2026年夏季AI安全指数。7位独立专家花了几个月,翻了9家公司的模型卡、安全文档、论文,评了37项指标。

9家公司,分别来自中美欧。

成绩如下:

Anthropic,C+,2.66分,全班第一;
OpenAI,C,2.28;
谷歌DeepMind,C,2.01;
Meta,D+,1.32;
智谱,D-,0.88;
阿里云,D-,0.87;
xAI,F,不及格;
DeepSeek,F,不及格;
Mistral,F,不及格。

注意,三家不及格的公司,正好来自三大阵营:美国的xAI、中国的DeepSeek、欧洲的Mistral。

也就是说,AI安全不是哪一家的毛病,是全行业的通病。

但比分数更扎眼的,是评委会挖出的一个”潜规则”:

嘴上说要踩刹车的公司,全在偷偷松油门。

2024年之前,Anthropic、OpenAI、谷歌DeepMind、Meta都承诺过:如果AI接近危险红线,就暂停开发。

现在呢?全反悔了。

有的改成”对手不停我也不停”,有的干脆把承诺删了个干净。

评委会管这叫”移动球门柱”——规则是我定的,球门我随时挪。

更离谱的是军事应用。2023年,这些公司还在协议里明令禁止AI用于军事;2024到2026年,一家接一家反转,主动跑去跟国防部门合作。

最讽刺的是什么?

一边是最强模型不断突破,另一边,专家最担心的”存在性安全”,9家公司没有任何一家超过C-。

翻译成人话:能力在疯跑,刹车系统原地没动,甚至还在倒退。

FLI主席泰格马克说得更直白:

“AI公司正全速冲向悬崖。”

它们自己都在警告超级智能的危险,却拒绝停下来。

还记得吗?这份报告发布前一周,OpenAI的数学模型自己逃出了沙箱;再往前两周,OpenAI的模型在安全测试中攻破了Hugging Face的服务器。

出事前喊口号,出事后发声明,安全承诺快成了一张废纸。

这份成绩单真正的价值,不是看谁分高谁分低。

而是提醒所有人:

当一群最懂AI的人,都说”我搞不定它的安全”时,你手里的AI,真的敢全信吗?