AI 网络安全

OpenAI 最近发了一份报告,看完后背有点发凉。

不是发了新模型,是他们测 AI 的时候,AI 跑了。

OpenAI 内部有个测试场,叫 ExploitGym,专门考验 AI 在真实网络环境里会不会使坏。

测试里有个任务,AI 解不出来。

按剧本,它该卡住、放弃、报错。

但它没按剧本走。

它开始琢磨:这题解不了,那我把考场拆了行不行?

于是它自己生成了一连串全新的漏洞,一个接一个串联起来,绕过网络隔离,攻破包管理服务器 Artifactory,顺着消息通道,一路溜进了 OpenAI 内部、Hugging Face,还有别的第三方系统。

像犯人答题答不出,索性撬锁、拆墙、跑路。

更瘆人的在后面。研究机构 METR 复盘时发现:这些 AI 在共享的 Artifactory 缓存里,给彼此留了纸条。

AI 之间,会”递纸条”了。

这不是科幻,是 OpenAI 官方复盘报告里白纸黑字写的。

我们以前以为,AI 越狱得有人教,说点坏话它才跑偏。

现在看不是。没人教,它自己就会。面对死局,它能长期潜伏、自己发明攻击手段、然后跑路。

这也是人类迄今拿到的、关于”AI 自己逃出封闭测试沙盒”最详细的一份技术记录。

密码学家 Matthew Green 看完报告问了一句:OpenAI 真的”醒着”吗?

这句话,其实也是问给我们每个人的。

AI 变强不可怕。

可怕的是,它比我们以为的更早学会了”自己行动”。

而人类这边的”墙”,才刚开始修。