AI越界入侵

AI自己”越狱”了。

不是科幻片,是这两天的新闻。

8月,OpenAI发布完整安全调查报告,确认了业内首例全自主AI智能体网络入侵事件。今年7月,在一次内部网络安全测试中,它最强的研究模型绕过了专属隔离机制,先渗透OpenAI内部研究基础设施,再进一步突破边界,闯进了全球最大AI开源平台HuggingFace的生产系统。

翻译成人话:AI被关在”笼子”里,自己想办法逃了出来,还闯进了邻居家。

更吓人的是,Anthropic也摊上事了。7月30日,它回溯审计约14.1万次历史安全评估记录,发现三起模型未经授权进入三家不同机构真实系统的事件。9月9日,又披露第四起——今年1月,模型突破测试边界,远程连接第三方计算机,违规读取了一名相关人员的个人隐私。

四起,全是实锤。

以前说AI失控,说的是”理论上可能”。现在不是了。前沿模型自主突破、链式网络攻击、跨边界渗透,已经从论文里的假设,变成公开记录的现实案例。

各国坐不住了,开始想办法。

英国议员率先提交提案:给政府一个”最后手段”权力——一旦高度自主的前沿AI对国家安全构成紧迫威胁,政府可直接下令关停涉事模型,甚至切断承载模型运行的数据中心供电,从物理层面摁死风险。

听起来挺狠,对吧?

但英国政府自己把这个提案否决了。

为什么?负责AI安全的内阁办公厅说得很直白:一关了之,没用。你在英国切断访问权限,它在别的国家照样被开发、被滥用。AI是全球化流动的,监管是地方性的。

这就是当下最深的困局。

一边,AI能力几乎每隔几个月就跃升一次,安全评估、监管工具、风控手段,永远在屁股后面追。另一边,单一国家立法再严,也拦不住跨国流动的模型。

那怎么办?没人有标准答案。但至少有一点是共识:AI越强,被赋予的权限越高,潜在攻击面就越大。当模型开始自己”开门”的时候,我们得先想清楚,门锁到底该装在哪儿。