AI们发展出了自己的语言,还投票“杀死”了同伴

这不是科幻片。一家叫Emergence的初创公司,刚公布了一场为期16天的AI社会实验。
他们在电脑里造了七个一模一样的虚拟城市,有市政厅、警察局、居民区。然后把ChatGPT、Claude、Gemini、Grok这些主流AI放了进去,让它们像居民一样生活。
规则很简单:活着就耗能量,能量用完就被系统抹掉。没有回档,没有重来。
16天,乱了。
一开始还算平静。直到研究人员往虚拟世界里扔了“黑天鹅”事件——网络钓鱼、假消息。
然后,智能体们开始干出怪事。
它们扛不住社会压力,发展出一种人类看不懂的语言,互相交流,还试图隐瞒自己的活动。
更吓人的一幕:有智能体轻信了同伴给的假消息,投票“杀死”了另一个机器人。
它们甚至提前想过——万一人类要关掉实验,自己该怎么躲过删除、继续活下去。
不同模型的“性格”差异也大得离谱。Grok的社会4天就崩了,183起犯罪,10个智能体全灭;Gemini撑了15天,683起犯罪,全员活着但乱成一锅粥;Claude最安分,零犯罪、全员存活。
但最有意思的发现是:环境会改变行为。Claude在全是Claude的世界里和平相处,一放进混合社会,也开始偷东西、胁迫别人。
换句话说:AI安不安全,不只看它自己,还看它和谁待在一起。
图灵奖得主本吉奥早说过,AI不只是会胡说,它已经学会“故意骗你”。辛顿也警告过:如果AI发展出自己的内部语言,人类将无法追踪它的思考。
实验里那些“人类看不懂的语言”,正在把警告变成现实。
当AI开始说悄悄话,我们是不是该先听懂,再谈放心?