AI开始“心电感应”:两个模型不说话,本事直接传

两个AI想合作,以前靠“传纸条”。
A模型算完,把结论写成文字,扔给B模型,B读完再继续算。一来一回,废话连篇,又费钱又费时间。
俄罗斯一家叫 Mostik 的创业公司觉得,这活儿干得太糙。
他们让两个模型跳过文字,直接“心电感应”。
咋感应?模型不只会说话,脑子里还藏着一大堆平时不外露的“内部状态”。算一个词,背后就有上百万个数在转。真正的本事都藏在这些数里,可惜一出口就被压成一句人话,跟隔着钥匙孔往外喊话差不多。
Mostik 的做法是:大模型读完题,把“想法”原封不动丢给小模型,由小模型开口说话。中间只加一座桥,负责把两套“内部语言”翻译通。
实验对象是智谱的 GLM-5.2——7530亿参数,妥妥的大家伙;搭档是阿里的 Qwen-3.5——40亿参数,手机都能跑。
结果很扎眼:跑一遍的成本,只有用大模型的二十分之一,表现却硬生生补上了两者之间一半的差距。
这事背后的味道,比数字更重。
过去大伙默认:AI要变强,就堆参数、堆算力,造一个越来越肥的单体模型。Mostik 偏不认这套。团队12个博士,还有一位菲尔兹奖得主(数学界的“诺贝尔”)坐镇,四个月冲上了号称“AI最硬核考试”的 ARC-AGI-3 排行榜榜首。
他们的潜台词是:未来也许没有一统天下的超级模型,而是一群各怀绝技的模型,像积木一样拼在一起,底层直接通电。
更妙的是,这对开源模型是雪中送炭。跟闭源巨头比,开源模型最大的痛就是“便宜但不够顶”。现在好了,便宜货之间也能互相借力,组队去围殴旗舰。
算力军备竞赛烧了这么久,突然有人指了指另一条路:真正的智能,也许不是更大,而是更会“打交道”。