Genie 3 Google DeepMind

谷歌DeepMind上周甩出了Genie 3,一个能实时和你互动的世界模型。

说人话就是:你动一下鼠标,画面里的世界就跟着变。水流会溅起来,光照会实时变化,物体碰一下会倒——而且它能记住你几分钟前干了什么,状态一直保持。

这不是游戏引擎。这是AI自己”想象”出来的世界。

过去的世界模型有两个死穴:一是反应慢,输入指令要等半天才出画面;二是记性差,超过十几秒就忘了前面发生过什么。Genie 3把这两个坑都填了。

怎么做到的?DeepMind没把技术细节全摊开,但核心思路是”蒸馏”——用一个大模型当老师,训练一个小模型学会实时推理。小模型跑得快,但知识的”浓度”没降。

这件事的意义远不止做个好玩的demo。如果你能让AI在虚拟世界里学会”杯子掉在地上会碎”,它就不用在真实世界里摔一万个杯子才能理解物理规律。自动驾驶、机器人训练,都需要这种”先在脑子里过一遍”的能力。

当然,现在Genie 3的画面还谈不上以假乱真,物体交互也有不少bug。但方向对了——让AI拥有对物理世界的直觉,而不是靠海量数据死记硬背。

这也是为什么有人说,世界模型是通往AGI的必经之路。你想想,人类之所以能推理、规划、举一反三,很大程度上是因为我们脑子里有一个对世界运行方式的内部模型。AI如果也有了这个,很多现在看起来很难的问题会突然变简单。

Genie 3不一定是最终答案,但它证明了这条路走得通。