AI虚拟城市

一张卧室照片扔进去,几秒钟,AI给你补出一整间房——能走进去,能转视角,灯还能关。

这不是游戏引擎,是8月17日合肥智象未来(HiDream.ai)发布的”世界模型”HiDream-O1-World。

名字有点绕,说人话:以前AI生成视频,是”放电影”,播完就完。现在这个,是”盖房子”——盖完你能进去逛,逛完还能改。

它有三板斧:漫游、编辑、交互。

漫游,第一人称、第三人称随便切,往前走、往左拐,空间不乱。编辑,让角色跑、跳、抓东西,或者下个雨、掉个物件。交互,人和世界能互相影响。

听着不难?难的是”记住”。

以前AI生成画面,镜头一转,刚才的东西就”忘”了——墙没了、杯子飞了、人穿模了。这个模型靠”3D空间记忆”把场景结构记下来,你转十圈回来,桌子还在原位,杯子还在桌上。

更狠的是物理。雪地上走路,脚印真的会陷下去;东西掉下来,真的会砸出响。碰撞、遮挡、重力,都按现实世界的规矩来,不是瞎拼的画面。

凭这一手,它在世界模型评测基准WBench的Navi分榜上登了顶,物理维度第一。

有人问,生成个能逛的3D世界,图啥?

图的是给机器人”练功”。

世界模型被业内叫”物理AI的大脑”。机器人、无人车想变聪明,不能老在现实里摔跟头——贵,还危险。现在可以在AI造的虚拟世界里先练,练会了再上真机。

还有AI互动影游:以前是你看故事,现在是你在故事里,剧情随你走。

智象未来CTO姚霆有句话挺戳:世界模型的价值,不在于生成逼真的三维场景,而在于AI开始真正理解空间的深度、物体的质感、运动的惯性与光影的逻辑。

翻译成人话:AI过去只会”画”,现在开始”懂”物理世界了。

从聊天到生成,从生成到交互,从交互到”构建世界”——AI的下半场,拼的不是谁更会说话,而是谁更懂这个世界。

AI全息世界