谷歌AI人工智能

这几天谷歌DeepMind发了篇论文,整了个叫DiffusionGemma的新模型。

名字听着学术,翻译成人话就一句话:AI以前一个字一个字往外蹦,现在可以一次蹦出256个。

别小看这个变化。过去这么多年,全世界都在等AI“打字”;现在,它学会“打包发货”了。

论文里有个数字很直观:在英伟达H100上,这个模型每秒能生成1500个token。什么概念?老模型靠各种加速技巧才能跑到几百,它直接翻了几倍。

原理其实不玄乎。以前的AI像绿皮火车,车厢一节一节过;DiffusionGemma像八车道高速,256辆车同时开,还不会撞。

更难得的是,它没拿质量换速度。论文说它保留了思考模式、能看图、支持超长上下文,想老老实实逐字输出也行。

这背后藏着一个更大的信号:AI的瓶颈,正在从“算得慢”变成“发得快”。

过去大家拼的是谁更聪明,接下来可能要拼谁更快、更便宜、更扛得住大规模调用。当生成速度不再是天花板,真正决定差距的,就只剩谁更聪明这一件事了。

跑得快的时代,已经摸到门口了。