Gemini Omni 1.1 Flash AI视频生成

谷歌放出了它今年最想秀的一张牌。

8月27日,谷歌正式发布视频生成模型 Gemini Omni 1.1 Flash。名字有点长,但你只需要记住三件事:能续写、能控制、能出4K。

第一件事:AI视频,终于会”接戏”了

以前AI生成视频,最尴尬的是什么?画面没逻辑。拍了一条10秒的,想让它继续往下编,它只记得最后那一秒,结果越接越离谱,人物漂移、光线乱跳。

这次谷歌把”记忆”拉长了。Omni 1.1能看懂前面10秒的画面,每次往后接10秒,最长能攒到40秒。别小看40秒——短视频最需要的,恰恰就是这个长度。

更实用的是”首尾帧控制”:你给出第一帧和最后一帧,AI自己把中间的镜头运动补出来。以前想让它来个环绕运镜,纯靠碰运气;现在你把起止定好,它照着演。

第二件事:先便宜地试,再贵贵地出

做视频最烧钱的是什么?不是生成,是反复试错。

谷歌这次学聪明了,搞了个”草稿模式”:360p的预览,生成速度快60%,价格只要720p的三分之一。你先花小钱把分镜试满意了,再花钱出高清成片——1080p甚至4K。

价格也明码标价了,按秒算:

  • 360p:每秒0.03美元(约2毛钱)
  • 720p:每秒0.1美元(约7毛)
  • 1080p:每秒0.15美元(约1块)
  • 4K:每秒0.3美元(约2块)

这个思路,其实是从电影工业学来的——先出粗剪,定了再精修。工具好不好用,从来不只看上限有多高,还看试错成本有多低。

第三件事:Adobe、Figma、Runway已经上车

这次谷歌不是自己玩。Adobe的Firefly、Figma的Weave、还有做AI视频的Runway,都已经把Omni Flash接进了自家工作流。

什么意思?说明AI视频正在从”实验室玩具”变成”生产工具”。真正干活的软件开始用它了,这比跑分有意义得多。

说点题外话

这一版最戳我的,不是参数多好看,而是谷歌想通了一件事:AI视频的对手,从来不是真人摄影,而是”不可控”三个字。

生成式视频这几年一直被骂”开盲盒”——你永远不知道下一秒会给你什么。这版加的所有功能,续写、定帧、草稿、4K,全都在做同一件事:把不可控变成可控,把”生成”变成”导演”。

工具越听话,对人的要求反而越高。以前是AI替你瞎编,现在是你得先想清楚要什么。就像相机普及后,摄影的门槛低了,但好照片反而更值钱——因为背后的人更重要了。

AI视频也一样。工具会越来越便宜、越来越听话,但”会讲故事”的人,永远不会被淘汰。