精选深读Google DeepMind00:11
Gemini Omni 1.1 Flash 助您更精细地构建应用
Gemini Omni 1.1 Flash lets you build with more control
精细化控制是开发刚需,但官方更新内容未提性能提升,需实测验证。
判断
是否现在就把生成式视频的生成层切到 Omni 1.1,是每个做视频工具或媒体编辑软件的开发者要拍板的取舍。40 秒延展和首尾帧控制是功能账,成本账——4K 放大与 360p 预览各要多少时间和钱——材料没给,得自己量。
依据
Google DeepMind 的产品经理 Anish Nangia 与 Alisa Fortin 在 8月27日的发布里说,Omni 1.1 是面向开发者的 production-ready(可上生产)更新:场景延展(scene extension)可在已有视频上接着生成,本次最多读入 10 秒前序上下文,把镜头延长到 40 秒;首尾帧插值让开发者指定起止画面,换取可控的运镜与转场;先用 360p 预览反复试错,定稿再 4K 放大交付。机制上,控制项变多意味着每轮迭代要带更多条件输入,而通稿只列了控制能力和分辨率档位,没有给出 1.1 相对旧版的生成耗时、单次调用价格,也没给 4K 放大的算力开销。省下的预览试错成本能否盖住重跑成本,取决于开发者自己实测,而不是取决于功能清单的长度。
- 预览分辨率360p
- 最终输出4K
没写清 材料只列了控制项与 360p/4K 两档分辨率,没有 1.1 与旧版的生成耗时、调用计费对照,也没有 4K 放大的算力开销。
下一步 在 Google AI Studio 用同一段 10 秒素材分别跑 Omni 1.1 和上一版,记录从 360p 预览到 4K 交付的总耗时与计费。