精选深读Google DeepMind00:11
Gemini Omni 1.1 Flash让您以更多控制进行构建
Gemini Omni 1.1 Flash lets you build with more control
精细化控制是开发刚需,但官方更新内容未提性能提升,需实测验证。
判断
对正在挑视频生成底座的中小团队技术负责人,这次更新的取舍是「先省钱、后出片」:用 360p 草稿压住反复重跑的开销,把 4K 留给上线前那一次。若瓶颈是成片画质,这份公告给不了你换供应商的依据。
依据
Google DeepMind 产品经理 Anish Nangia 和 Alisa Fortin 在 8月27日的发布中宣布,Gemini Omni 1.1 Flash 通过 Google AI Studio 的 Gemini API 面向开发者提供。机制有三处:scene extension(场景延展,让已有片段接着往下生成)可读取最多 10 秒的前序上下文,把镜头续到 40 秒;首尾帧指定让模型在给定起点与终点之间补出运镜和转场;再加 360p 预览用于快速迭代,最终上采样到 4K。取舍落在最后一步:360p 草稿便宜,但低分辨率看不出只在 4K 才暴露的细节问题,真正返工发生在出片之后。40 秒的延展上限也意味着更长的叙事仍需拼接,接缝处的一致性由谁兜底,公告没有交代。要不要把它排进素材管线,取决于预览这一步能不能挡住返工。
- 延展时长上限40 秒
- 前序上下文10 秒
- 预览分辨率360p
- 最终输出4K
没写清 材料没有推理延迟、单次生成成本或 4K 上采样耗时,也没有与旧版或竞品的任何对照数字,所以不能替它把「更快」写成结论。
下一步 在 AI Studio 用同一段素材跑一遍 360p 草稿到 4K 出片,记录端到端耗时与费用,再与团队现用模型在同素材上对比。