跳到正文

精选深读Google DeepMind00:11

Gemini Omni 1.1 Flash让您以更多控制进行构建

Gemini Omni 1.1 Flash lets you build with more control

精细化控制是开发刚需,但官方更新内容未提性能提升,需实测验证。

判断

对正在挑视频生成底座的中小团队技术负责人,这次更新的取舍是「先省钱、后出片」:用 360p 草稿压住反复重跑的开销,把 4K 留给上线前那一次。若瓶颈是成片画质,这份公告给不了你换供应商的依据。

依据

Google DeepMind 产品经理 Anish Nangia 和 Alisa Fortin 在 8月27日的发布中宣布,Gemini Omni 1.1 Flash 通过 Google AI Studio 的 Gemini API 面向开发者提供。机制有三处:scene extension(场景延展,让已有片段接着往下生成)可读取最多 10 秒的前序上下文,把镜头续到 40 秒;首尾帧指定让模型在给定起点与终点之间补出运镜和转场;再加 360p 预览用于快速迭代,最终上采样到 4K。取舍落在最后一步:360p 草稿便宜,但低分辨率看不出只在 4K 才暴露的细节问题,真正返工发生在出片之后。40 秒的延展上限也意味着更长的叙事仍需拼接,接缝处的一致性由谁兜底,公告没有交代。要不要把它排进素材管线,取决于预览这一步能不能挡住返工。

  • 延展时长上限40 秒
  • 前序上下文10 秒
  • 预览分辨率360p
  • 最终输出4K
Omni 1.1 Flash 公布的规格上限,不是与旧版的性能对照

没写清 材料没有推理延迟、单次生成成本或 4K 上采样耗时,也没有与旧版或竞品的任何对照数字,所以不能替它把「更快」写成结论。

下一步 在 AI Studio 用同一段素材跑一遍 360p 草稿到 4K 出片,记录端到端耗时与费用,再与团队现用模型在同素材上对比。

本期其他新闻

  1. 行业动态

    如今,仅凭一个漏洞的传闻就足以发现安全漏洞

    Simon Willison

  2. 行业动态

    支持泰国下一代AI初创企业

    OpenAI

  3. 行业动态

    突破Claude Code Opus 5自动模式

    Simon Willison

  4. 行业动态

    试点全球首个双盲AI评估

    Google DeepMind

  5. 精选深读

    开放ASR排行榜新增首个南半球语言

    Hugging Face