跳到正文

精选深读Google DeepMind00:11

Gemini Omni 1.1 Flash 助您更精细地构建应用

Gemini Omni 1.1 Flash lets you build with more control

精细化控制是开发刚需,但官方更新内容未提性能提升,需实测验证。

判断

是否现在就把生成式视频的生成层切到 Omni 1.1,是每个做视频工具或媒体编辑软件的开发者要拍板的取舍。40 秒延展和首尾帧控制是功能账,成本账——4K 放大与 360p 预览各要多少时间和钱——材料没给,得自己量。

依据

Google DeepMind 的产品经理 Anish Nangia 与 Alisa Fortin 在 8月27日的发布里说,Omni 1.1 是面向开发者的 production-ready(可上生产)更新:场景延展(scene extension)可在已有视频上接着生成,本次最多读入 10 秒前序上下文,把镜头延长到 40 秒;首尾帧插值让开发者指定起止画面,换取可控的运镜与转场;先用 360p 预览反复试错,定稿再 4K 放大交付。机制上,控制项变多意味着每轮迭代要带更多条件输入,而通稿只列了控制能力和分辨率档位,没有给出 1.1 相对旧版的生成耗时、单次调用价格,也没给 4K 放大的算力开销。省下的预览试错成本能否盖住重跑成本,取决于开发者自己实测,而不是取决于功能清单的长度。

  • 预览分辨率360p
  • 最终输出4K
同一流程的两端:360p 试错,4K 交付

没写清 材料只列了控制项与 360p/4K 两档分辨率,没有 1.1 与旧版的生成耗时、调用计费对照,也没有 4K 放大的算力开销。

下一步 在 Google AI Studio 用同一段 10 秒素材分别跑 Omni 1.1 和上一版,记录从 360p 预览到 4K 交付的总耗时与计费。

本期其他新闻

  1. 行业动态

    突破性发布:Claude Code Opus 5 自动模式

    Simon Willison

  2. 行业动态

    试点全球首个双盲 AI 评估

    Google DeepMind

  3. 行业动态

    扩大 OpenAI 在巴西的业务版图

    OpenAI

  4. 精选深读

    Qwen3.8-Flash-Next

    Simon Willison

  5. 精选深读

    更佳答案,更广思维:学生从 ChatGPT 与批判性思维训练中的收获

    OpenAI