跳到正文

精选深读Google DeepMind00:18

推出Gemini 3.8 Flash和3.8 Flash Cyber

Introducing Gemini 3.8 Flash and 3.8 Flash Cyber

Flash迭代提速但Cyber版仅限特定任务,通用场景性价比待测。

判断

准备把长周期编码代理接入生产的人,这次升级把选型问题从“模型够不够强”移到“高 effort 下多出的 token 成本能否压住”;通用安全团队因 Cyber 版只走 Fairwind Program,暂不必把它列入采购比较。

依据

Google DeepMind 的 Tulsee Doshi(产品管理高级总监)和 Raluca Ada Popa(Gemini 安全负责人)在 9月2日发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。3.8 Flash 保持 3.7 Flash 的入门价:每百万输入 token(模型计费的最小文本单位)$0.75、每百万输出 token $3.75;在 HLE-Verified(Humanity's Last Exam 的验证子集)得 54.9%。机制上,两个版本共享同一基础智能,用长周期 agentic loop(代理循环)递归评估和精炼模型;3.8 Flash 在复杂任务上“更用力”,会多走推理步骤、反复调用工具,因此高 effort(模型投入的推理力度)下可能消耗更多 token,而低 effort 可用于压缩算力。Cyber 版则面向 Fairwind Program(新可信防御者计划)内的可信防御者,主攻漏洞检测和自动修补。

  • 输入 token 每百万$0.75
  • 输出 token 每百万$3.75
  • HLE-Verified54.9%
3.8 Flash 的每百万 token 定价与 HLE-Verified 得分

没写清 材料没给 3.8 Flash 在高 effort 下相对 3.7 Flash 的实际 token 增幅和单位任务成本,只说可能多用 token。

下一步 下一步可核对 Google DeepMind 是否发布 3.8 Flash 与 3.7 Flash 在相同高 effort 任务上的 token 消耗对照。

本期其他新闻

  1. 行业动态

    前线防御者的黎明:10亿美元保护关键服务

    OpenAI

  2. 行业动态

    Legora使用GPT-6 Astra在几分钟内审阅了41份文档

    OpenAI

  3. 行业动态

    Playco使用GPT-6 Astra将游戏原型制作中的手动修复减少50%

    OpenAI

  4. 精选深读

    推出WeatherNext 3,我们最先进、最准确的全球天气AI模型

    Google DeepMind

  5. 精选深读

    NeoMME:一种高效的多模态原生和多语言编码器

    Hugging Face

  6. 精选深读

    在100个GRPO步骤中微调350M模型以获得更好的结构化输出

    Hugging Face