精选深读Google DeepMind
来源时间 本站刊期
Gemini 4 Argon:我们前沿智能的下一个时代
Gemini 4 Argon: our next era of frontier intelligence
官方称新时代前沿却无评测细节,真实性待第三方场景验证
判断
官方只给了价格和 1 million token 上下文,没给任何评测分,所以工程团队这轮只能把 Argon 放进新项目候选池,而不是迁移存量生产任务——迁移得重跑整条评测与回归,这笔账现在没人替它买单。
依据
Koray Kavukcuoglu(Google DeepMind 高级副总裁兼首席 AI 架构师)在公告里称 Argon 在真实软件工程、法律与财务这类企业知识工作、以及网络安全防御上达到前沿水平,同时给出的是分阶段发布路径:先通过 Fairwind Program(邀请制、只面向受信任网络安全防御者的计划)小范围放出,并参与美国政府的前置模型访问流程。机制上,Google 交出的是一组商业参数而不是能力证据——上下文 1 million token(token 是模型处理文本的最小单位)、输入 2 美元/百万 token、输出 10 美元/百万 token、缓存输入按输入价打 95% 折扣,外加『数千名 Googler 已在内部使用』这条自述。全篇没有基准分、没有竞品同任务对照、也没有第三方复现,所以「前沿」目前只有官方口径在支撑,采购与迁移决策缺的是可比的数字。
- 上下文上限1 million token
- 输入价$2 / 百万 token
- 输出价$10 / 百万 token
- 缓存输入折扣95% off
没写清 材料没给任何基准分、竞品同任务对照或第三方复现,能力是否达到它自称的「前沿」无法从这批信息里核实。
下一步 看 Argon 是否公开第三方评测结果,或把 Fairwind 邀请制改成开发者自助申请。