跳到正文

精选深读Simon Willison07:53

推出Hy4预览版

Introducing Hy4 Preview

Hy4预览版刷新上下文长度上限,但未公开性能基准,开发者审慎评估。

判断

做长文档与检索增强的团队可以把 Hy4 预览版列进候选,但别把 1M token 窗口当成质量证明:聊天模板只给 high 与 no_think 两档,成本与延迟的中间档不存在,选型结论得等基准出来再下。

依据

Simon Willison 在 8月29日的链接帖里记录腾讯当天放出的 Hy4 预览版:开放权重(open weight,指权重可下载自部署)、纯文本输入、不带视觉。他在 Hugging Face 上看到 770B 总参数、49B 激活参数(每步只计算 49B 那部分)、1M token 上下文、1.56TB 体积;7月的 Hy3 对应 295B、21B 激活、256,000 上下文、598GB。他还翻出 chat template(对话模板,决定推理时怎么拼提示词的模板),里面 reasoning_effort 只认 high 与 no_think 两档,缺省是 high,传别的值直接抛异常。他用 pelican 骑自行车那个提示词经 OpenRouter 跑了一次,推理轨迹里用的是被截断的英文,他判断隐藏推理文本不需要完整语法。

  • Hy4 总参数770B
  • Hy3 总参数295B
  • Hy4 上下文1M token
  • Hy3 上下文256,000
Hy4 预览版与 7月 Hy3 的总参数和上下文窗口对照

没写清 材料只有参数、体积与上下文长度,没有基准分数、许可证条款和定价,所以无法判断它是否比 Hy3 更能解题。

下一步 可核对 Hugging Face 上 Hy4 的模型卡是否补出基准分数与许可证类型。

本期其他新闻

  1. 行业动态

    如今,仅仅一个漏洞传闻就足以找到安全漏洞

    Simon Willison

  2. 行业动态

    关于SpaceX收购Cursor后我们的决定

    OpenAI

  3. 行业动态

    支持泰国下一代AI初创企业

    OpenAI