精选深读Simon Willison07:53
推出Hy4预览版
Introducing Hy4 Preview
Hy4预览版刷新上下文长度上限,但未公开性能基准,开发者审慎评估。
判断
做长文档与检索增强的团队可以把 Hy4 预览版列进候选,但别把 1M token 窗口当成质量证明:聊天模板只给 high 与 no_think 两档,成本与延迟的中间档不存在,选型结论得等基准出来再下。
依据
Simon Willison 在 8月29日的链接帖里记录腾讯当天放出的 Hy4 预览版:开放权重(open weight,指权重可下载自部署)、纯文本输入、不带视觉。他在 Hugging Face 上看到 770B 总参数、49B 激活参数(每步只计算 49B 那部分)、1M token 上下文、1.56TB 体积;7月的 Hy3 对应 295B、21B 激活、256,000 上下文、598GB。他还翻出 chat template(对话模板,决定推理时怎么拼提示词的模板),里面 reasoning_effort 只认 high 与 no_think 两档,缺省是 high,传别的值直接抛异常。他用 pelican 骑自行车那个提示词经 OpenRouter 跑了一次,推理轨迹里用的是被截断的英文,他判断隐藏推理文本不需要完整语法。
- Hy4 总参数770B
- Hy3 总参数295B
- Hy4 上下文1M token
- Hy3 上下文256,000
没写清 材料只有参数、体积与上下文长度,没有基准分数、许可证条款和定价,所以无法判断它是否比 Hy3 更能解题。
下一步 可核对 Hugging Face 上 Hy4 的模型卡是否补出基准分数与许可证类型。