![[AINews] 今天没发生什么大事](https://substackcdn.com/image/fetch/$s_!DbYa!,w_256,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F73b0838a-bd14-46a1-801c-b6a2046e5c1e_1130x1130.png)
行业动态Latent Space
[AINews] 今天没发生什么大事内容仅一句“a quiet day”,对科技从业者无实际信息增量,可跳过。
做 agent 成本路由的人这周该换默认模型:Sonnet 5.5 的缓存读取降到 $0.10/百万 token,Anthropic 估算多数 agentic 工作便宜约 20%;而 Haiku 5.5 一旦上下文超过 100k,单价涨 5 倍。
展开全文收起
依据
Vals 把 Haiku 5.5 与 Haiku 4.5 逐项对比:同一条 Legal Research 上推理步数是 59 对 17,结果它在每个共同基准上的单次测试成本都更高;其 API 报价为 $0.10/$0.50 每百万输入/输出 token,与 GPT-6 Luna 持平,但超过 100k token 上下文后价格上涨 5 倍。另一侧,Anthropic 把 Sonnet 5.5 的缓存读取(cache read,指复用已缓存的提示前缀、只按读取量计费的那部分)降到每百万 token $0.10,输入 $2、输出 $10,官方估算这让大多数 agentic(自主多步调用工具的)工作便宜约 20%,且 Claude Code 的限额不变。两边叠起来,选型的判据从「哪家单价便宜」变成「这条任务的上下文会不会越过 100k」,因为越线之后省下的缓存钱会被 Haiku 5.5 的涨价吃掉。
- Haiku 5.5 输入$0.10/百万 token
- Haiku 5.5 输出$0.50/百万 token
- Sonnet 5.5 缓存读取$0.10/百万 token
- Haiku 5.5 超 100k 上下文价格涨 5 倍
没写清 材料没给真实 agent 工作负载下的缓存命中率,也没有 Haiku 5.5 跨过 100k 后的实测单任务账单,所以那 20% 和 5 倍无法折算到同一条任务上做净额比较。
下一步 Vals 或 Roboflow 下一次跑 Legal Research 时公布的整条任务 token 账单与缓存命中率。


