精选深读AWS Machine Learning Blog
来源时间 本站刊期
在 Amazon Bedrock 上推出 GLM 5.3
Introducing GLM 5.3 on Amazon Bedrock
753B参数MoE在Bedrock上线,编码与长任务团队可先试,别忘了成本账。
判断
正在为开源权重编码模型自建推理集群的团队,可以把「先自建还是先托管」这一步往后推:GLM 5.3 在 Amazon Bedrock 上以托管 API 提供,可以先用它验证编码与长周期任务能不能跑通,再决定是否自己搭推理基础设施。
依据
AWS 博客作者 Alex Thewsey 在公告里说 GLM 5.3 已可在 Amazon Bedrock 上调用,并写明 Z.ai(智谱 AI)报告该模型表现出显著的网络安全能力。它是 753B 参数的混合专家模型(mixture-of-experts,MoE:推理时只激活部分专家而非全部参数),定位编码和长周期 agentic(智能体)任务。托管这件事改变了分工:团队不再需要采购和运维自己的推理基础设施,而是走带跨区域推理、提示缓存(prompt caching:复用重复前缀以降低成本和延迟)和服务层级的托管 API,并用 OpenAI 兼容接口接入。公告同时写明,访问权限只对 eligible enterprise customers 开放。
- 企业客户准入接入
- OpenAI 兼容接口调用复用前缀
- 提示缓存压成本实测
- 授权安全测试
没写清 材料只说面向 eligible enterprise customers,没给准入标准、单价和限流,所以成本账无法替它算。
下一步 先在自己的 Bedrock 账号上确认是否落在 eligible enterprise customers 的准入范围内。