GLM-5.3 已经正式上线 Amazon Bedrock。2026 年 10 月 6 日,智谱 Z.ai 官方宣布这款旗舰模型进入 AWS 的大模型服务平台;AWS 官方文档给出的模型上线日期为 10 月 5 日,并标注访问权限只开放给符合条件的客户。据《科创板日报》10 月 6 日报道,AWS 将按模型调用量与智谱分成——这意味着智谱的海外收入不再主要靠卖授权,而是跟着每一次 API 调用走。
先看模型本身:744B 总参数,冲着编程智能体去
按 AWS 官方模型页的说明,GLM-5.3 是智谱的开放权重旗舰文本模型,采用混合专家架构,总参数 744B、每个 token 约激活 40B,基于与 GLM-5.2 相同的底座、靠扩大后训练规模做了增强。它支持 100 万 token 上下文、最长 12.8 万 token 输出,并提供可调的推理强度档位,让调用方在延迟、token 消耗和任务效果之间自己权衡。
从官方列出的典型用途看,这款模型的靶心非常明确:智能体编程与自主软件工程、终端与命令行任务、仓库级代码生成与重构、跨多步工具调用的长程工程任务。函数调用、结构化 JSON 输出、流式响应(含推理过程流式输出)也都齐备。换句话说,它不是来和聊天机器人拼闲聊的,而是来抢企业开发流水线里的位置的。
分成模式才是这条新闻的重点
模型上架大云平台并不新鲜,新鲜的是钱怎么分。按调用量分成,等于模型厂商把自己变成了云货架上的"供应商":云厂商提供全球区域、合规背书、企业客户关系和账单体系,模型厂商提供能力,按用量抽成。报道称,智谱近期已与多家海外云厂商落地类似模式;国内方面,阿里云百炼已签下类似分成协议,华为云也已上架 GLM-5.3 并就合作达成意向。一条贯通国内外的分成网络,正在替代过去"一家一家谈授权"的笨重打法。
对智谱来说,这条路的好处是轻:不用在每个国家自建销售团队,收入随调用量自然放大;代价是定价权和客户关系都握在云厂商手里,分成比例也没有公开。对 AWS 来说,货架上多一款能打的开放权重旗舰,可以把原本可能流向其他云的企业客户留住。
想用的人,先看清两个门槛
第一是资格门槛。AWS 文档明确写了 GLM-5.3 只对符合条件的客户开放,需要联系 AWS 客户团队,不是注册账号就能直接调用。第二是部署方式:它只支持跨区域推理,必须使用美国地理推理配置(us.zai.glm-5.3)或全球推理配置(global.zai.glm-5.3),不支持区域内按需推理。对数据驻留要求严格的企业来说,请求可能跨境这一点必须提前评估,它和"模型很强"是两件不同的事。
把这件事放在更大的图景里看:中国开放权重模型正在从"在榜单上赢"转向"在全球云货架上赚钱"。榜单成绩决定有没有人看,分成通道决定能不能持续把研发的钱挣回来。GLM-5.3 这一步的成败,不看发布当天的声量,看接下来几个季度 Bedrock 上的真实调用量。