GLM-5.3 在 2026 年 10 月 6 日正式上架 Amazon Bedrock:智谱官方账号当天宣布上线,AWS 在官方博客同步发文介绍这款模型,科创板日报披露的合作方式是按调用量分成。也就是说,企业在 Bedrock 上每调用一次 GLM-5.3,智谱都能从中分得收入——GLM 的赚钱方式,从卖自家 API 扩展到了租用全球云平台的收费管道。
在 Bedrock 上能用到什么
按 AWS 官方博客的介绍,GLM-5.3 是 753B 参数的混合专家(MoE)模型,针对编程和长程智能体任务优化,智谱报告它在 CyberGym 安全基准上拿到 84.5 分。上架后,企业不需要自己部署推理基础设施,直接用全托管 API 调用:支持美国与全球两套跨区域推理配置,提示缓存默认开启(也可以显式控制缓存断点),并提供 Flex、Standard、Priority 三档服务等级,在成本和延迟之间选。调用方式兼容 OpenAI 的 Responses 与 Chat Completions 接口,也可以用 Bedrock 原生的 Invoke 和 Converse,控制台 Playground 里可以直接试。限制同样明确:目前只对符合条件的企业客户开放,博客没有公布价格。
分成模式为什么比上架本身更重要
据科创板日报报道,AWS 与智谱按模型调用量分成,而且这不是孤例:智谱近期已与多家海外云厂商落地收入分成,国内则与阿里云百炼签了类似协议,华为云已上架 GLM-5.3 并就分成合作达成意向,正在形成一套贯通国内外的分成体系。背景是智谱的财务结构:其财报显示,2026 年上半年营收 9.54 亿元、同比增长 399.7%,归母亏损 20.71 亿元、同比收窄 12.1%;今年 9 月智谱完成约 50 亿美元融资,资金投向下一代 GLM 模型和算力基础设施。推理调用量直接变成收入,对一家仍在大额投入训练的模型公司,是比一次性授权费更可持续的回血方式。
谁该试,先核对什么
已经在 AWS 上跑业务、又想用开放权重模型做编程或智能体任务的团队,是第一批受益者:省去自建推理集群,账单、权限和合规都留在原有 AWS 账户里。但下单前要核对三件事:一是账户是否在可开通的企业客户范围内;二是价格未公开,需用自己的真实代码库任务做小规模对照测试,再和 Bedrock 上的其他模型比成本;三是安全边界——GLM-5.3 的网络攻防能力是卖点,AWS 博客的演示也是用它配合开源工具 Strix 做渗透测试,这类用法只适用于自有系统或有书面授权的目标,企业应把调用权限和审计纳入现有流程,而不是当成普通聊天模型放开。