AI导航

GLM-5.3 上架 Amazon Bedrock:智谱与 AWS 按调用量分成

AI资讯
2 min read
4 次阅读

GLM-5.3 在 2026 年 10 月 6 日正式上架 Amazon Bedrock:智谱官方账号当天宣布上线,AWS 在官方博客同步发文介绍这款模型,科创板日报披露的合作方式是按调用量分成。也就是说,企业在 Bedrock 上每调用一次 GLM-5.3,智谱都能从中分得收入——GLM 的赚钱方式,从卖自家 API 扩展到了租用全球云平台的收费管道。

在 Bedrock 上能用到什么

按 AWS 官方博客的介绍,GLM-5.3 是 753B 参数的混合专家(MoE)模型,针对编程和长程智能体任务优化,智谱报告它在 CyberGym 安全基准上拿到 84.5 分。上架后,企业不需要自己部署推理基础设施,直接用全托管 API 调用:支持美国与全球两套跨区域推理配置,提示缓存默认开启(也可以显式控制缓存断点),并提供 Flex、Standard、Priority 三档服务等级,在成本和延迟之间选。调用方式兼容 OpenAI 的 Responses 与 Chat Completions 接口,也可以用 Bedrock 原生的 Invoke 和 Converse,控制台 Playground 里可以直接试。限制同样明确:目前只对符合条件的企业客户开放,博客没有公布价格。

分成模式为什么比上架本身更重要

据科创板日报报道,AWS 与智谱按模型调用量分成,而且这不是孤例:智谱近期已与多家海外云厂商落地收入分成,国内则与阿里云百炼签了类似协议,华为云已上架 GLM-5.3 并就分成合作达成意向,正在形成一套贯通国内外的分成体系。背景是智谱的财务结构:其财报显示,2026 年上半年营收 9.54 亿元、同比增长 399.7%,归母亏损 20.71 亿元、同比收窄 12.1%;今年 9 月智谱完成约 50 亿美元融资,资金投向下一代 GLM 模型和算力基础设施。推理调用量直接变成收入,对一家仍在大额投入训练的模型公司,是比一次性授权费更可持续的回血方式。

谁该试,先核对什么

已经在 AWS 上跑业务、又想用开放权重模型做编程或智能体任务的团队,是第一批受益者:省去自建推理集群,账单、权限和合规都留在原有 AWS 账户里。但下单前要核对三件事:一是账户是否在可开通的企业客户范围内;二是价格未公开,需用自己的真实代码库任务做小规模对照测试,再和 Bedrock 上的其他模型比成本;三是安全边界——GLM-5.3 的网络攻防能力是卖点,AWS 博客的演示也是用它配合开源工具 Strix 做渗透测试,这类用法只适用于自有系统或有书面授权的目标,企业应把调用权限和审计纳入现有流程,而不是当成普通聊天模型放开。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。