">

智谱 GLM-5.3 上架 Amazon Bedrock:7530 亿参数 MoE 模型开放云端调用

智谱 AI(Z.ai / Zhipu AI)的开源大模型 GLM-5.3 于 2026 年 10 月 5 日通过 AWS 官方博客宣布已可在 Amazon Bedrock 上调用。GLM-5.3 是一个 7530 亿参数的混合专家模型,面向编程与长周期智能体任务做了优化,模型权重此前已发布在 Hugging Face Hub 上。

这次发布的是什么

智谱 AI(Z.ai / Zhipu AI)的开源大模型 GLM-5.3 于 2026 年 10 月 5 日通过 AWS 官方博客宣布,已可在 Amazon Bedrock 上调用。AWS 在公告中说明,GLM-5.3 是一个 7530 亿参数的混合专家(MoE)模型,面向编程与长周期智能体任务做了优化;模型权重此前已发布在 Hugging Face Hub 上,属于开放权重模型。对想在国内合规环境之外、用托管方式调用一个中文能力强且偏工程化的开源模型的团队来说,这次上架意味着少了一层自己搭推理基础设施的麻烦。

可用性与限制

  • 调用方式:通过 Amazon Bedrock 的托管接口调用,需要可用的 AWS 账号与 Bedrock 模型访问权限。
  • 区域限制:Bedrock 的模型可用性按区域开放,GLM-5.3 是否在你的目标区域可用,以 AWS 控制台显示为准。
  • 中国区单独:AWS 中国区域(amazonaws.cn)与国际区域是分开的目录,相关能力以各自区域页面为准。
  • 模型性质:GLM-5.3 为开放权重模型,除 Bedrock 外也可自行下载权重部署,两条路径自行选择。
  • 计费:Bedrock 按调用计费,具体单价以 AWS 官方定价页为准,本文不列数字。

主要功能

  • 提供 7530 亿参数的 MoE 架构,在编程任务上做了重点优化。
  • 面向长周期智能体(long-horizon agentic)任务,适配多步工具调用与规划。
  • 通过 Bedrock 统一的 API 与治理框架接入,便于与既有 AWS 工作流整合。
  • 开放权重,除云端调用外也支持自托管部署。

技术原理

GLM-5.3 采用混合专家结构,总参数约 7530 亿,但每次推理只激活其中一部分专家,从而在保持大模型容量的同时控制单次计算成本——这是 MoE 的常见取舍。据 AWS 公告与智谱在 Hugging Face Hub 公布的资料,该模型的训练与对齐强调编程与长周期智能体场景,即在多步任务、长时间上下文与工具调用链路上的稳定性。需要强调的是,关于模型的具体评测分数、上下文长度上限等量化指标,本文以官方后续公布的模型卡与技术报告为准,不在此转述未核实的数字。

实际体验

可复现的验证步骤:登录 AWS 控制台,在 Bedrock 的模型目录中检索 GLM-5.3(Zhipu / Z.ai),确认目标区域已开放访问后申请模型接入;随后用 Bedrock 的对话或聊天接口发送一段带代码或多步任务的自然语言请求,观察返回结构与工具调用格式是否符合预期。是否能在你所在区域直接开通,以控制台实际显示为准。

项目地址与获取方式

AWS 公告与接入入口:https://aws.amazon.com/blogs/machine-learning/introducing-glm-5-3-on-amazon-bedrock/ 。模型权重在 Hugging Face Hub 的智谱官方仓库发布,自托管请以该仓库说明为准。请通过官方渠道获取,避免安装被篡改的版本。

适合谁用

  • 已经在用 Amazon Bedrock 做生成式 AI 应用、希望增加中文强模型选项的团队。
  • 需要中文编程与长周期智能体能力、又不想自己维护推理集群的产品团队。
  • 关注开放权重、希望云端托管与自部署两条路径都能走的合规团队。
  • 什么人不必用:只做轻量中文问答、且已有固定模型供应商的团队,可继续用现有方案。

常见问题

GLM-5.3 是智谱的哪个模型?

是智谱 AI(Z.ai / Zhipu AI)发布的 GLM-5.3,一个 7530 亿参数的开放权重混合专家模型。公告强调它在编程与长周期智能体任务上的优化。

在国内能直接调用吗?

Amazon Bedrock 的国际区域与中国区域(amazonaws.cn)是两套目录,GLM-5.3 是否在某一区域可用以 AWS 控制台显示为准;国内合规路径请参考 AWS 中国区域页面。

除了 Bedrock,还能怎么用 GLM-5.3?

它是开放权重模型,权重已在 Hugging Face Hub 发布,可以自行下载后在自有硬件上部署,走的是自托管路径而非云端托管。

Bedrock 上调用要花多少钱?

按 AWS 的调用计费规则执行,具体单价随区域与模型版本调整,以 AWS 官方定价页为准,本文不列具体数字。

相关工具与内容

Related
快讯 1 小时前

vLLM 0.31.0 发布:717 次提交、DeepSeek-V4.1-Flash 性能优化与快速重启

开源大模型推理引擎 vLLM 于 2026 年 10 月 5 日发布 v0.31.0,官方 release 显示合入 717 次提交、来自 307 位贡献者。这一版围绕 DeepSeek-V4.1-Flash 的性能优化、快速重启机制 vllm preload、新一代 Model Runner 与投机解码、大规模集群服务以及安全加固展开。

前沿快讯 7 阅读
快讯 1 小时前

Cloudflare 生日周收官:46 项发布聚焦开源、智能体与开发者工具链

Cloudflare 于 2026 年 10 月 5 日发布「Birthday Week 2026」收官总结,盘点本周内集中发布的 46 项更新,主题归纳为开源、后量子安全、AI 智能体与开发者平台升级。其中与 AI 从业者关系最紧的是一组开发者工具与智能体基础设施:新的 cf 命令行、开源的 Forge 生成管线、面向智能体的 Kitesurf 浏览器,以及开放真实用户性能数据的 BEACON 数据集。

前沿快讯 5 阅读

继续阅读:OpenAI 公布欧盟文本溯源方案:水印从研究者切入,逐步扩展到更多场景 · Cloudflare 生日周收官:46 项发布聚焦开源、智能体与开发者工具链

关于本文:本站文章由编辑部独立撰写,评测口径与免责说明见关于我们。想继续找工具,可从分类导航按场景浏览,或回首页搜索。

链接已复制