
GLM-5.3 正式发布:API 价格、迁移变化与验证清单
glm-5.3,同一把 API Key 可接 Chat Completions 与 Anthropic Messages。下文的分阶段状态仍作为发布历史保留,但不再代表今天的 API 结论;当前价格与代码请看 GLM-5.3 API 页面。glm-5.3-flash 上线,新增图片、视频和文件输入,并提供显著更低的路由价格。请用 GLM-5.3 Flash 对比 GLM-5.3 判断任务应从高吞吐层开始,还是直接进入纯文本旗舰版。Z.ai 到底官宣了什么
| 项目 | 已确认信息(2026 年 8 月 14 日) |
|---|---|
| 正式名称 / API 模型 ID | GLM-5.3 / glm-5.3(来自 Z.ai 官方 API 示例) |
| 基座模型 | 与 GLM-5.2 相同;提升全部来自后训练 |
| 上下文 / 最大输出 | 1M Token / 128K Token |
| 模态 | 文本输入、文本输出——不支持视觉;发布前被第三方媒体广泛报道的社区诉求没有落地(来源见下文 FAQ) |
| Thinking | 永远开启:thinking.type: "disabled" 不再支持 |
| 推理控制 | 新增 reasoning_effort 参数:low / high / max(编程任务官方推荐 max) |
| 工具能力 | Function Calling、MCP、流式输出、上下文缓存、结构化输出(据官方文档) |
| 参数量 | 未公布(「同基座」的推断 ≠ 官方数字) |
| 定位 | "Built to Code. Ready for Cyber Defense." |
发布之后,接入状态发生了什么变化
GLM-5.3 是一次典型的「官宣、订阅产品、API 与权重并非同日到位」的发布。首发日状态与当前状态已经不同:
| 通道 | 首发日状态 | 2026 年 8 月 26 日当前状态 |
|---|---|---|
| GLM Coding Plan / ZCode | 已上线;Coding Plan 中 5.2/5.1 请求自动路由到 5.3 | 仍可用;订阅积分与按 Token API 应分开比较 |
| Z.ai 国际版 API | 有请求示例,但价格缺失 | 已定价:$1.40 输入 / $0.26 缓存 / $4.40 输出每百万 Token |
| EvoLink 统一 API | 首发日无公开验证路由 | 已配置 glm-5.3;实时价格与代码见模型页 |
| 开源权重 | 承诺安全评估后放出,License 未说明 | 规划自部署前仍需核验当前仓库与 License |

官方跑分怎么看——以及它的前提
| 基准 | GLM-5.3 | GLM-5.2 | 备注 |
|---|---|---|---|
| Terminal Bench 3.0 | 28.3 | 4.6 | 官方称开源模型第一;Claude Fable 5 为 33.7 |
| DeepSWE v1.1 | 66.9 | 46.2 | |
| FrontierSWE | 78.1 | 67.5 | |
| SWE-Marathon v1.1 | 42.5 | 19.4 | |
| CyberGym | 84.5 | 77.2 | 国内官方文档正文写 83.5%——两个官方口径并存 |
| ExploitBench | 54.4 | 24.4 | Z.ai 自己注明闭源模型仍然领先(Mythos 5 为 78) |
| Agents' Last Exam (CLI) | 28.5 | 23.8 | 官方称开源模型第一 |
Z.ai 还报告在其内部私有基准 Code Bench 上「相比 GLM-5.2 提升 50%」,并公开承认 GLM-5.3 在最高档推理下「仍落后于 Claude Fable 5」。发布日 Hacker News 上的开发者反应正好覆盖两极:一边说距离前沿闭源模型「只差一线(only just by a hair)」,一边问「后训练魔法是不是只是在过拟合基准(is post-training magic just overfitting to benchmarks?)」。在第三方评测落地之前,这两句话都值得记住。
GLM-5.3、GLM 5.5、GLM-6——各是什么?
两个月里,围绕 Z.ai 的路线图流传着三个名字。今天发布之后,它们各自的位置是:
- GLM-5.3——7 月以来开发者讨论使用的称呼。今天发布的就是它。
- GLM 5.5——一个独立的分析师 / 媒体标签(摩根大通经路透社传出的预测),常与一个传闻中「参数超万亿」的旗舰绑定。至今仍未官宣——如果它到来,将是更晚的发布,可能是 GLM-5.3 之后的那一款。我们的 GLM 5.5 发布观察继续把它作为独立实体追踪。
- GLM-6——纯粹的猜测线,没有任何官方依据。
传闻期还有一个细节值得收尾:被广泛转发的 GitHub「glm-5.3 分支」地址从来不是发布证据(核验当天页面没有任何提交历史,该仓库随后整体从公开访问中消失)。发布最终照样发生了——通过一篇官方公告,恰好是本追踪页一直建议等待的那种证据。
开发者要注意什么:API 合同变了
公告中确认了两个 API 层面的变化,任何迁移之前都必须知道:
- Thinking 不能再关闭。 GLM-5.2 接受
thinking.type: "disabled";GLM-5.3 不再支持。依赖非思考调用来控制延迟或成本的管线,面对的是一个破坏性变更。 reasoning_effort是新的控制面——low/high/max,编程任务官方推荐max。
Z.ai 官方请求示例:
{
"model": "glm-5.3",
"thinking": { "type": "enabled" },
"reasoning_effort": "max"
}今天如何使用 GLM-5.3
现在有两类购买路径:积分制编程订阅与按 Token API,不应直接比较两者的表面计费单位。
| 你的情况 | 今天的现实选项 | 需要盯什么 |
|---|---|---|
| 在用 Claude Code / OpenCode / 编程 Agent | GLM Coding Plan 订阅(最低 $18/月,按点数计额度;GLM-5.3 按系列内最高点数倍率计费) | 非高峰时段按 50% 点数计费 |
| 通过 API 按 Token 计费 | 通过 EvoLink GLM-5.3 页面调用 glm-5.3;常规任务可从 reasoning_effort: "low" 起测 | 每个可用任务成本、缓存命中、输出 Token 增幅 |
| 想自部署 | 等权重(约 8 月 28 日)和许可证条款 | Hugging Face zai-org 组织;许可证不保证沿用 GLM-5.2 的条款 |
| 需要视觉能力 | GLM-5.3 没有;请走多模态路由 | GLM-V 产品线是否与主线 GLM 合并 |
EvoLink 现已把 GLM-5.3 接入统一网关,可与其他模型选择共用一把 Key。请把模型 ID 留在配置里,在自己的请求上验证流式、工具与计费行为,并保留经过测试的回退路由;可调用不等于已经通过你的业务验收。
目前还不知道什么
即使价格已公布,仍有几项与生产直接相关的事实需要继续核验:
- 限流与并发。 没有公布任何 RPM / TPM 数字。
- 开源权重许可证。 GLM-5.2 是 MIT 式许可;Kimi 和 Qwen 近期都转向了受限许可,社区正在观察 Z.ai 是否跟进。两周安全评审也意味着条款可能不同。
- 参数量。 「与 GLM-5.2 同基座」引人推断,但 Z.ai 没有公布数字。
- 独立评测。 发布日所有数字都是官方口径。
会触发我们下一次更新的信号
- GLM-5.3 权重出现在 huggingface.co/zai-org,并附明确 License。
- 官方给出生产限流与并发指导。
- 独立、同 Harness 的第三方评测复现或挑战官方跑分。
- Z.ai 或 EvoLink 的价格、API 契约发生实质变化。
常见问题
GLM-5.3 上线了吗?
上线了。Z.ai 于 2026 年 8 月 14 日正式官宣 GLM-5.3。首发日是订阅优先,按 Token API 价格现已公布。
现在到底怎么用 GLM-5.3?
glm-5.3,也可以使用 GLM Coding Plan 或 ZCode。前者按 Token 计费,后两者按订阅规则计费。GLM-5.3 API 什么时候开放、多少钱?
GLM-5.3 的模型 ID 是什么?
glm-5.3。官方示例与 EvoLink 路由使用同一个公共模型 ID。「同一基座、提升全部来自后训练」是什么意思?
Z.ai 没有预训练新模型。GLM-5.3 是 GLM-5.2 的基座网络加上大幅扩展的后训练(微调、强化学习及相关阶段)。这就是没有新参数量的原因——也是部分开发者质疑基准涨幅能否泛化的原因。
GLM-5.3 和 GLM-5.2 参数量一样吗?
按同基座推断大概率一样——但 Z.ai 没有为 GLM-5.3 公布参数量,任何数字都不应当作官方规格。
GLM-5.3 支持视觉 / 识图吗?
GLM-5.3 什么时候开源、用什么许可证?
Z.ai 承诺权重在发布约两周后(约 2026 年 8 月 28 日)放出,前提是完成安全评估与加固。许可证尚未说明——不要假设 GLM-5.2 的条款会沿用。
这就是 GLM 5.5 吗?
官方跑分可信吗?
它们是 Z.ai 自己报告的结果,其中包含 GLM-5.3 落后于闭源模型的对比——就坦诚度而言是加分项。但目前没有独立复现,且 CyberGym 一项在不同官方文档中同时出现 84.5 和 83.5 两个数字。在第三方测试出现之前,请当作厂商口径对待。
把 GLM-5.2 的接入迁到 GLM-5.3 会踩什么坑?
reasoning_effort 成为新的控制旋钮。完整迁移清单见 GLM-5.3 对比 GLM-5.2。现在要不要从 GLM-5.2 切换过去?
glm-5.3 开一条受控挑战者通道,删除 thinking.type: "disabled",比较每个可用任务成本,并把 GLM-5.2 保留为回退路线。参考来源与更新记录
- Z.ai——GLM-5.3 官方公告
- BigModel——GLM-5.3 模型文档
- Z.ai——GLM-5.3 官方价格
- Z.ai——GLM Coding Plan / devpack 文档
- Hacker News——发布日讨论
- Unite.AI——发布报道
- Hugging Face——zai-org(暂无 GLM-5.3 权重)
glm-5.3,并提供当前价格、双协议、迁移检查与代码示例。所有“当前 API 不可用”的表述已撤下;首发日状态仅作为日期化历史保留。glm-5.3 模型 ID(据官方示例)、1M / 128K 限制、纯文本模态、永远开启的 thinking 与 reasoning_effort、官方口径基准表、Coding Plan 可用且从 GLM-5.2 / 5.1 自动路由、约两周的开源权重时间表。在当时仍未公布:按 Token 价格、API 开放日期、限流、许可证、参数量、独立评测。

