模型 ID 与接口格式
Z.ai 官方公告的请求示例使用模型 ID glm-5.3,thinking 永远开启,并新增 reasoning_effort 参数(low/high/max)。
GLM-5.3 已于 2026 年 8 月 14 日正式发布,但按 Token 计费的 API 仍在分阶段开放、价格未公布——真正的问题是你什么时候能实际调用它。订阅提醒,EvoLink 验证通路后第一时间通知你。
当 EvoLink 完成可调用的 GLM-5.3 路由、请求模型 ID、实时价格与支持的 API 行为验证后,我们会邮件通知你。
接入开放后我们会第一时间邮件通知你;届时本页会同步更新经过验证的模型 ID、实时价格、接口兼容性、地区与限额,以及通过 EvoLink 统一 API 接入并保留回退模型的方法。
8 月 14 日的发布敲定了部分接入字段,也留下了一些空白。EvoLink 只会在官方公布并完成路由级验证后逐项更新。
Z.ai 官方公告的请求示例使用模型 ID glm-5.3,thinking 永远开启,并新增 reasoning_effort 参数(low/high/max)。
按 Token 价格尚未公布——Z.ai 自己的价格页仍停留在 GLM-5.2。上线后以 EvoLink 实时价格模块为准。
官方文档确认 GLM-5.3 支持 1M Token 上下文窗口和最高 128K 输出 Token。
地区、并发、配额、速率限制和 429 行为需要可调用的生产路由才能验证;目前均未公布。
发布日没有任何聚合平台可以调用 GLM-5.3,BigModel API 页面标注「即将上线」。开源权重承诺在发布约两周后放出。
只有真实 API 路由上的真实工作负载才能回答生产问题。以下六类用户最关心的指标,是 EvoLink 接入开放后要逐项验证的内容;厂商跑分不能替代。
检查缺陷修复、多文件重构和测试任务最终能否真正通过,而不是只看一次回答。
观察参数错误、重复调用、无效循环和需要人工接管的频率。
验证大仓库和长文档深处是否仍能保留约束、定位证据并稳定完成任务。
GLM-5.3 移除了关闭 thinking 的选项。请在每个 reasoning_effort 档位下,对照原有非思考路径实测延迟和输出 Token 开销。
同时关注首 Token 延迟、整体速度、容量、错误率和高峰期 429。
把 Token 消耗、重试、失败和人工修正一起计算,不能只比较标价。
GLM-5.3 目前还无法按 Token 调用,价格也未公布——所以能用 GLM-5.2 上线的项目不应为它推迟。
需要立即交付时,先在有文档、可调用的 GLM-5.2 路由上建立真实基线。
只有当你的工作负载在真实路由上验证出确定的提升时才切换——并注意破坏性变更:thinking 不再可以关闭。
通过 EvoLink 统一 API 保留当前模型,验证通过后再加入 GLM-5.3,无需重写另一套供应商接入。
这是一次分阶段发布:什么已上线、什么还没开放、要不要切换。
按 Token 计费还不行。发布日 GLM-5.3 只能通过 GLM Coding Plan 订阅和 ZCode 使用;Z.ai 价格页没有 glm-5.3 条目,BigModel API 页面标注「即将上线」。
Z.ai 官方公告的 API 示例使用 glm-5.3。写进生产配置前,请对照官方 API 文档再次确认。
未公布。Z.ai 价格页目前仍只列出 GLM-5.2(每百万 Token $1.40/$0.26/$4.40——这是 GLM-5.2 自己的价格)。路由与 SKU 批准后,本页只会使用 EvoLink 的实时价格模块。
尚未完成验证。EvoLink 只在真实请求、计费和行为核验通过后才发布可调用路由、模型 ID 与价格。加入通知即可在开通后第一时间收到消息。
基础模型相同——全部提升来自后训练。已确认的破坏性变更:thinking 不再可以关闭,reasoning_effort(low/high/max)成为新的控制方式。
不支持。GLM-5.3 是纯文本模型;智谱的多模态工作仍在独立的 GLM-V 产品线。
Z.ai 承诺权重在发布约两周后(约 2026 年 8 月 28 日)放出,前提是完成安全评估。许可证尚未公布。
不是——它们是两个独立的模型。GLM 5.5 仍未官宣;如果发布,预计会是更晚的版本,并在它自己的可用性页面追踪。
GLM-5.2——已上线、有定价、1M 上下文,今天就能通过 EvoLink 调用。把模型 ID 做成可配置项,等 GLM-5.3 路由验证通过后,切换只是一次配置变更。
EvoLink 完成 GLM-5.3 路由验证后发送通知:官方发布状态、模型 ID、价格、路由行为与接入状态。