GLM-5.3 正式开放 API:输入1.4美元/百万token,输出4.4美元/百万token
z.ai 推出 GLM-5.3 开源大模型 API,定价与前代持平(1.4/4.4 美元/百万 token),显著低于 GPT-5.6 Sol、Claude Opus 5 等高端模型;Artificial Analysis 测得其智能指数达60分,与 Kimi K3 并列开源模型榜首。

在 上周惊艳亮相之后 ,凭借其先进的网络能力——据报道甚至发现了 Cursor 中此前未被发现的漏洞——中国初创公司 z.ai 推出的新一代开源语言模型 GLM-5.3 已 正式上线应用编程接口(API) ,使开发者能够基于该模型进行构建,并将其集成至自身的智能体(agents)和应用程序中。
此前订阅 GLM 编程计划(GLM Coding Plan)的开发者目前仅限使用与 OpenAI Chat Completions 兼容的协议。z.ai 表示计划将该模型的权重公开发布,但具体日期及许可证类型尚未公布。
在 API 方面,定价与 GLM-5.2 保持一致:每百万输入 token 收费 1.40 美元,每百万输出 token 收费 4.40 美元。缓存输入(cached input)费用为每百万 token 0.26 美元,而 z.ai 目前将缓存输入存储列为限时免费。
这意味着,即使该公司声称新版本在编程能力与长周期智能体(long-horizon agent)性能方面均有显著提升,开发者仍可迁移到这一新一代模型,而无需承担 z.ai 更高的标称每 token 费率。 按此费率,GLM-5.3 的价格远低于多个高端前沿 API。
模型 | 输入(美元/百万) | 输出(美元/百万) | 总计(美元/百万) | 来源 |
0.10 美元 | 0.20 美元 | 0.30 美元 | ||
MiMo-V2.5 Flash | 0.10 美元 | 0.30 美元 | 0.40 美元 | |
DeepSeek-V4-Flash — 非高峰时段 | 0.22 美元 | 0.66 美元 | 0.88 美元 | |
GPT-5.6 Luna | 0.20 美元 | 1.20 美元 | 1.40 美元 | |
MiniMax-M3 | 0.30 美元 | 1.20 美元 | 1.50 美元 | |
LongCat-2.0 — 限时促销 | 0.30 美元 | 1.20 美元 | 1.50 美元 | |
DeepSeek-V4-Flash — 高峰时段 | 0.44 美元 | 1.32 美元 | 1.76美元 | |
MiMo-V2.5 | 0.40美元 | 2.00美元 | 2.40美元 | |
DeepSeek-V4-Pro — 非高峰时段 | 0.66美元 | 1.98美元 | 2.64美元 | |
LongCat-2.0 — 标准版 | 0.75美元 | 2.95美元 | 3.70美元 | |
MiMo-V2.5 Pro(≤256K) | 1.00美元 | 3.00美元 | 4.00美元 | |
Gemini 3.6 Flash — 至2026年12月31日 | 0.75美元 | 3.75美元 | 4.50美元 | |
Gemini 3.7 Flash — 至2026年12月31日 | 0.75美元 | 3.75美元 | 4.50美元 | |
DeepSeek-V4-Pro — 高峰时段 | 1.32美元 | 3.96美元 | 5.28美元 | |
Muse Spark 1.1 / 1.2 | 1.25美元 | 4.25美元 | 5.50美元 | |
GLM-5.3 | 1.40美元 | 4.40美元 | 5.80美元 | |
Grok 4.6 — 提示词(prompt tokens)少于200K | 2.00美元 | 6.00美元 | 8.00美元 | |
MiMo-V2.5 Pro(>256K) | 2.00美元 | 6.00美元 | 8.00美元 | |
Qwen3.8-Max | 2.00美元 | 6.00美元 | 8.00美元 | |
Gemini 3.6 Flash——自2027年1月1日起生效 | 1.50美元 | 7.50美元 | 9.00美元 | |
Gemini 3.7 Flash——自2027年1月1日起生效 | 1.50美元 | 7.50美元 | 9.00美元 | |
GPT-5.6 Terra | 2.00美元 | 12.00美元 | 14.00美元 | |
Grok 4.6——输入提示词数量≥200K | 4.00美元 | 12.00美元 | 16.00美元 | |
GPT-5.4 | 2.50美元 | 15.00美元 | 17.50美元 | |
Kimi K3 | 3.00美元 | 15.00美元 | 18.00美元 | |
Claude Opus 5 | 5.00美元 | 25.00美元 | 30.00美元 | |
Sakana Fugu Ultra(≤272K) | 5.00美元 | 30.00美元 | 35.00美元 | |
GPT-5.6 Sol — 标准模式 | 5.00美元 | 30.00美元 | 35.00美元 | |
Claude Fable 5 / Claude Mythos 5 | 10.00美元 | 50.00美元 | 60.00美元 | |
GPT-5.6 Sol — 快速模式 | 10.00美元 | 60.00美元 | 70.00美元 |
根据VentureBeat对一百万输入token加一百万输出token的简单对比,GLM-5.3费用为5.80美元,而 Grok 4.6 在其较低上下文速率下为8美元, Kimi K3 为18美元, Claude Opus 5 为30美元, GPT-5.6 Sol为35美元。
这并非工作负载成本估算——实际账单高度依赖于输入/输出比例、缓存及token消耗量——但它使各API价格层级的相对关系一目了然。
GLM-5.3并非当前可用的最廉价高性能模型。谷歌目前为Gemini 3.7 Flash提供的入门价为:截至2026年12月31日,每百万输入token收费0.75美元,每百万输出token收费3.75美元;而OpenAI的GPT-5.6 Luna定价为每百万输入token 0.20美元、每百万输出token 1.20美元。
尽管如此,Z.ai为GLM-5.3设定的价格,使其明显低于那些它正日益被用作基准测试对象的高端前沿模型的成本区间。
在最新独立测试结果发布后,这一对比变得更具现实意义。 Artificial Analysis在其智能指数(Intelligence Index)上给予GLM-5.3 60分,与Kimi K3并列全球表现最佳的开源权重模型,并比GLM-5.2高出7分。
其分析还估算GLM-5.3每项智能指数任务成本约为0.68美元,而GLM-5.2约为0.44美元,尽管二者API token单价完全相同。
这一差异凸显了 headline API 定价中一项重要注意事项:Artificial Analysis发现GLM-5.3比其前代模型更冗长,因此统一的每token费率并不必然意味着完成同一工作负载的实际成本保持不变。
不过对开发者而言,即时变化十分明确:GLM-5.3现已可通过Z.ai的API调用,费率与GLM-5.2相同,均为每百万token 1.40美元(输入)/4.40美元(输出),为团队提供了另一款相对低成本的选项,用于测试前沿级编程与智能体(agent)工作负载。
JOTO 企业落地观察
- 对企业部署而言,GLM-5.3 在保持与 GLM-5.2 相同 API 单价前提下,智能指数提升7分且编程与长周期智能体性能增强,意味着企业可在不增加账单成本的前提下升级模型能力,但需注意其冗长输出特性可能推高实际 token 消耗。
- 对智能体工程而言,该模型已支持 OpenAI Chat Completions 兼容协议,开发者可低门槛迁移至 GLM-5.3 构建 agent,尤其适用于需强代码理解与多步推理的编程智能体场景,但需重新评估缓存策略与输出截断逻辑以应对更高冗余率。
- 对 AI 安全治理而言,GLM-5.3 曾在 Cursor 中发现未公开漏洞,表明其具备较强代码审计潜力,但 z.ai 尚未公布模型权重与许可证,企业若用于安全敏感场景(如内部代码扫描),需审慎评估黑盒 API 的可控性与合规风险。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询
想把这些做法用到你的业务里?
留下你的场景和痛点,我们帮你判断从哪一步开始。
联系我们


