智谱 GLM-5.3 的按量 API 单价在 2026-08-21 正式公布:输入 ¥8、输出 ¥28 每百万 tokens,缓存命中 ¥2,与 GLM-5.2 同价,1M 上下文(来源)。这意味着之前"GLM-5.3 更强但没价"的悬念没了——用 5.2 的钱就能调 5.3。
这篇做一次价格对比:GLM-5.3 API 和用户高频搜的 Kimi Token Plan 到底谁划算,充值、优惠、官网入口、API key、额度限速、接入配置怎么看,以及值不值得现在接。
GLM-5.3 API 定价公布:和 GLM-5.2 一个价
GLM-5.3 上定价页了,一口价输入 ¥8/输出 ¥28 每百万 tokens,缓存命中 ¥2,和 GLM-5.2 完全同价。 官方把它标注为「新品」,1M 上下文、128K 输出,面向复杂软件工程与长程 Agent 任务,编程体验较前代提升 50%,部分网络安全能力持平 Mythos 5(来源)。模型概览里它也是推荐旗舰,编程与智能体能力比肩 Claude Fable 5,长程任务与复杂环境中表现更佳(来源)。
| 模型 | 输入 | 输出 | 缓存命中 | 上下文 |
|---|---|---|---|---|
| GLM-5.3(新品) | ¥8 | ¥28 | ¥2 | 1M |
| GLM-5.2 | ¥8 | ¥28 | ¥2 | 1M |
| GLM-4.7(低档) | ¥2 | ¥8 | ¥0.4 | 200K |
| GLM-4.5-Air(低档) | ¥0.8 | ¥2 | ¥0.16 | 128K |
价格对比的核心结论:GLM-5.3 是"加量不加价",旗舰档位没有溢价。 要便宜就下探 GLM-4.7/4.5-Air,要最强就 GLM-5.3,价格梯度是干净的。官方还说它在效果与 Token 利用率之间做了更优平衡——同一次请求里,它花更少的 token 干同样的活,这属于隐性降价,只有跑真实业务才能感受出来。
和 Kimi Token Plan 的价格对比:按量 vs 订阅,先换算再比
GLM-5.3 API 是按量计费,Kimi Token Plan 是订阅会员,两者不能直接比单价,要按你的月用量换算。 Kimi 会员四档月付:Andante ¥39、Moderato ¥79、Allegretto ¥159、Allegro ¥559,年付分别是 ¥468、¥948、¥1,908、¥6,708(来源)。GLM-5.3 API 按 ¥8/¥28 每百万 tokens 算,1M 输入 + 100K 输出约 ¥10.8。
| 方案 | 月付 | 年付 | 计费形态 | 适合 |
|---|---|---|---|---|
| GLM-5.3 API | 用多少付多少 | 无年付概念 | 按量 | 自建后端、调用量波动大 |
| GLM Coding Plan Lite | ¥118 | ¥991.2 | 订阅(积分池) | 编程工具轻度使用 |
| Kimi Token Plan Andante | ¥39 | ¥468 | 订阅(Agent 额度) | 轻中度会员生态 |
| Kimi Token Plan Allegretto | ¥159 | ¥1,908 | 订阅(4 倍额度) | Agent 多任务 + Kimi Claw |
怎么选的关键是看你的主力使用场景:自建服务调 API,GLM-5.3 按量更灵活;每天泡在编码工具里,Coding Plan 有积分池封顶;想要 Agent 多任务并行、Claw 部署这套订阅生态,才值得上 Kimi Token Plan。按量 API 和订阅套餐各有各的账,别只看谁月付便宜。
算笔账:你的月用量对应多少成本
把用量代进公式,才知道该用按量还是订阅。 GLM-5.3 API 的成本公式很简单:输入 tokens × ¥8/百万 + 输出 tokens × ¥28/百万。下面按几个典型用量档算一笔账(不含缓存命中折价):
| 月用量(输入 + 输出) | GLM-5.3 API 成本 | 对比 Kimi Token Plan |
|---|---|---|
| 1M + 100K | ≈ ¥10.8 | 低于最低档 Andante ¥39 |
| 10M + 1M | ≈ ¥108 | 高于 Andante,低于 Moderato ¥79 上限 |
| 30M + 3M | ≈ ¥324 | 高于 Allegretto ¥159,低于 Allegro ¥559 |
| 80M + 8M | ≈ ¥864 | 超过 Allegro ¥559,订阅明显封顶 |
判断标准:月成本稳定超过 ¥159(Allegretto 档)且你能吃满订阅额度,就转订阅;在 ¥39–¥159 之间徘徊,按量 API 更省心。 注意 Kimi Token Plan 是 Agent 额度池,不是按 token 无限用,重度 Agent 用户可能很快耗尽额度需要加油包;GLM-5.3 API 则不存在额度耗尽,只受余额和限速约束。
充值、优惠和官网入口
开放平台按量计费的入口在 open.bigmodel.cn,充值、建 key、查账单都在控制台,和 Coding Plan 订阅是两套体系。 智谱 GLM API 的官网入口就是 BigModel 开放平台,注册后在控制台充值余额、创建 API key,按 token 消耗×模型单价自动扣费,有赠金优先扣赠金(来源)。
优惠方面两套机制:Batch API 对支持的文本模型按实时价约五折结算,适合离线批量任务——你把非实时任务丢进 Batch,等于直接打了对折;缓存命中输入大幅降价——GLM-5.3 缓存命中 ¥2,只有输入价 ¥8 的四分之一。长对话、固定 system prompt、重复上下文场景,缓存命中率做上去,账单能砍掉一大截。这两个降本机制独立、不叠加。
额度、用量和限速
开放 API 的额度就是账户余额,限速跟账号等级和累计充值挂钩,没有订阅式的额度池重置。 免费模型(如 GLM-4.7-Flash)受公平使用和速率限制,生产放量前先压测确认当前账号的 RPM/TPM 并发承载。GLM Coding Plan 的 5 小时/周积分池重置规则、Kimi Token Plan 的 Agent 额度池,都是订阅体系专属,不适用于开放 API 按量计费。
对个人开发者来说,这反而是优点:按量 API 没有"额度用完了干瞪眼"的时刻,余额在那里,随时能调;订阅则要算准每周期额度,超了就买加油包或等重置,各有各的麻烦。
接入配置和值不值得
接入很简单:GLM-5.3 API 走 OpenAI 兼容接口,把 base_url 换成 open.bigmodel.cn 对应地址、model 填 glm-5.3 就能用。 API key 在控制台创建,配置时确认余额充足。团队协作场景,每个成员用自己的 key,账单按 key 分开核算,谁的调用烧钱一目了然;这与订阅套餐共享一个额度池是完全不同的管理方式。
值不值得的结论很明确,按三类人给建议:
- 自建后端 / 有稳定 API 调用的开发者:直接切 GLM-5.3,价格和 GLM-5.2 一样,能力更强,无脑升级。
- 编程工具重度用户:GLM Coding Plan 积分池更划算,GLM-5.3 已在全模型列表内,复杂节点切 5.3 即可。
- Agent 生态需求(多任务并行、Claw 部署、超长对话):Kimi Token Plan 的订阅生态更完整,但月成本要从 ¥159 起。
最后提醒三点:GLM-5.3 与 GLM-5.2 同价,按量 API 没有换新溢价;按量 vs 订阅先按月用量换算,别直接比单价;API key 余额与 Coding Plan / Kimi 订阅额度互不互通,充值前想清楚走哪条体系。