智谱 GLM 到底怎么收费:GLM Coding Plan 是订阅制按积分扣(个人版 ¥118-¥1078/月),开放平台 API 是按量按 token 实扣(定价页旗舰 GLM-5.2 ¥8/¥28 起步),两者价格逻辑完全不同。 高频编程场景(Claude Code、Cursor 这类工具里重度使用)买订阅,固定月费、额度用完等重置不额外扣钱;低频调用或自建后端服务走按量,Batch 五折、缓存命中降价。这篇用两边各自的最新旗舰——订阅侧 GLM-5.3、按量侧 GLM-5.2——对比两套体系的价格换算、优惠边界和 Key 边界。
两套计费体系:先分清
GLM Coding Plan 是「订阅 + 积分」,开放平台 API 是「按量 + token」,计费单位都不一样。 两套体系的边界:
| 维度 | GLM Coding Plan(订阅) | 开放平台 API(按量) |
|---|---|---|
| 计费单位 | 积分(5h + 周额度) | token(输入/输出单价) |
| 扣费方式 | 额度内免费,耗尽等重置 | 实时扣账户余额 |
| 价格区间 | 个人版 ¥118-¥1078/月 | 按模型单价,无月费 |
| 适用工具 | 官方支持的编程工具(Claude Code、Cursor 等) | 任何 OpenAI/Anthropic 兼容调用 |
| Key 体系 | Coding 专用 Key | 开放平台 API Key |
两套 Key 不互通、额度不共享。订阅的 Key 拿去接后端服务、按量的 Key 拿去配 Claude Code,都属于误用,可能触发风控。
订阅看积分周期,按量看余额;限速规则两边也不同。 Coding Plan 的额度是 5 小时 + 每周双周期,耗尽等重置、不自动扣余额,限速与高峰时段、工具和官方风控策略有关;开放平台 API 的额度就是账户余额、按 token 实时扣,限速与账号等级和累计充值挂钩,免费模型(如 GLM-4.7-Flash)还有公平使用限制。想订阅转按量或反向迁移,重新申请 Key 即可,但已消耗的积分/余额不互通。
价格对比:GLM-5.3 积分 ↔ GLM-5.2 单价
两边各自的最新旗舰:订阅侧是 GLM-5.3(系数 Input 6.9 / Cached 1.7 / Output 24,历史 GLM-5.2/5.1 调用自动切到 GLM-5.3),按量侧定价页旗舰是 GLM-5.2(一口价 ¥8/¥28,缓存命中 ¥2)。 GLM-5.3 的独立 API 单价截至 8 月 18 日尚未公布(来源),所以按量侧以 GLM-5.2 为最新参照,不编造 5.3 的 API 价格。
拿数字粗算一下「Pro 档 ¥538/月」的购买力:Pro 每周 60,000 积分,纯输出场景按 GLM-5.3 系数 24 积分/百万 token,约等于每周 2,500 百万输出 token。同样的量走按量 GLM-5.2,按 ¥28/百万输出 token 算要 ¥70,000/周——这是理想化粗算(非高峰 5 折、缓存命中、Batch 都会让两边数字变化),但量级差摆在那:高频编程订阅是碾压式便宜。
| 对比项 | GLM-5.2(API 按量) | GLM-5.3(Coding Plan 积分) |
|---|---|---|
| 输入 | ¥8 / 百万 token | 6.9 积分 / 百万 token |
| 输出 | ¥28 / 百万 token | 24 积分 / 百万 token |
| 缓存命中 | ¥2 | 1.7 积分 |
| 门槛 | 充多少用多少 | 先付月费,¥118 起 |
想控积分还有低档位:GLM-4.7 在 Coding Plan 侧系数 4.6 / 1.2 / 16,API 侧 ¥2/¥8——GLM-5.3 的积分系数比 GLM-4.7 高约 50%。复杂任务切 5.3、日常编码用低档模型,能显著放慢额度消耗。
什么场景订阅划算、什么场景按量划算
判断标准只有一个:你的用量是不是「编程工具里的高频长链路」。
订阅(Coding Plan)划算的场景:
- 每天在 Claude Code / Cursor / Cline 里重度使用,任务链长、工具调用密集。
- 用量稳定,额度用完等 5 小时或每周重置,不心疼实时扣费。
- 想吃非高峰 5 折烧分 + 包季包年折扣。
按量(开放平台 API)划算的场景:
- 自建后端服务、自动化流水线、批量任务,需要可编程的稳定接口。
- 低频调用,月消耗 token 很少,交月费不划算。
- 想用 Batch API 五折跑离线批处理,或大量复用固定上下文吃缓存命中折扣。
优惠对比:折扣边界不一样
订阅的优惠在「包季包年 + 非高峰抵扣」,API 的优惠在「Batch 五折 + 缓存命中」,两边互不叠加、别混着算。
- Coding Plan:连续包季 8 折、包年 7 折;非高峰时段(周一至周五 14:00-18:00 之外)模型调用按基础积分 50% 抵扣。
- 开放平台 API:Batch API 对支持的文本模型按实时价约五折结算;缓存命中输入大幅降价(GLM-5.2 从 ¥8 降到 ¥2);缓存存储目前限时免费。
注意「非高峰 5 折」和「Batch 五折」是两套体系的规则,不存在叠加。GLM-5.3 的 API 单价目前还没公布(截至 8 月 18 日),按量侧价格对比只能参照定价页旗舰 GLM-5.2 的 ¥8/¥28。
怎么选:三个决策信号
给三个直接结论,对照你的场景。
- 天天在 Claude Code / Cursor 里写代码 → 买 GLM Coding Plan,选哪档按使用强度:Lite 轻度、Pro 高频、Max 重度,旗舰调用优先切 GLM-5.3。
- 自建后端、做自动化、低频调用 → 开放平台 API 按量,用 GLM-5.2(¥8/¥28)或 GLM-4.7(¥2/¥8)控成本。
- 想省极致成本 → 订阅走年付 7 折 + 非高峰 5 折烧分;按量走 Batch 五折 + 缓存命中。两套体系各自的最优解,不存在跨界叠加。
横向比价还可以看 DeepSeek API、Kimi API、火山方舟 这些国内玩家的套餐和 API。智谱的价格在国产第一梯队里属于中上水平,优势是 1M 上下文和 Coding 能力。
风险提示
三个风险点,先记住再上车。
- GLM-5.3 独立 API 单价未公布,按量侧目前以定价页旗舰 GLM-5.2 为参照,官方出价后结论可能变。
- 订阅 Key 用于非支持工具、按量 Key 用于 Coding 工具都属于误用,可能触发风控。
- 免费模型有公平使用限制,生产放量前先压测确认并发承载。