全球 AI Token Plan 价格对比首页

智谱 GLM Token API 价格对比、充值、优惠和官网入口

智谱 GLM API 价格对比汇总官网入口、优惠和 API key 申请,按 ¥0.8/¥2 起计费查看 GLM-5.3、GLM-5.2、GLM-4.7、GLM-5V-Turbo、CodeGeeX、CogView、CogVideoX、AutoGLM 等模型额度、用量限速、OpenAI/Anthropic 兼容接入、上下文缓存与 Batch API 五折计费规则。

Token APIGLM-5.3

Zhipu Token API 最新动态

分析

智谱 GLM-5.3 API 定价公布:与 Kimi Token Plan 价格对比、充值优惠、官网入口与值不值得

智谱 GLM-5.3 的按量 API 单价在 2026-08-21 正式公布:输入 ¥8/输出 ¥28 每百万 tokens,缓存命中 ¥2,与 GLM-5.2 同价、1M 上下文。本文做一次 GLM-5.3 API 与 Kimi Token Plan 的价格对比:Kimi 会员四档月付 ¥39/¥79/¥159/¥559,按量 API 与订阅套餐形态不同,怎么换算才公平;再讲清充值、优惠(Batch 五折、缓存命中)、官网入口、API key 申请、额度限速和接入配置,最后给出按场景该选 GLM-5.3 按量、GLM Coding Plan 还是 Kimi Token Plan 的选择建议。

以下为 智谱 GLM Token API 的完整价格对比数据,涵盖 6 个套餐档位、核心模型能力、额度用量与官方入口,所有数据均来源于厂商官方网站,帮你快速判断是否值得购买。

数据最后更新

Zhipu Token API 价格对比、核心模型

GLM-5.3GLM-5.2GLM-5.1GLM-5GLM-5-TurboGLM-4.7GLM-4.7-FlashXGLM-4.6GLM-4.5-AirGLM-4.5-AirXGLM-4-LongGLM-4-FlashX-250414GLM-4.7-FlashGLM-4-Flash-250414GLM-4-PlusGLM-4-Air-250414GLM-4-AirXGLM-4-AssistantGLM-5V-TurboGLM-4.6VGLM-4.6V-FlashXGLM-4.5VGLM-OCRAutoGLM-PhoneGLM-4.1V-Thinking-FlashXGLM-4.6V-FlashGLM-4.1V-Thinking-FlashGLM-4V-FlashGLM-4V-Plus-0111GLM-ImageCogView-4CogView-3-FlashCogVideoX-3CogVideoX-2Vidu Q1Vidu 2CogVideoX-FlashGLM-TTSGLM-TTS-CloneGLM-ASR-2512GLM-RealtimeGLM-4-VoiceEmbedding-3Embedding-2CharGLM-4EmohaaCodeGeeX-4Rerank
GLM-5.3

最新旗舰文本模型,2026-08-21 上定价页标注「新品」:一口价 ¥8/¥28(1M 上下文、128K 输出),缓存命中 ¥2、存储限时免费;面向复杂软件工程与长程 Agent,编程体验较前代提升 50%,部分网络安全能力持平 Mythos 5。

GLM-5.2

上代定价页旗舰文本模型,1M 上下文,Coding 能力开源 SOTA,长程任务执行更稳定;支持思考模式、工具调用与 MCP。

GLM-5.1

上一代旗舰文本模型,200K 上下文,阶梯定价 [0,32K) ¥6/¥24、[32K+) ¥8/¥28,缓存命中 ¥1.3-¥2;支持思考模式、工具调用与 MCP,长程任务能力仍属第一梯队。

GLM-5-Turbo

面向复杂长任务与 Agent 优化的文本基座,200K 上下文,执行连续性好,刊例价略低于 GLM-5.2。

GLM-5V-Turbo

多模态 Coding 基座,支持图像/视频/文件/文本,200K 上下文,适合视觉 Agent 与前端复刻。

Zhipu Token API 价格对比、套餐

GLM-5.3
最新旗舰新品推荐
输入价格
¥8
输出价格
¥28
1M 上下文;缓存命中 ¥2(缓存存储限时免费)
用量
GLM-5.3 是面向复杂软件工程与长程 Agent 任务的最新旗舰模型,编程体验较前代提升 50%,部分网络安全能力持平 Mythos 5,并在效果与 Token 利用率之间实现更优平衡。
模型
GLM-5.3 一口价 ¥8/¥28,1M 上下文(最大输出 128K),缓存命中 ¥2、存储限时免费;支持思考模式、流式、Function Call、结构化输出,适合长上下文项目级工程与复杂 Agent。
特点
缓存存储目前限时免费,缓存命中输入只需 ¥2/百万 tokens;长对话、固定 system prompt 与项目级上下文场景应优先设计缓存策略。
定价与 GLM-5.2 相同,是当前开放平台在售的最强旗舰;适合复杂 Agent、长程 Coding、项目级工程交付与需要最强推理能力的生产后端。
适合人群
复杂软件工程、长程 Agent 与项目级工程交付
GLM-5.2
上代旗舰
输入价格
¥8
输出价格
¥28
1M 上下文;缓存命中 ¥2(缓存存储限时免费)
用量
GLM-5.2 是当前定价页旗舰文本模型,1M 上下文可承载项目级工程上下文,Coding 能力开源 SOTA,长程任务执行更稳定、工程规范遵循更可靠。
模型
GLM-5.2 一口价 ¥8/¥28,1M 上下文(最大输出 128K),缓存命中 ¥2、存储限时免费;支持思考模式、流式、Function Call、结构化输出,适合长上下文项目级工程。
特点
缓存存储目前限时免费,缓存命中输入只需 ¥2/百万 tokens;长对话、固定 system prompt 与项目级上下文场景应优先设计缓存策略。
适合复杂 Agent、长程 Coding、项目级工程交付与需要最强推理能力的生产后端;Coding Plan 内的历史 GLM-5.2 调用现已自动切换至 GLM-5.3。
适合人群
长上下文工程、复杂 Agent 与高质量生产后端
GLM-4.7
高智能主力
输入价格
¥2
输出价格
¥8
输入 <32K 且输出 <0.2 · 更长上下文/输出分档加价 · 缓存命中 ¥0.4
用量
GLM-4.7 在通用对话、推理、编程与智能体能力上全面升级,200K 上下文;定价按输入长度与输出占比多档划分,页面 ¥2/¥8 为常见低档代表价。
模型
相比 5.2/5.1 系列刊例价更低,适合高频日常调用、中等复杂度编程与需要稳定性价比的生产流量。
特点
同样支持思考模式、工具调用与缓存;可与 GLM-4.5-Air 搭配做「难任务上 4.7、轻任务下 Air」的路由策略。
Coding Plan 用户日常编码默认主力模型之一,按量 API 用户亦常作为生产默认档。
适合人群
高性价比生产调用、日常编程与通用智能体
GLM-4.5-Air
高性价比
输入价格
¥0.8
输出价格
¥2
输入 <32K 低档 · 缓存命中 ¥0.16 · 长输入最高 ¥1.2/¥8
用量
GLM-4.5-Air 在推理、编码与智能体任务上表现强劲,128K 上下文,是开放平台入门价最低的付费文本模型之一。
模型
按输入长度与输出占比分档,适合轻量问答、批量预处理、分类抽取与成本敏感的高并发接口。
特点
Coding Plan 全档位均可用,按量场景适合作为默认路由或 Flash 之外的稳定低价备选。
若业务以短输入、短输出为主,实际账单可长期维持在极低水平。
适合人群
轻量高频调用、成本敏感接口与批量预处理
GLM-5V-Turbo
多模态 Coding
输入价格
¥5
输出价格
¥22
图片/视频/文件/文本多模态 · 输入 ≥32K 为 ¥7/¥26
用量
GLM-5V-Turbo 是智谱多模态 Agent 基座,兼顾视觉理解与 Coding,200K 上下文,适合视觉编程、UI 复刻与 Agent 工作流。
模型
支持图像、视频、文件与文本输入,按输入长度阶梯计价;复杂视觉推理与前端代码生成场景的首选视觉模型之一。
特点
与纯文本 GLM-5.2/5.1 分工明确:需要看图、看视频再写代码时切 5V,纯文本工程任务用 5.2/4.7 更省。
缓存命中输入 ¥1.2/百万 tokens(<32K 档),长多模态会话同样可受益于缓存设计。
适合人群
视觉编程、UI 理解与多模态 Agent 团队
GLM-4.7-Flash
免费
输入价格
¥0
输出价格
¥0
200K 上下文 · 平台免费模型 · 受速率限制
用量
GLM-4.7-Flash 是 GLM-4.7 基座的普惠免费版,200K 上下文,适合原型验证、教学演示与低频试用。
模型
输入、输出、缓存均为免费,但须遵守平台并发与公平使用策略,不适合无限制生产放量。
特点
与 GLM-4-Flash-250414、GLM-4.6V-Flash 等其它免费模型可按场景能力差异做互补路由。
验证通过后应迁移到 GLM-4.7 或 GLM-4.5-Air 等付费档以获得稳定 SLA 与更高并发。
适合人群
原型验证、学习与低频试用

Zhipu Token API 价格对比、注意事项

  • GLM-5.3 已于 2026-08-21 上开放平台定价页,标注「新品」,一口价 ¥8/¥28(1M 上下文、128K 输出),缓存命中 ¥2、缓存存储限时免费;官方称其面向复杂软件工程与长程 Agent 任务,编程体验较前代提升 50%,部分网络安全能力持平 Mythos 5。
  • 本页 `entryPrice` 与各 tier 展示价均为最低档代表价,非长上下文最终账单。GLM-5.2 一口价 ¥8/¥28(1M 上下文,缓存命中 ¥2)。GLM-5(独立条目)<32K ¥4/¥18,≥32K ¥6/¥22。GLM-4.7 按输入长度和输出占比分档。GLM-4.5-Air:<32K 低档 ¥0.8/¥2。单次请求按实际所处档位单价结算。
  • GLM-4.7-Flash、GLM-4-Flash-250414、GLM-4.6V-Flash、GLM-4.1V-Thinking-Flash、GLM-4V-Flash、CogView-3-Flash、CogVideoX-Flash 等免费模型仍计入 API 目录;调用须遵守平台速率与公平使用规则。
  • 图像生成 GLM-Image ¥0.1/次,CogView-4 ¥0.06/次;视频 CogVideoX-3 ¥1/次。语音 GLM-TTS、GLM-4-Voice 等见定价页语音模型章节。
  • Coding Plan 团队版超额按量部分按 API 刊例价 9 折计费,但须使用团队套餐 Key;普通开放平台 API Key 走账户余额实时扣费。

Zhipu Token API 价格对比、接入配置与工具

OpenAI-compatible APIAnthropic-compatible APIContext CacheBatch APIFunction CallMCP

Zhipu Token API 价格对比、充值、优惠、额度、用量、配置、最新动态

页面发布时间

Zhipu Token API 价格对比、充值、优惠、常见问题

AI Token Plan

全球 AI Token Plan 价格对比

AI Token Plan 不是简单收集厂商链接,而是把 41+ 家国内外 AI 平台与厂商放到同一套对比框架里,覆盖 395+ 款模型资料,以及 Token Plan、Coding Plan、IDE Tools 和大模型 API 等常见套餐形态。

当你想比较 AI 订阅价格、编程套餐额度、API 调用成本或官网优惠入口时,可以在这里同时看到官方价格、套餐档位、用量规则、模型能力和工具接入方式,减少在多个官网之间反复查找的成本。

我们会随着各厂商价格页、套餐页和产品文档的变化持续整理数据,让首页适合作为 AI Token Plan 价格对比入口,也让详情页能进一步说明单个厂商的套餐是否适合个人开发者、团队采购或长期 API 调用。

价格信息来源于各平台官网,可能随时变动,请以官网实际价格为准。

© 2026 AI Token Plan · 保留所有权利 · 网站上线时间于 2026 年 6 月 18 日 · 已运营 64 天 · 站长地图