智谱 GLM API Token API 核心模型
新旗舰文本模型,1M 上下文,Coding 能力开源 SOTA,长程任务执行更稳定;支持思考模式、工具调用与 MCP。
上一代旗舰文本模型,1M 上下文,支持思考模式、工具调用与 MCP;长程任务与 Coding 能力仍处第一梯队。
面向复杂长任务与 Agent 优化的文本基座,1M 上下文,执行连续性好,刊例价略低于 GLM-5.2。
多模态 Coding 基座,支持图像/视频/文件/文本,1M 上下文,适合视觉 Agent 与前端复刻。
高智能主力文本模型,1M 上下文,编程、推理与智能体能力均衡,阶梯定价覆盖多档输入/输出组合。
其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。
智谱 GLM API Token API 套餐 价格对比
GLM-5.2
新旗舰推荐GLM-5.2
新旗舰推荐适合复杂 Agent、长程 Coding、项目级工程交付与需要最强推理能力的生产后端;Coding Plan 内历史 GLM-5.2/GLM-5 调用会自动路由至此模型。
GLM-4.7
高智能主力GLM-4.7
高智能主力Coding Plan 用户日常编码默认主力模型之一,按量 API 用户亦常作为生产默认档。
GLM-4.5-Air
高性价比GLM-4.5-Air
高性价比若业务以短输入、短输出为主,实际账单可长期维持在极低水平。
GLM-5V-Turbo
多模态 CodingGLM-5V-Turbo
多模态 Coding缓存命中输入 ¥1.2/百万 tokens(<32K 档),长多模态会话同样可受益于缓存设计。
GLM-4.7-Flash
免费GLM-4.7-Flash
免费验证通过后应迁移到 GLM-4.7 或 GLM-4.5-Air 等付费档以获得稳定 SLA 与更高并发。
注意事项
- 本页 `entryPrice` 与各 tier 展示价均为最低档代表价,非长上下文最终账单。GLM-5.2:¥8/¥28(缓存命中 ¥2,1M 上下文)。GLM-5.2:<32K 输入 ¥6/¥24(缓存命中 ¥1.3),≥32K 输入 ¥8/¥28(命中 ¥2)。GLM-4.7 另按输出占比分档:<32K 且输出 <20% 为 ¥2/¥8,同输入输出 ≥20% 为 ¥3/¥14,输入 32K–1M 为 ¥4/¥16。GLM-4.5-Air:<32K 低档 ¥0.8/¥2,32K–128K 为 ¥1.2/¥8。单次请求按实际所处档位单价结算。
- GLM-4.7-Flash、GLM-4-Flash-250414、GLM-4.6V-Flash、GLM-4.1V-Thinking-Flash、GLM-4V-Flash、CogView-3-Flash、CogVideoX-Flash 等免费模型仍计入 API 目录;调用须遵守平台速率与公平使用规则。
- 图像生成 GLM-Image ¥0.1/次,CogView-4 ¥0.06/次;视频 CogVideoX-3 ¥1/次。语音 GLM-TTS、GLM-4-Voice 等见定价页语音模型章节。
- Coding Plan 团队版超额按量部分按 API 刊例价 9 折计费,但须使用团队套餐 Key;普通开放平台 API Key 走账户余额实时扣费。
支持的编程工具
价格与模型数据均来源于厂商官方网站
常见问题
智谱 GLM API 的价格对比、计费和套餐价格该怎么看?
智谱 GLM API 不是固定订阅套餐价格,而是开放平台按量计费,文本模型通常按输入/输出 token 分档结算,页面入门价为 CNY 口径的 ¥0.8 / ¥2 每百万 tokens。做价格对比时要同时看长上下文、输出占比、图像/视频按次计费和语音、向量、重排序等独立刊例价。最终计费以官网定价页和实际命中档位为准。
智谱 GLM API 的官网入口、购买入口和控制台在哪里?
智谱 GLM API 的官网入口和官方入口指向 BigModel 开放平台,购买入口通常从 open.bigmodel.cn/pricing 查看价格并进入控制台开通。API 页没有单独订阅入口,开放 API 主要通过账户余额按量扣费。Coding Plan 的订阅入口属于另一套编程套餐,不应和开放平台 API 购买入口混用。
智谱开放 API 的 API key、key 申请和接入配置有什么边界?
开放 API 的 API key 需要在智谱开放平台完成 key 申请,用于后端服务、自动化流水线或 OpenAI/Anthropic 兼容接入。接入时要按开放平台文档配置 base URL、模型名、Function Call、MCP 或上下文缓存等能力。Coding Plan 的专用 Key 属于订阅额度体系,不能替代开放 API key,也不会按普通 API 账户余额实时扣费。
智谱 API 有优惠、免费额度、Batch 或缓存折扣吗?
智谱 API 的优惠主要体现在部分免费模型、Batch API 五折和上下文缓存命中折扣,缓存存储目前标注为限时免费。免费额度和首购活动如果官网有更新,应以官方页面为准;API 页没有写明年付订阅,因为开放 API 不是年付套餐。Batch 适合离线批处理,缓存适合重复 system prompt 或长上下文复用,两类折扣边界不同。
智谱 API 的额度、限速和使用限制如何重置?
开放 API 的额度通常取决于账户余额、模型可用性和平台风控,免费模型也要遵守限速与公平使用限制。usage limit、rate limit、并发和重置规则没有在本文件给出统一数值,生产接入应以控制台与官方文档为准。Coding Plan 的 5 小时或周重置规则不适用于普通开放 API 按量计费。
智谱 GLM 模型、工具和特色能力适合哪些场景?
智谱 GLM 模型覆盖文本模型、图像模型、语音模型、视频模型、推理模型和代码模型,适合对话、Agent、长上下文工程、视觉理解、内容生成和语音客服等场景。工具与能力包括 OpenAI 兼容 API、Anthropic 兼容 API、Function Call、MCP、上下文缓存和 Batch API。需要代码生成可关注 CodeGeeX,需要图像或视频生成可看 CogView、CogVideoX 与 GLM 图像能力。