息壤 API
息壤 API 价格对比适合把 DeepSeek、GLM、Qwen、Kimi、BGE 等 35 款模型放到同一套天翼云 Token 服务里看:从官网入口申请 API key 后,可按量计费接入 OpenAI 兼容 Chat、Embeddings、Reranker、Batch 推理和上下文缓存。这里汇总 ¥0.3/¥0.6 起的百万 tokens 价格、00:00–08:00 优惠时段、缓存命中价、免费额度、RPM/TPM 限速和 Batch 折扣,帮助判断息壤 API 与原厂 API 或编程 Token Plan 哪个更适合后端用量。
息壤 API Token API 核心模型
旗舰推理,V4 Pro 档标准时段刊例输入 ¥12、输出 ¥24/百万 tokens。
V4 Flash 轻量档,输入 ¥1、输出 ¥2/百万 tokens。
智谱 GLM-5.1,≤32K 输入 ¥6、输出 ¥24/百万 tokens(长上下文档更高)。
智谱多模态 GLM4.6V,≤32K 输入 ¥1、输出 ¥3/百万 tokens。
千问 3.5 122B,≤128K 输入 ¥0.8、输出 ¥6.4/百万 tokens。
其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。
息壤 API Token API 套餐 价格对比
Qwen3-8B
入门Qwen3-8B
入门编程 Token Plan 内不可用此按量路线。
DeepSeek-V3.2(旗舰版)
高性价比推荐DeepSeek-V3.2(旗舰版)
高性价比推荐适合主力代码生成与日常工程后端。
GLM-5(正式版)
智谱旗舰GLM-5(正式版)
智谱旗舰DeepSeek-V4-Pro
旗舰推理DeepSeek-V4-Pro
旗舰推理按量 API 与编程 Token Plan 计费体系独立。
注意事项
- DeepSeek-V3.2 缓存命中输入 ¥0.2/百万 tokens(全天);标准时段输入 ¥2、输出 ¥3。
- 批量推理 DeepSeek V3/R1 系列约为在线标准时段 40%(如 V3.1 输入 ¥1.6、输出 ¥6.4/百万 tokens)。
- BGE-m3 / BGE-Reranker-Large 走 Embeddings / Reranker API,仅输入侧计费 ¥0.5/百万 tokens。
- 「其他系列模型」免费额度用尽后不支持 tokens 计费模式;RPM/TPM 限制见模型广场详情。
支持的编程工具
价格与模型数据均来源于厂商官方网站
常见问题
息壤 API 的价格对比和按量计费怎么判断套餐价格?
息壤 API 是按量计费,不是固定订阅套餐价格,入门刊例可从 ¥0.3 输入、¥0.6 输出/百万 tokens 看起。做价格对比时要按模型、输入输出、标准时段、优惠时段和缓存命中价分别算,DeepSeek 模型、GLM 模型、Qwen 模型等价格差异较大。编程 Token Plan 的包月额度与这里的开放 API 后付费分离,后端用量应以官网计费表为准。
息壤 API 的官网入口、购买入口和控制台在哪里?
本页指向天翼云文档中的官方入口,可从官网入口查看 Token 服务价格表、模型说明和 API key 申请流程。实际购买入口、订阅入口和控制台开通路径以天翼云页面为准,不建议使用非官方入口处理账户余额或密钥。若页面跳转到模型广场或控制台,按官方提示完成开通即可。
API key、key 申请和接入配置要注意哪些开放 API 边界?
息壤 API 走 OpenAI 兼容接入,key 申请后用于 Chat API、Embeddings API、Reranker API、Batch 推理和上下文缓存等开放 API 能力。接入配置时要使用常规 API key 与账户余额,不能把编程 Token Plan 的专属 key 或包月额度当作开放 API 按量计费用。自建后端、批处理和检索重排场景都应按 API 文档配置。
息壤 API 有优惠、免费额度、Batch 或缓存折扣吗?
有,文件显示多数模型提供两周免费额度,常见为 50 万 tokens,部分模型有 2500 万或 100 万 tokens,首购后的实际可用规则以官网为准。优惠主要包括 00:00–08:00 对部分 DeepSeek、GLM、Qwen 模型的折扣,Batch 推理对部分 DeepSeek 系列约为在线标准时段 40%。缓存命中价全天一致,不参与优惠时段;年付不是该 API 按量页的主要口径。
额度、限速、使用限制和重置规则怎么看?
免费额度通常从首次使用起按两周窗口计算,优先消耗,用尽后需要手动开通付费;这类重置规则与包月 Token Plan 不同。限速和使用限制按模型设置,文件说明 RPM/TPM 需要到模型广场详情查看。评估 usage limit 与 rate limit 时,要同时看免费额度、账户余额、模型可用性和是否支持 tokens 计费。
息壤 API 支持哪些模型、工具和典型场景能力?
息壤 API 覆盖 DeepSeek 模型、GLM 模型、Qwen 模型、Kimi 模型、MiniMax 模型和 BGE 向量/重排能力,适合对话、推理、代码、视觉理解、Embedding 和 Reranker 场景。工具能力包括 OpenAI 兼容 API、Chat API、Embeddings API、Reranker API、Batch inference 和 Context cache。典型场景是后端服务统一路由多模型、离线批处理、检索增强和需要缓存降本的长上下文调用。