返回全部对比

息壤 API

DeepSeek-V3.2

息壤 API 价格对比适合把 DeepSeek、GLM、Qwen、Kimi、BGE 等 35 款模型放到同一套天翼云 Token 服务里看:从官网入口申请 API key 后,可按量计费接入 OpenAI 兼容 Chat、Embeddings、Reranker、Batch 推理和上下文缓存。这里汇总 ¥0.3/¥0.6 起的百万 tokens 价格、00:00–08:00 优惠时段、缓存命中价、免费额度、RPM/TPM 限速和 Batch 折扣,帮助判断息壤 API 与原厂 API 或编程 Token Plan 哪个更适合后端用量。

Token API
订阅套餐Token API

息壤 API Token API 核心模型

DeepSeek-V4-ProDeepSeek-V4-FlashGLM-5.1GLM4.6VQwen3.5-122B-A10BQwen3.5-35B-A3BQwen3-Next-80B-A3B-InstructQwen3-VL-235B-A22B-InstructKimi-K2.5Minimax-M2.5Qwen3.5-397B-A17B(正式版)GLM-5(正式版)DeepSeek-V3.2(旗舰版)DeepSeek-V3.1DeepSeek-R1-0528DeepSeek-R1DeepSeek-V3DeepSeek-V3-0324DeepSeek-R1-Distill-Llama-70BDeepSeek-R1-Distill-Qwen-32BQwen3-VL-30B-A3B-InstructQwen3-Coder-480B-A35B-InstructQwen3-235B-A22B-Instruct-2507Qwen3-235B-A22BQwen3-30B-A3BQwen3-32BQwen3-14BQwen3-8BQwen3-4BQwen2.5-72B-InstructQwen2.5-VL-72B-InstructQwen-VL-ChatBGE-m3BGE-Reranker-LargeKimi-K2-Instruct
DeepSeek-V4-Pro

旗舰推理,V4 Pro 档标准时段刊例输入 ¥12、输出 ¥24/百万 tokens。

DeepSeek-V4-Flash

V4 Flash 轻量档,输入 ¥1、输出 ¥2/百万 tokens。

GLM-5.1

智谱 GLM-5.1,≤32K 输入 ¥6、输出 ¥24/百万 tokens(长上下文档更高)。

GLM4.6V

智谱多模态 GLM4.6V,≤32K 输入 ¥1、输出 ¥3/百万 tokens。

Qwen3.5-122B-A10B

千问 3.5 122B,≤128K 输入 ¥0.8、输出 ¥6.4/百万 tokens。

更多模型详情请查看官网

其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。

前往官网

息壤 API Token API 套餐 价格对比

Qwen3-8B

入门
输入价格
¥0.3
输出价格
¥0.6
用量
Qwen3-8B 为在线推理语言模型最低刊例档之一,适合轻量对话与成本敏感的后端路由。
模型
首次使用可享 50 万 tokens 免费额度(两周),用尽后需开通付费。
特点
复杂推理应路由到 DeepSeek-R1 或 GLM-5 等更高档。
编程 Token Plan 内不可用此按量路线。
适合人群
轻量应用、试用与低成本路由

DeepSeek-V3.2(旗舰版)

高性价比推荐
输入价格
¥2
输出价格
¥3
用量
DeepSeek-V3.2 旗舰版标准时段输入 ¥2、输出 ¥3/百万 tokens,也是编程 Token Plan 支持模型之一。
模型
开启上下文缓存后输入命中 ¥0.2/百万 tokens,全天有效。
特点
00:00–08:00 优惠时段输入 ¥1、输出 ¥1.5/百万 tokens。
适合主力代码生成与日常工程后端。
适合人群
主力开发、代码生成与工程后端

GLM-5(正式版)

智谱旗舰
输入价格
¥4
输出价格
¥18
用量
GLM-5 正式版 ≤32K 输入 ¥4、输出 ¥18/百万 tokens;32K–200K 长上下文档更高。
模型
编程 Token Plan 五档套餐均支持 GLM-5(正式版)与 DeepSeek-V3.2(旗舰版)切换。
特点
复杂 Agent 与长程任务可优先选 GLM-5.1(刊例输入 ¥6 起)。
优惠
00:00–08:00 优惠时段 ≤32K 输入 ¥2、输出 ¥9。
适合人群
复杂推理、Agent 与长上下文

DeepSeek-V4-Pro

旗舰推理
输入价格
¥12
输出价格
¥24
用量
DeepSeek-V4-Pro 输入 ¥12、输出 ¥24/百万 tokens,面向最高复杂度推理任务。
模型
首次使用 50 万 tokens 免费(两周)。
特点
与 V4-Flash(¥1/¥2)形成高低搭配。
按量 API 与编程 Token Plan 计费体系独立。
适合人群
高难度推理与旗舰任务

注意事项

  • DeepSeek-V3.2 缓存命中输入 ¥0.2/百万 tokens(全天);标准时段输入 ¥2、输出 ¥3。
  • 批量推理 DeepSeek V3/R1 系列约为在线标准时段 40%(如 V3.1 输入 ¥1.6、输出 ¥6.4/百万 tokens)。
  • BGE-m3 / BGE-Reranker-Large 走 Embeddings / Reranker API,仅输入侧计费 ¥0.5/百万 tokens。
  • 「其他系列模型」免费额度用尽后不支持 tokens 计费模式;RPM/TPM 限制见模型广场详情。

支持的编程工具

OpenAI-compatible APIChat APIEmbeddings APIReranker APIBatch inferenceContext cache

价格与模型数据均来源于厂商官方网站

常见问题

息壤 API 的价格对比和按量计费怎么判断套餐价格?息壤 API 的官网入口、购买入口和控制台在哪里?API key、key 申请和接入配置要注意哪些开放 API 边界?息壤 API 有优惠、免费额度、Batch 或缓存折扣吗?额度、限速、使用限制和重置规则怎么看?息壤 API 支持哪些模型、工具和典型场景能力?

息壤 API 的价格对比和按量计费怎么判断套餐价格?

息壤 API 是按量计费,不是固定订阅套餐价格,入门刊例可从 ¥0.3 输入、¥0.6 输出/百万 tokens 看起。做价格对比时要按模型、输入输出、标准时段、优惠时段和缓存命中价分别算,DeepSeek 模型、GLM 模型、Qwen 模型等价格差异较大。编程 Token Plan 的包月额度与这里的开放 API 后付费分离,后端用量应以官网计费表为准。

息壤 API 的官网入口、购买入口和控制台在哪里?

本页指向天翼云文档中的官方入口,可从官网入口查看 Token 服务价格表、模型说明和 API key 申请流程。实际购买入口、订阅入口和控制台开通路径以天翼云页面为准,不建议使用非官方入口处理账户余额或密钥。若页面跳转到模型广场或控制台,按官方提示完成开通即可。

API key、key 申请和接入配置要注意哪些开放 API 边界?

息壤 API 走 OpenAI 兼容接入,key 申请后用于 Chat API、Embeddings API、Reranker API、Batch 推理和上下文缓存等开放 API 能力。接入配置时要使用常规 API key 与账户余额,不能把编程 Token Plan 的专属 key 或包月额度当作开放 API 按量计费用。自建后端、批处理和检索重排场景都应按 API 文档配置。

息壤 API 有优惠、免费额度、Batch 或缓存折扣吗?

有,文件显示多数模型提供两周免费额度,常见为 50 万 tokens,部分模型有 2500 万或 100 万 tokens,首购后的实际可用规则以官网为准。优惠主要包括 00:00–08:00 对部分 DeepSeek、GLM、Qwen 模型的折扣,Batch 推理对部分 DeepSeek 系列约为在线标准时段 40%。缓存命中价全天一致,不参与优惠时段;年付不是该 API 按量页的主要口径。

额度、限速、使用限制和重置规则怎么看?

免费额度通常从首次使用起按两周窗口计算,优先消耗,用尽后需要手动开通付费;这类重置规则与包月 Token Plan 不同。限速和使用限制按模型设置,文件说明 RPM/TPM 需要到模型广场详情查看。评估 usage limit 与 rate limit 时,要同时看免费额度、账户余额、模型可用性和是否支持 tokens 计费。

息壤 API 支持哪些模型、工具和典型场景能力?

息壤 API 覆盖 DeepSeek 模型、GLM 模型、Qwen 模型、Kimi 模型、MiniMax 模型和 BGE 向量/重排能力,适合对话、推理、代码、视觉理解、Embedding 和 Reranker 场景。工具能力包括 OpenAI 兼容 API、Chat API、Embeddings API、Reranker API、Batch inference 和 Context cache。典型场景是后端服务统一路由多模型、离线批处理、检索增强和需要缓存降本的长上下文调用。