返回全部对比

百川 API

Baichuan4-Air

百川 API 这页围绕价格对比、API key 申请和官网入口,把 Baichuan4-Air ¥0.98/百万 tokens 的合并计费、Baichuan4 旗舰 ¥100/百万 tokens、M3 / M2 输入输出拆分计费放在同一张账里看。它会同时说明 Baichuan-M3-Plus 医疗搜索增强、web_search ¥0.03/次、Assistants API 限时免费、知识库 API、Baichuan-Text-Embedding、优惠与接入配置,方便判断低成本问答、医疗垂类助手、搜索增强或向量化场景该选哪一档计费。

Token API

百川 API Token API 核心模型

Baichuan-M3-PlusBaichuan-M3Baichuan-M2-PlusBaichuan-M2Baichuan4-TurboBaichuan4-AirBaichuan4Baichuan3-TurboBaichuan3-Turbo-128kBaichuan2-TurboBaichuan2-53BBaichuan-Text-Embedding
Baichuan-M3-Plus

医疗垂类 M3 增强版,输入 ¥5、输出 ¥9 / 百万 tokens(32k);对话自动触发医疗搜索 ¥0.03/次。

Baichuan-M3

M3 通用推理,输入 ¥10、输出 ¥30 / 百万 tokens(32k),拆分计费。

Baichuan-M2-Plus

M2 增强版,与 M3 同价(输入 ¥10、输出 ¥30 / 百万 tokens);自动触发医疗搜索。

Baichuan-M2

M2 轻量档,输入 ¥2、输出 ¥20 / 百万 tokens(32k),M 系列输入最低价。

Baichuan4-Turbo

Baichuan4 Turbo,合并计费 ¥15 / 百万 tokens(32k),4 系中间档。

更多模型详情请查看官网

其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。

前往官网

百川 API Token API 套餐 价格对比

Baichuan4-Air

最低合并价推荐
输入价格
¥0.98
输出价格
百万 tokens
用量
Baichuan4-Air 是价格页最低档通用模型,按输入与输出合并后的总 token 统一计费 ¥0.98 / 百万 tokens,32k 上下文,适合大规模日常对话与预算敏感业务。
模型
合并计费意味着 prompt 与 completion 不再分开计价,阅读账单时直接看总 token 消耗乘以单价即可,选型逻辑与输入/输出分开的 M 系列不同。
特点
适合客服、轻量助手、常规问答和需要把单次调用成本压到极低的稳定流量场景;不需要开启搜索增强时可传 with_search_enhance 关闭以省 ¥0.03/次。
适合人群
低成本生产调用、常规问答和预算敏感业务团队

Baichuan-M3-Plus

医疗垂类
输入价格
¥5
输出价格
¥9
用量
Baichuan-M3-Plus 按输入/输出分开计费:输入 ¥5 / 百万 tokens、输出 ¥9 / 百万 tokens,32k 上下文,计费覆盖对话全流程节点产生的 token 总量。
模型
调用过程会自动触发「医疗搜索」并单独计费 ¥0.03/次,实际成本需在模型 token 之外额外计入搜索次数。
特点
适合医疗健康、专业咨询等垂类场景,需要 M 系列推理能力且能接受搜索附加费用的团队。
适合人群
医疗健康垂类、专业咨询与需要 M3-Plus 能力的团队

Baichuan-M2

M2 低价
输入价格
¥2
输出价格
¥20
用量
Baichuan-M2 输入 ¥2 / 百万 tokens、输出 ¥20 / 百万 tokens,32k 上下文,是 M 系列里输入单价最低的拆分计费模型。
模型
输出单价相对输入更高,适合 prompt 较长、生成较短的场景;若输出占比高,应对比合并计费的 Baichuan4-Turbo(¥15/百万 tokens 合并)。
特点
适合需要 M 系列能力、以输入为主且希望控制 prompt 成本的轻量推理与工具调用场景。
适合人群
输入占比高、需要 M2 拆分计费的轻量推理场景

Baichuan4-Turbo

4 系 Turbo
输入价格
¥15
输出价格
百万 tokens
用量
Baichuan4-Turbo 合并计费 ¥15 / 百万 tokens,32k 上下文,介于 Air(¥0.98)与 Baichuan4 旗舰(¥100)之间,是 4 系的高性价比中间档。
模型
合并计费下无需分别估算 prompt 与 completion,适合日常生产里需要比 Air 更强能力、又不必上到 ¥100 档的任务。
特点
适合通用对话、内容生成和需要 Baichuan4 系列能力但预算有限的团队。
适合人群
需要 Baichuan4 系列能力、预算中等的通用生产场景

Baichuan-M3

M3 通用
输入价格
¥10
输出价格
¥30
用量
Baichuan-M3 输入 ¥10 / 百万 tokens、输出 ¥30 / 百万 tokens,32k 上下文;M2-Plus 与 M3 同价,但 M2-Plus 会自动触发医疗搜索。
模型
M 系列通用推理档,比 M3-Plus 单价更高但无强制医疗搜索,适合不需要垂类搜索的通用 Agent 与多轮对话。
特点
选型时若输出 token 占比高,应把输出 ¥30/百万 与合并计费的 Baichuan4(¥100/百万 总 token)做整体对比。
适合人群
需要 M 系列拆分计费的通用推理与 Agent 场景

Baichuan4

4 系旗舰
输入价格
¥100
输出价格
百万 tokens
用量
Baichuan4 合并计费 ¥100 / 百万 tokens,32k 上下文,是价格页 4 系最高档,适合对质量与复杂度要求明显更高的专业任务。
模型
单价显著高于 Air 与 Turbo,应作为关键路径模型使用,而非默认承接全部流量。
特点
适合复杂内容生成、深度分析与对输出质量要求更高的定制化场景。
适合人群
专业高价值场景、复杂内容生成和对输出质量要求更高的团队

注意事项

  • 官方按千 tokens 计价,站内展示已换算为百万 tokens 口径(×1000)。1500 tokens 按 1.5 千 tokens 计费。
  • Baichuan2-53B 分时段:00:00–8:00 为 ¥10/百万 tokens(合并),8:00–24:00 为 ¥20/百万 tokens(合并)。
  • 知识库 API 对 Baichuan-Text-Embedding 与文件存储分别计费(Embedding ¥0.5/百万 tokens,存储 ¥1.5/GB/天,单用户限 5GB)。

支持的编程工具

Open APIWeb SearchAssistants APIKnowledge Base

价格与模型数据均来源于厂商官方网站

常见问题

百川 API 做价格对比时,计费、套餐价格和按量计费怎么区分?百川智能的官网入口、官方入口、购买入口、控制台和订阅入口在哪里确认?百川 API key、key 申请、接入、配置和开放 API 边界是什么?Assistants API、Web Search 和医疗搜索有哪些优惠、免费额度、年付、首购、Batch、缓存或折扣?百川 API 的额度、限速、使用限制、重置、usage limit 和 rate limit 怎么看?百川模型、Web Search、Assistants API 和 Knowledge Base 的工具能力适合哪些场景?

百川 API 做价格对比时,计费、套餐价格和按量计费怎么区分?

百川 API 不是包月订阅页,文件没有列出固定套餐价格,而是开放 API 的按量计费。价格对比时先区分合并计费和输入/输出拆分计费:百川通用模型有 ¥0.98、¥15、¥100/百万 tokens 等合并口径,M 系列则按输入和输出分别计费。若输出占比高,要把输出 token、搜索增强次数和知识库费用一起算,不能只看最低入口价。

百川智能的官网入口、官方入口、购买入口、控制台和订阅入口在哪里确认?

文件记录的购买入口是 platform.baichuan-ai.com/sign_up,官方入口和价格页是 platform.baichuan-ai.com/prices。预算评估先看官网入口的价格页,再到控制台完成账号、API key、余额和用量配置。百川 API 属于按量开放 API,不是 Token Plan 订阅;如果购买入口、订阅入口或控制台展示不一致,以官方页面为准。

百川 API key、key 申请、接入、配置和开放 API 边界是什么?

百川 API key 需要在百川智能平台账号中申请,然后在业务服务里按开放 API 文档接入和配置。百川文本模型、向量模型、Web Search、Assistants API 和 Knowledge Base 都属于开放 API 调用边界,按 token、搜索次数或存储规则计费。它不是专属订阅 key,也没有文件中可混用的 Token Plan 或 Coding Plan;生产接入前应在控制台核对余额、权限和模型可用性。

Assistants API、Web Search 和医疗搜索有哪些优惠、免费额度、年付、首购、Batch、缓存或折扣?

文件明确的优惠是 Assistants API 当前限时免费,是否继续免费以官网为准。Web Search 搜索增强按 ¥0.03/次计费,M 系列部分医疗对话会自动触发医疗搜索并按同样口径收费,不属于免费额度。这里没有列出年付、首购、Batch、缓存专项优惠或其他折扣,实际活动和折扣需要看百川平台账户页与官方公告。

百川 API 的额度、限速、使用限制、重置、usage limit 和 rate limit 怎么看?

文件只明确写到知识库 API 的文件存储额度:单用户限 5GB,存储按 ¥1.5/GB/天计费,向量模型按 ¥0.5/百万 tokens 计费。普通模型调用额度通常受账户余额、token 消耗、控制台策略和模型权限影响,文件没有给出统一限速、usage limit、rate limit 或重置周期。实际使用限制、余额告警和重置规则应以百川控制台为准,不要自行假设固定额度。

百川模型、Web Search、Assistants API 和 Knowledge Base 的工具能力适合哪些场景?

百川模型覆盖通用文本、M 系列垂类推理和向量模型能力,适合低成本问答、医疗健康咨询、专业助手和向量化检索场景。Web Search 工具适合需要搜索增强的实时问答,Assistants API 适合构建对话式助手,Knowledge Base 适合文档问答和企业知识库。若只是常规客服或轻量内容生成,可优先选择低价通用模型;若需要医疗搜索或知识库检索,则要把工具调用和存储费用一起评估。