百川 API
百川 API 这页围绕价格对比、API key 申请和官网入口,把 Baichuan4-Air ¥0.98/百万 tokens 的合并计费、Baichuan4 旗舰 ¥100/百万 tokens、M3 / M2 输入输出拆分计费放在同一张账里看。它会同时说明 Baichuan-M3-Plus 医疗搜索增强、web_search ¥0.03/次、Assistants API 限时免费、知识库 API、Baichuan-Text-Embedding、优惠与接入配置,方便判断低成本问答、医疗垂类助手、搜索增强或向量化场景该选哪一档计费。
百川 API Token API 核心模型
医疗垂类 M3 增强版,输入 ¥5、输出 ¥9 / 百万 tokens(32k);对话自动触发医疗搜索 ¥0.03/次。
M3 通用推理,输入 ¥10、输出 ¥30 / 百万 tokens(32k),拆分计费。
M2 增强版,与 M3 同价(输入 ¥10、输出 ¥30 / 百万 tokens);自动触发医疗搜索。
M2 轻量档,输入 ¥2、输出 ¥20 / 百万 tokens(32k),M 系列输入最低价。
Baichuan4 Turbo,合并计费 ¥15 / 百万 tokens(32k),4 系中间档。
其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。
百川 API Token API 套餐 价格对比
Baichuan4-Air
最低合并价推荐Baichuan4-Air
最低合并价推荐Baichuan-M3-Plus
医疗垂类Baichuan-M3-Plus
医疗垂类Baichuan-M2
M2 低价Baichuan-M2
M2 低价Baichuan4-Turbo
4 系 TurboBaichuan4-Turbo
4 系 TurboBaichuan-M3
M3 通用Baichuan-M3
M3 通用Baichuan4
4 系旗舰Baichuan4
4 系旗舰注意事项
- 官方按千 tokens 计价,站内展示已换算为百万 tokens 口径(×1000)。1500 tokens 按 1.5 千 tokens 计费。
- Baichuan2-53B 分时段:00:00–8:00 为 ¥10/百万 tokens(合并),8:00–24:00 为 ¥20/百万 tokens(合并)。
- 知识库 API 对 Baichuan-Text-Embedding 与文件存储分别计费(Embedding ¥0.5/百万 tokens,存储 ¥1.5/GB/天,单用户限 5GB)。
支持的编程工具
价格与模型数据均来源于厂商官方网站
常见问题
百川 API 做价格对比时,计费、套餐价格和按量计费怎么区分?
百川 API 不是包月订阅页,文件没有列出固定套餐价格,而是开放 API 的按量计费。价格对比时先区分合并计费和输入/输出拆分计费:百川通用模型有 ¥0.98、¥15、¥100/百万 tokens 等合并口径,M 系列则按输入和输出分别计费。若输出占比高,要把输出 token、搜索增强次数和知识库费用一起算,不能只看最低入口价。
百川智能的官网入口、官方入口、购买入口、控制台和订阅入口在哪里确认?
文件记录的购买入口是 platform.baichuan-ai.com/sign_up,官方入口和价格页是 platform.baichuan-ai.com/prices。预算评估先看官网入口的价格页,再到控制台完成账号、API key、余额和用量配置。百川 API 属于按量开放 API,不是 Token Plan 订阅;如果购买入口、订阅入口或控制台展示不一致,以官方页面为准。
百川 API key、key 申请、接入、配置和开放 API 边界是什么?
百川 API key 需要在百川智能平台账号中申请,然后在业务服务里按开放 API 文档接入和配置。百川文本模型、向量模型、Web Search、Assistants API 和 Knowledge Base 都属于开放 API 调用边界,按 token、搜索次数或存储规则计费。它不是专属订阅 key,也没有文件中可混用的 Token Plan 或 Coding Plan;生产接入前应在控制台核对余额、权限和模型可用性。
Assistants API、Web Search 和医疗搜索有哪些优惠、免费额度、年付、首购、Batch、缓存或折扣?
文件明确的优惠是 Assistants API 当前限时免费,是否继续免费以官网为准。Web Search 搜索增强按 ¥0.03/次计费,M 系列部分医疗对话会自动触发医疗搜索并按同样口径收费,不属于免费额度。这里没有列出年付、首购、Batch、缓存专项优惠或其他折扣,实际活动和折扣需要看百川平台账户页与官方公告。
百川 API 的额度、限速、使用限制、重置、usage limit 和 rate limit 怎么看?
文件只明确写到知识库 API 的文件存储额度:单用户限 5GB,存储按 ¥1.5/GB/天计费,向量模型按 ¥0.5/百万 tokens 计费。普通模型调用额度通常受账户余额、token 消耗、控制台策略和模型权限影响,文件没有给出统一限速、usage limit、rate limit 或重置周期。实际使用限制、余额告警和重置规则应以百川控制台为准,不要自行假设固定额度。
百川模型、Web Search、Assistants API 和 Knowledge Base 的工具能力适合哪些场景?
百川模型覆盖通用文本、M 系列垂类推理和向量模型能力,适合低成本问答、医疗健康咨询、专业助手和向量化检索场景。Web Search 工具适合需要搜索增强的实时问答,Assistants API 适合构建对话式助手,Knowledge Base 适合文档问答和企业知识库。若只是常规客服或轻量内容生成,可优先选择低价通用模型;若需要医疗搜索或知识库检索,则要把工具调用和存储费用一起评估。