百川 API 的全系价格摆在明面上:合并计费最便宜的 Baichuan4-Air 只要 ¥0.98/百万 tokens,旗舰 Baichuan4 要 ¥100/百万 tokens,中间还夹着 M 系列按输入输出拆分计费的模型(来源)。百川的计费分两套口径——Baichuan4/3/2 系多数型号按「输入+输出合并后的总 token」统一计价,M 系列(M2/M3)则把输入和输出分开标价。想比价先分清计费口径,别拿合并价和拆分价直接比。以下价格以官方价格页 2026-08-18 为准。
百川 API 价格对比:合并计费和拆分计费是两套口径
百川 API 的价格不能只看一个数字,合并计费看总 token 单价、拆分计费要先估输入输出比例,两套口径的算账方式完全不同。 Baichuan4、Baichuan3、Baichuan2 的多数型号(如 Baichuan4-Air、Baichuan4-Turbo、Baichuan4)按输入+输出合并后的总 token 统一计价,账单直接拿总 token 数乘单价;M 系列(Baichuan-M2/M2-Plus/M3/M3-Plus)把输入和输出分开标价,你得先估出自己的输入输出比例才能算总成本(来源)。
官方按「千 tokens」计价,本文和站内统一换算成百万 tokens 口径(×1000):官方 0.00098 元/千 tokens 就是 ¥0.98/百万 tokens,1500 tokens 按 1.5 千 tokens 计费、不四舍五入。模型调用之外还有三笔附加费用要算进账:开启 web_search 搜索增强每次 ¥0.03,M3-Plus 和 M2-Plus 对话自动触发医疗搜索同样每次 ¥0.03,知识库文件存储按 ¥1.5/GB/天计费(来源)。
| 对比维度 | 合并计费(4/3/2 系) | 拆分计费(M 系列) |
|---|---|---|
| 计价方式 | 输入+输出合并的总 token × 单价 | 输入、输出分别计价 |
| 看账单 | 总 token 消耗 × 单价即可 | 需按输入输出比例估算 |
| 代表模型 | Baichuan4-Air / 4-Turbo / Baichuan4 | Baichuan-M2 / M3 / M3-Plus |
| 适合场景 | 常规问答、客服、内容生成 | 长 prompt、Agent、垂类推理 |
全系模型价格表:¥0.98 到 ¥100 怎么分布
百川全系 12 款模型,价格从 Baichuan4-Air 的 ¥0.98 到旗舰 Baichuan4 的 ¥100(每百万 tokens)跨度超过 100 倍,选型第一步永远是先看计费口径。 合并计费的通用模型按价格从低到高排列如下(来源):
| 模型 | 计费口径 | 合并 ¥/百万 tokens | 上下文 | 备注 |
|---|---|---|---|---|
| Baichuan4-Air | 合并 | 0.98 | 32k | 全系最低通用档,官方标注全新发布 |
| Baichuan2-Turbo | 合并 | 8 | 32k | 兼容旧集成 |
| Baichuan2-53B | 合并 | 10(00:00-8:00)/ 20(8:00-24:00) | 32k | 分时段计价 |
| Baichuan3-Turbo | 合并 | 12 | 32k | 上一代 Turbo |
| Baichuan4-Turbo | 合并 | 15 | 32k | 4 系中间档 |
| Baichuan3-Turbo-128k | 合并 | 24 | 128k | 长上下文,旧 192k 路由至此 |
| Baichuan4 | 合并 | 100 | 32k | 4 系旗舰 |
拆分计费的 M 系列单独一张表(来源):
| 模型 | 输入 ¥/百万 tokens | 输出 ¥/百万 tokens | 上下文 | 备注 |
|---|---|---|---|---|
| Baichuan-M2 | 2 | 20 | 32k | M 系列输入最低价 |
| Baichuan-M3-Plus | 5 | 9 | 32k | 自动触发医疗搜索 ¥0.03/次 |
| Baichuan-M3 | 10 | 30 | 32k | 通用推理 |
| Baichuan-M2-Plus | 10 | 30 | 32k | 与 M3 同价,自动触发医疗搜索 |
工具与附加费用(来源):Baichuan-Text-Embedding 向量模型 ¥0.5/百万 tokens;知识库文件存储 ¥1.5/GB/天、单用户限 5GB;web_search 搜索增强 ¥0.03/次;Assistants API 限时免费。
怎么选:Baichuan4-Air、M3 还是 M2
预算敏感、流量大的日常问答直接上 Baichuan4-Air(¥0.98/百万 tokens 合并计费),长 prompt 短生成看 M2,医疗垂类看 M3-Plus,输出占比高先拿拆分价和 Baichuan4-Turbo 的 ¥15 合并价放一起算。 选型不能只看单价,要结合自己的输入输出比例:M2 输入只要 ¥2 但输出 ¥20,prompt 长、生成短的场景划算;M3-Plus 输入 ¥5、输出 ¥9,贵在自动医疗搜索能力(来源)。
| 你的场景 | 推荐模型 | 计费口径 |
|---|---|---|
| 客服、轻量助手、预算敏感 | Baichuan4-Air | 合并 ¥0.98/百万 tokens |
| 长 prompt、短生成 | Baichuan-M2 | 输入 ¥2 / 输出 ¥20 |
| 医疗健康、专业咨询 | Baichuan-M3-Plus | 输入 ¥5 / 输出 ¥9 + ¥0.03/次医疗搜索 |
| 通用 Agent、多轮对话 | Baichuan-M3 | 输入 ¥10 / 输出 ¥30 |
| 内容生成、深度分析 | Baichuan4 | 合并 ¥100/百万 tokens |
两个小提醒:Baichuan4-Air 不需要搜索结果时,传 with_search_enhance 关闭可以省下每次 ¥0.03 的搜索费;Baichuan2-Turbo-192k 已经下线,旧调用会自动路由到 Baichuan3-Turbo-128k,存量代码不用动。
充值、优惠与官网入口
百川 API 是纯按量计费,官方入口在 platform.baichuan-ai.com/prices,注册后在控制台充值余额、申请 API key 就能调用,没有包月订阅。 钱先充进账户,每次调用按 token 消耗和附加功能自动扣费。官方价格页还保留了注册赠送金说明——2024 年 5 月 22 日后新注册的用户可获赠送金、有效期 3 个月,具体到账金额以你注册时控制台显示为准(来源)。当前能省钱的点主要是 Assistants API 限时免费,以及不需要搜索时关掉 web_search。
想横向对比其他国产模型的价格,可以看看 DeepSeek、通义千问 和 智谱 的对比页。
额度、限速与 API key 接入配置
百川 API 的额度由账户余额决定,官方价格页没有公布统一限速数值,高并发上线前要到控制台确认配额和告警规则。 明确写出来的限制是知识库:单用户限 5GB 存储,超出按 ¥1.5/GB/天继续计费。API key 在百川智能平台控制台申请,文本模型、向量模型、Web Search、Assistants API 和知识库共用同一套 key,各自按对应规则计费;接入按官方开放 API 文档配置即可,这是按量计费的开放接口,不是订阅专属 key。
值不值得:一句话结论
常规问答、客服或预算敏感的稳定流量,Baichuan4-Air 的 ¥0.98/百万 tokens 合并计费几乎没什么可挑的;医疗垂类加钱上 M3-Plus,追求顶级质量再考虑 ¥100 的 Baichuan4。 百川价格体系最大的坑是两套计费口径混着比——合并计费看总 token 单价,拆分计费先估输入输出比例。官方保留调价权利,价格可能变动,比价时把 web_search、医疗搜索等附加费用一并算进去,才是真实的单次成本(来源)。