文心 API
文心 API 这页用于对比百度千帆官网 API 价格、优惠和 API key 申请口径:ERNIE 5.1、ERNIE 5.0、ERNIE X1、Turbo、Lite Pro、Qianfan 视觉 / OCR 从 ¥0.2/¥0.4 每百万 tokens 起,但长上下文、图像、OCR、搜索增强和量包不按同一单位计费。这里会把 OpenAI / Anthropic 兼容接口、¥0.004/次联网搜索、Prompt 缓存命中价、Batch 推理折扣、预购量包、限速和 Coding Plan 专属 Key 边界放在一起,避免把普通 API 余额与编程订阅额度混用。
文心 API Token API 核心模型
文心 5.1 旗舰,128K 上下文;输入 ¥4、输出 ¥18/百万 tokens(≤32K 输入档),适合复杂 Agent 与中文场景。
文心 5.0 原生全模态旗舰;输入 ¥6、输出 ¥24/百万 tokens,支持文本/图像/音频/视频联合建模。
文心 5.0 思考预览版,输出含思维链;按 token 计费,适合需要可见推理链路的任务。
文心 5.0 思考最新版,与 Preview 同价档;适合复杂推理与 Agent 决策节点。
文心 5.0 思考实验版,定价与 5.0 思考系列一致;实验能力以控制台可用性为准。
其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。
文心 API Token API 套餐 价格对比
ERNIE-Lite-Pro-128K
最低刊例ERNIE-Lite-Pro-128K
最低刊例ERNIE-4.5-Turbo
主流主力推荐ERNIE-4.5-Turbo
主流主力推荐ERNIE-5.1
最新旗舰ERNIE-5.1
最新旗舰ERNIE-5.0
全模态旗舰ERNIE-5.0
全模态旗舰注意事项
- 官方定价按千 token 展示,站内统一换算为百万 token 口径便于横向比较;ERNIE 5.0/5.1 长上下文(>32K 输入)有更高单价档。
- Turbo 系列支持缓存命中(输入 ¥0.2/百万 tokens)与搜索增强附加费;Batch 推理部分模型有折扣价。
- 图像生成(ernie-image-turbo、musesteamer-air-image)与 OCR 按张或按 token 计费,与纯文本 API 口径不同,需单独估算。
- 除按 token 后付费外,千帆还提供预购量包(按量包付费):百度自研系列含 Lite Pro / Speed Pro / Turbo 32K·128K / Turbo VL 32K / X1-Turbo-32K 等,规格多为 1 亿·5 亿·10 亿·50 亿 tokens,有效期 6–12 个月、有折扣(如 Lite Pro 1 亿折后 ¥22.5/12 个月、Turbo 128K 1 亿折后 ¥126/6 个月)。稳定跑量往往比纯后付费更省;本站 entryPrice 与 tiers 仍按后付费单价展示,量包细节以控制台订单页为准。
- 联网搜索另售按次量包:10,000 次/6 个月折后 ¥38、50,000 次折后 ¥190;触发搜索增强时优先抵扣量包,耗尽后恢复 ¥0.004/次后付费。账户欠费但量包/Tpm 预付费未用完时,推理仍可调用,搜索按次仍会继续出账。
支持的编程工具
价格与模型数据均来源于厂商官方网站
常见问题
文心 API 的价格对比应该先看哪些计费口径?
做价格对比时,文心 API 不能只看一个套餐价格:Lite Pro 从输入 ¥0.2、输出 ¥0.4/百万 tokens 起,Turbo、ERNIE 旗舰、视觉/OCR 和图像能力的计费单位都不同。开放 API 主要是按量计费,长上下文、搜索增强、Batch 和缓存命中还会改变实际成本,所以正式上线前要按真实请求链路估算。
文心 API 的官网入口、购买入口和控制台分别在哪里?
本页的官方入口指向百度千帆文档中的价格与模型说明,购买入口和订阅入口通常需要进入百度智能云千帆控制台完成开通、下单或量包购买。API key 申请、余额、量包和搜索增强用量也以控制台展示为准,TokenPlan 只做对比和跳转,不代替官网订单页。
申请 API key 后,文心 API 的接入和 Coding Plan Key 有什么边界?
文心 API 的 API key / key 申请用于千帆开放 API 接入,可按 OpenAI 或 Anthropic 兼容接口配置到后端服务,并按 token 从账户余额或量包扣费。Coding Plan 的专属 Key 与 Base URL 只给编程工具订阅使用,不能当作普通开放 API key 接入应用后端或批量任务。
文心 API 有优惠、免费额度、年付、首购、Batch 或缓存折扣吗?
已知优惠主要来自预购量包、联网搜索按次量包、Batch 推理折扣和 Turbo 缓存命中价;例如部分 Batch 约为实时价 40%,缓存命中输入可低至 ¥0.2/百万 tokens。文件没有明确免费额度、首购或年付档位,是否有临时折扣以官网和控制台为准,不建议把 Coding Plan 促销当作 API 优惠。
文心 API 的额度、限速和 usage limit 怎么重置?
普通文心 API 更接近余额、量包和开放 API 配额管理,不是 Coding Plan 那种固定订阅额度重置;具体 usage limit、rate limit、RPM/TPM 限速和欠费规则要以千帆控制台为准。文件中明确 Lite Pro 默认 10K RPM,量包或账户余额耗尽后会回到后付费或停止可用,搜索增强按次计费也可能继续出账。
文心 API 的模型、工具和特色能力适合哪些场景?
模型选择上,Lite Pro 和 Speed Pro 适合高并发轻量问答,Turbo 适合多数生产知识助手,ERNIE 模型适合复杂 Agent、中文业务和全模态任务,Qianfan 视觉/OCR、图像模型适合文档识别、图文理解和生成场景。工具能力包括 OpenAI 兼容 API、Anthropic 兼容 API、Web Search、Batch inference 和 Context cache,适合按成本、延迟与准确率组合路由。