DeepSeek 要涨价了,而且幅度不小。如果你在用它的 API,这事儿得提前算算账。
官方定价页 2026 年 8 月发了公告,计划近期整体上调 API 服务定价(来源)。具体涨多少、什么时候生效都还没说,但话放这儿了——让你提前规划好用量。
当前在售的模型就两个:deepseek-v4-flash 和 deepseek-v4-pro,都支持 1M 上下文、最大 384K 输出,OpenAI 和 Anthropic 格式双兼容。
现在的价格长什么样
涨价之前先把现价看清楚,免得到时候一脸懵。
DeepSeek-V4-Flash
| 计费项 | 价格(CNY) | 价格(USD) |
|---|---|---|
| 缓存命中输入 | ¥0.02 / MTok | $0.0028 / MTok |
| 缓存未命中输入 | ¥1 / MTok | $0.14 / MTok |
| 输出 | ¥2 / MTok | $0.28 / MTok |
并发 2500,思考/非思考双模式,JSON Output、Tool Calls、FIM 补全都在。Responses API 已经支持了。
DeepSeek-V4-Pro
| 计费项 | 价格(CNY) | 价格(USD) |
|---|---|---|
| 缓存命中输入 | ¥0.025 / MTok | $0.003625 / MTok |
| 缓存未命中输入 | ¥3 / MTok | $0.435 / MTok |
| 输出 | ¥6 / MTok | $0.87 / MTok |
并发 500,功能和 Flash 一样,但 Responses API 还没上(预计 8 月初)。
缓存比模型选择重要得多
说真的,与其纠结选 Flash 还是 Pro,不如把缓存搞好。V4 系列的缓存能把输入成本打掉 98% 以上:
| 对比 | Flash 缓存命中 | Flash 缓存未命中 | Pro 缓存命中 | Pro 缓存未命中 |
|---|---|---|---|---|
| 输入价格 | ¥0.02 / MTok | ¥1 / MTok | ¥0.025 / MTok | ¥3 / MTok |
| 降幅 | — | — | — | — |
| 相比未命中 | 省 98% | — | 省 99.2% | — |
什么场景缓存最值:重复的 system prompt、多轮编程对话、RAG 的知识库上下文——就这些,缓存命中率就是你的省钱密码。
扣费怎么算
费用 = token 消耗量 × 模型单价,从余额里自动扣。有赠送余额就先扣赠送的,花完才扣你充的。余额没了直接停服,建议按需充、别一次充太多。
涨价后怎么搞
如果你不想到时候被涨价吓一跳,现在可以做的事情:
第三方 Coding Plan 走起
DeepSeek 官方没有包月套餐,但 火山方舟、天翼云 和 百度千帆 有固定套餐,里面都接入了 DeepSeek 模型。走的是套餐额度,不受官方涨价影响,定价体系完全独立。
工具切换没啥成本
DeepSeek API 兼容 OpenAI 和 Anthropic 两种格式,你在 Claude Code、Cursor、Cline、Codex CLI 里换个 Base URL 和 API key 就完事了。
最后说几句
- 官方定价页 https://api-docs.deepseek.com/zh-cn/quick_start/pricing 没事多刷刷,涨价方案以那上面的正式通知为准。
- 提前算一下你的月度 token 消耗,把预算影响摸清楚。
- 缓存策略现在就做好——别等涨价了才发现缓存命中率连 50% 都不到。
- Flash 和 Pro 分工明确——日常批量全走 Flash,复杂推理才上 Pro。