DeepSeek 这波不是小打小闹,是直接把价格表整体抬了一档。 官方定价页在 2026 年 8 月 15 日发了公告,从北京时间 2026-08-17 00:00 起改用峰谷定价,空闲时段价格为高峰时段的一半(来源)。高峰时段是 9:00–12:00 和 14:00–18:00,正好卡在你写代码、跑批量的核心时间。
新价格长什么样
一句话:高峰输入翻 3 倍起步,输出直接奔 4.5 倍去了。 峰谷定价把一天切成两档——高峰按高价算,空闲按半价算。
高峰时段(9:00–12:00、14:00–18:00)
| 计费项 | V4-Flash | V4-Pro |
|---|---|---|
| 缓存未命中输入 | ¥3 / 百万 tokens | ¥9 / 百万 tokens |
| 输出 | ¥9 / 百万 tokens | ¥27 / 百万 tokens |
| 缓存命中输入 | ¥0.10 / 百万 tokens | ¥0.30 / 百万 tokens |
空闲时段(其余时间)
| 计费项 | V4-Flash | V4-Pro |
|---|---|---|
| 缓存未命中输入 | ¥1.5 / 百万 tokens | ¥4.5 / 百万 tokens |
| 输出 | ¥4.5 / 百万 tokens | ¥13.5 / 百万 tokens |
| 缓存命中输入 | ¥0.05 / 百万 tokens | ¥0.15 / 百万 tokens |
两个模型还是老配置:1M 上下文、最大 384K 输出、思考/非思考双模式,OpenAI 和 Anthropic 格式都能接。v4-flash 并发 2500,v4-pro 并发 500,这部分没变(来源)。
涨价幅度有多大
高峰时段 v4-flash 输入 3 倍、输出 4.5 倍,v4-pro 缓存命中更是翻了 12 倍。 把涨价前后的价格摆一起看更直观:
| 计费项 | 模型 | 涨价前 | 空闲价 | 高峰价 | 高峰涨幅 |
|---|---|---|---|---|---|
| 缓存未命中输入 | V4-Flash | ¥1 | ¥1.5 | ¥3 | 3 倍 |
| 输出 | V4-Flash | ¥2 | ¥4.5 | ¥9 | 4.5 倍 |
| 缓存命中输入 | V4-Flash | ¥0.02 | ¥0.05 | ¥0.10 | 5 倍 |
| 缓存未命中输入 | V4-Pro | ¥3 | ¥4.5 | ¥9 | 3 倍 |
| 输出 | V4-Pro | ¥6 | ¥13.5 | ¥27 | 4.5 倍 |
| 缓存命中输入 | V4-Pro | ¥0.025 | ¥0.15 | ¥0.30 | 12 倍 |
最扎眼的是 v4-pro 的缓存命中,从 ¥0.025 涨到高峰 ¥0.30,翻了 12 倍。以前靠缓存薅羊毛的场景,现在也得重新算账。
充值、扣费、额度和限速还是老规矩
充值和扣费逻辑没变:按 token 用量 × 单价自动从余额扣,赠送余额优先花,没有包月套餐。 DeepSeek API 没有固定订阅额度,账户余额就是你的用量上限,token 用量在控制台实时可查。充值、API key 申请都在 platform.deepseek.com 控制台。
| 项目 | 规则 |
|---|---|
| 官网入口 | platform.deepseek.com 控制台 |
| 充值 | 控制台充值余额,按需充 |
| 扣费 | token 用量 × 单价,赠送余额优先 |
| 额度 | 无固定订阅额度,余额即用量上限 |
| 限速 | v4-flash 2500、v4-pro 500,超了返回 HTTP 429 |
| API key | 控制台申请,OpenAI / Anthropic 双格式 |
优惠这块,官方没有年付折扣或免费开发者额度,唯一能算「优惠」的就是缓存命中——重复 system prompt、长对话历史命中后输入价能便宜几十倍,虽然这波也涨了,但仍是降本大头。接入 Claude Code、Cursor、Cline 时选 OpenAI 或 Anthropic 兼容格式、填 Base URL 和 key 就行。需要更高并发可以提扩容工单,扩容不加钱;余额没了会停服,按需充、别一次充太多。
涨价后怎么控成本
别在高峰时段硬刚,把能错峰、能缓存的量都挪到空闲时段。 这波涨价后,省钱的三个抓手很明确:
- 错峰跑批量:空闲时段价格砍半,日志分析、批量补全、离线任务尽量放到晚上或非高峰午后跑。
- 把缓存命中率拉满:重复的 system prompt、多轮对话、RAG 上下文是缓存收益最大的地方,缓存命中输入仍比未命中便宜几十倍。
- 走第三方 Coding Plan:官方没有包月套餐,火山方舟、天翼云、百度千帆 有固定套餐接入 DeepSeek 模型,走套餐额度不走官方余额,定价体系独立,不受这波峰谷涨价影响。
值不值得继续用
看你用量和时段——重度用户算完账大概率还是留着,但要把高峰调用压下来。 这波涨价本质是把「工作时段」的算力成本转嫁给了按量付费用户。如果你白天大量调用,成本会明显上升;如果能把任务错峰、把缓存设计好,空闲价 ¥1.5/¥4.5 的输入输出其实还能接受。
几条实在的建议:
- 先算清楚你的高峰 vs 空闲用量占比,别只看单价。
- 高峰时段优先走缓存命中和 Flash 这类轻量模型,能省则省。
- 预算敏感就切火山方舟这类固定套餐,一次月费锁定成本。
- 持续盯 https://api-docs.deepseek.com/zh-cn/quick_start/pricing,峰谷时段和价格官方说改就改。