Deepseek Token API 价格对比、充值、优惠、最新动态 | 文章详情

DeepSeek Token API 价格对比,DeepSeek-V4-Flash、DeepSeek-V4-Pro等3个模型,OpenAI-compatible API、Anthropic-compatible API、Claude Code等6种工具接入,含缓存与限速等级,汇总 API key 配置、用量与官网入口,帮你判断值不值得。

41
平台对比
395+
支持模型
140+
IDE Tools
3
Deepseek Token API 模型数
¥1.5–3 / ¥4.5–9
Deepseek Token API 入门价
详情
查看厂商详情

DeepSeek API 最新动态

DeepSeek V4-Flash 正式发布:Agent 基准全面超越 V4-Pro 预览版,MIT 开源权重

发布 更新
模型更新DeepSeekV4-Flash模型发布AgentAPI 更新开源Codex
摘要

DeepSeek V4-Flash 正式版已发布,API 开放公测。仅靠后训练就在全部 9 项 Agent 基准上超越 V4-Pro 预览版,新增 Responses API 和 Codex 支持,同日 MIT 开源权重。定价不变、并发 2500:缓存未命中输入 ¥1/MTok、输出 ¥2/MTok,缓存命中输入 ¥0.02/MTok。

DeepSeek-V4-Flash 正式版出来了。最有意思的看点:一个只有 13B 激活参数的模型,在全部 9 项 Agent 基准上干掉了 49B 激活的 V4-Pro 预览版——而且只靠后训练,架构一笔没动。

2026 年 7 月 31 日,DeepSeek-V4-Flash 从预览版升格为正式版(DeepSeek-V4-Flash-0731),API 公开测试同步开放(来源)。权重 MIT 开源,定价不变。

架构没变,能力飞涨

就是同一套 CSA + HCA 架构,同一个 284B total / 13B active 的参数规模——只做了一轮 re-post-training。你换个权重文件就行,推理代码一行不用改。

指标 DeepSeek-V4-Flash-0731
总参数量 284B
激活参数量 13B
架构 CSA + HCA
上下文长度 1M
最大输出 384K
精度 FP4 + FP8 混合
新增 DSpark 推测解码
开源协议 MIT

DSpark 推测解码是新增的加速模块,不改变输出内容,纯粹提吞吐。

Agent 基准:13B 打 49B

后训练带来的 Agent 能力提升不是挤牙膏,是跳了一档。9 项基准全部碾压 V4-Pro 预览版(来源):

基准 V4-Flash-0731
Terminal Bench 2.1 82.7
NL2Repo 54.2
Cybergym 76.7
DeepSWE 54.4
Toolathlon verified 70.3
Agent Last Exam 25.2
Automation Bench (Public) 25.1
DSBench-FullStack 68.7
DSBench-Hard 59.6

DSBench 是 DeepSeek 内部测试集,和公开基准没有可比性,看趋势参考就好。

新加的能力

Responses API

原生支持了 Responses API——OpenAI 那套新的有状态 API,比 Chat Completions 更适合多轮 Agent 任务。V4-Pro 的 Responses API 还要等到 8 月初。

Codex 适配

专门给 Codex(Claude Code 的 Agent 框架)做了优化。如果你用 Claude Code + DeepSeek API 的组合,这波更新体验直接拉满。配置参考 官方文档

DSpark 推测解码

加速推理用的,不改输出,不提参数,纯粹让 token 跑得更快。

定价和并发

完全没变,跟预览版一个价:

计费项 价格(CNY) 价格(USD)
缓存命中输入 ¥0.02 / MTok $0.0028 / MTok
缓存未命中输入 ¥1 / MTok $0.14 / MTok
输出 ¥2 / MTok $0.28 / MTok

并发 2500,思考/非思考双模式、JSON Output、Tool Calls 全在。

额外提一句:官方定价页也挂了个涨价预告,涨幅应该不小。这事儿上篇文章细聊过,简单说就是趁现在把缓存策略做好。

开源权重

MIT 协议,HuggingFace 和 ModelScope 都有:

Base 和 Instruct 两个版本。自己微调拿 Base,开箱即用拿 Instruct。

几个要注意的点

  1. 这次只升了 Flash,Pro 的 API 没动。APP/WEB 的模型也还是老版本。
  2. V4-Pro 正式版快了,官方预告"将很快发布"。
  3. deepseek-chatdeepseek-reasoner 已经彻底停服(7 月 24 日 23:59),现在自动转到 v4-flash 的对应模式。
  4. 涨价预告别不当回事——赶紧算一下月度消耗、做好缓存策略。

来源与核验

最后核验

Deepseek Token API 常见问题

DeepSeek-V4-Flash 正式发布和预览版有什么关键变化?13B 激活参数后训练怎么做到 Agent 超越 V4-Pro 预览版

正式版(DeepSeek-V4-Flash-0731)架构和参数量(284B total / 13B active)跟预览版一模一样,只做了 re-post-training。就这么一步后训练,在全部 9 项 Agent 基准上把 49B 激活的 V4-Pro 预览版给超了。另外原生支持了 Responses API 格式,专门适配了 Codex,加了个 DSpark 推测解码模块提速度。API 调用方式没变,模型名还是 deepseek-v4-flash。

DeepSeek-V4-Flash 正式版在 Terminal Bench 等 9 项 Agent 基准上的具体跑分和测试配置

Terminal Bench 2.1(82.7)、NL2Repo(54.2)、Cybergym(76.7)、DeepSWE(54.4)、Toolathlon verified(70.3)、Agent Last Exam(25.2)、Automation Bench Public(25.1)、DSBench-FullStack(68.7)、DSBench-Hard(59.6)。全部 9 项碾压 V4-Pro 预览版。测试用的是 DeepSeek Harness minimal mode + max effort level + top_p=0.95 + temperature=1.0。DSBench 是内部测试集,看个趋势就行。

DeepSeek-V4-Flash 正式版原生的 Responses API 和 Codex 适配对 Claude Code 接入有什么影响

Responses API 是 OpenAI 新一代有状态 API 标准,比老 Chat Completions 更适合多轮 Agent 交互。V4-Flash 正式版原生支持,不用调配置。Codex 适配是专门给 Claude Code 用的 Agent 框架做的优化——如果你用 Claude Code + DeepSeek API,这波更新体验提升明显。V4-Pro 的 Responses API 预计 8 月初才上。

DeepSeek-V4-Flash 正式发布后 V4-Pro 什么时候出正式版以及 API 定价变了吗

官方说 V4-Pro 正式版'将很快发布'。这次只升级了 Flash,Pro 的 API 和 APP/WEB 都没动。定价完全没变——缓存未命中输入 ¥1/MTok、输出 ¥2/MTok,缓存命中输入 ¥0.02/MTok,并发 2500。不过注意,官方定价页也发了涨价预告,整体上调近期就来,用 API 的得提前规划。

DeepSeek-V4-Flash 正式版 MIT 开源权重 HuggingFace 和 ModelScope 下载地址及 Base/Instruct 版本区别

MIT 协议,7月31日跟 API 同步发的。HuggingFace:deepseek-ai/DeepSeek-V4-Flash-0731,ModelScope:deepseek-ai/DeepSeek-V4-Flash-0731。Base 和 Instruct 两个版本都有,FP4+FP8 混合精度。Base 适合自己微调和后训练,Instruct 是对话微调版,开箱即用。如果你用 vLLM 或者 SGLang 部署,选 Instruct 就行。
AI Token Plan

全球 AI Token Plan 价格对比

AI Token Plan 不是简单收集厂商链接,而是把 41+ 家国内外 AI 平台与厂商放到同一套对比框架里,覆盖 395+ 款模型资料,以及 Token Plan、Coding Plan、IDE Tools 和大模型 API 等常见套餐形态。

当你想比较 AI 订阅价格、编程套餐额度、API 调用成本或官网优惠入口时,可以在这里同时看到官方价格、套餐档位、用量规则、模型能力和工具接入方式,减少在多个官网之间反复查找的成本。

我们会随着各厂商价格页、套餐页和产品文档的变化持续整理数据,让首页适合作为 AI Token Plan 价格对比入口,也让详情页能进一步说明单个厂商的套餐是否适合个人开发者、团队采购或长期 API 调用。

价格信息来源于各平台官网,可能随时变动,请以官网实际价格为准。

© 2026 AI Token Plan · 保留所有权利 · 网站上线时间于 2026 年 6 月 18 日 · 已运营 64 天 · 站长地图