返回全部对比

Kimi API

K2.7 Code 编程

Kimi API 价格对比要从官网入口、API key 申请和三段式 token 计费一起看:K2.7 Code 是当前编程旗舰,标准版缓存命中 ¥1.30、未命中输入 ¥6.50、输出 ¥27/百万 tokens,HighSpeed 翻倍换更快输出;K2.6 旗舰多模态为 ¥1.10 / ¥6.50 / ¥27,K2.5 则以 ¥0.70 / ¥4.00 / ¥21 更适合生产跑量。这个页面会把 Moonshot 平台入口、API key 配置、充值赠券优惠、Tier0–Tier5 限速、自动缓存、ToolCalls、JSON Mode、Batch/批量任务取舍、`$web_search` ¥0.03/次、文件抽取限免、Claude Code / Cline / Roo Code 接入和 Kimi 会员额度差异放在一起,评估复杂代码 Agent、联网搜索与长上下文业务的真实计费成本。

Token API
订阅套餐Token API

Kimi API Token API 核心模型

Kimi K2.6Kimi K2.5Kimi K2 0905 PreviewKimi K2 0711 PreviewKimi K2 Turbo PreviewKimi K2 ThinkingKimi K2 Thinking TurboMoonshot V1 128KMoonshot V1 32KMoonshot V1 8KMoonshot V1 128K VisionMoonshot V1 32K VisionMoonshot V1 8K Vision
Kimi K2 0905 Preview

`kimi-k2-0905-preview` 是当前 K2 预览系列主力,上下文 256k,在 0711 版本基础上增强 Agentic Coding、前端代码美观度与上下文理解能力;缓存命中 ¥1、未命中输入 ¥4、输出 ¥16 / 百万 tokens。

Kimi K2 Thinking / Turbo

`kimi-k2-thinking` 适合通用 Agentic 与深度推理,`kimi-k2-thinking-turbo` 和 `kimi-k2-turbo-preview` 是高速版本;常规 Thinking 为 ¥1/¥4/¥16,Turbo 系列为 ¥1/¥8/¥58 / 百万 tokens。

Kimi K2.6

当前 API 旗舰模型 `kimi-k2.6`:长程代码与 Agent 连续执行能力更强,支持视觉/视频输入与思考模式,缓存命中 ¥1.10、未命中输入 ¥6.50、输出 ¥27.00 / 百万 tokens,上下文 262,144 tokens。

Kimi K2.5

主流生产模型 `kimi-k2.5`:256k 上下文,覆盖代码、工具调用与 `$web_search`;缓存命中 ¥0.70、未命中输入 ¥4.00、输出 ¥21.00 / 百万 tokens,适合作为长期主力接入。

Moonshot V1 128K

经典长文本模型 `moonshot-v1-128k` 与 `moonshot-v1-128k-vision-preview`:输入 ¥10.00、输出 ¥30.00 / 百万 tokens,上下文 131,072 tokens;Vision 版支持图片理解并按同档计价。

更多模型详情请查看官网

其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。

前往官网

Kimi API Token API 套餐 价格对比

Kimi K2.7 Code

编程旗舰
输入价格
¥6.5
输出价格
¥27
用量
kimi-k2.7-code 是 Kimi 当前最强 Coding 模型,同时支持文本、图片与视频输入,仅支持思考模式,适合复杂工程、多步 Agent 与长链路代码改造。
模型
kimi-k2.7-code-highspeed 与标准版同模型,输出约 180 tokens/s,短上下文可达 260 tokens/s;单价为缓存命中 ¥2.60、未命中输入 ¥13、输出 ¥54 / 百万 tokens。
特点
K2.7 Code 支持自动上下文缓存、ToolCalls、JSON Mode、Partial Mode 等能力;未命中输入 ¥6.50、输出 ¥27 / 百万 tokens,与 K2.6 输出档一致但更偏编程。
适合人群
AI 编程工具、复杂代码 Agent、长上下文工程任务与对响应速度有要求的开发团队

Kimi K2.6

旗舰模型
输入价格
¥6.5
输出价格
¥27
用量
kimi-k2.6 是当前最智能的 API 模型,长程代码编写能力更强更稳,指令遵循与自我纠错也有明显提升,适合把复杂工程任务集中交给旗舰处理。
模型
支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务,并覆盖 ToolCalls、JSON Mode、Partial Mode、自动上下文缓存和联网搜索等能力。
特点
上下文 256k,更适合多步工具调用、长链路计划、复杂代码改造和研究型 Agent 等对持续执行能力要求更高的节点。
单价高于 K2.5,更像关键路径模型而非默认入口:真正复杂、重要、难容错的任务更适合交给它,日常高频流量仍可优先走 K2.5。
适合人群
复杂代码工作流、研究型 Agent、长链路规划和高价值分析任务团队

Kimi K2.5

生产主力推荐
输入价格
¥4
输出价格
¥21
用量
kimi-k2.5 是主流生产模型,在 Agent、代码、视觉理解与通用智能任务上表现均衡,缓存命中输入价仅 ¥0.70/百万 tokens,更适合长期稳定跑量。
模型
支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务,并覆盖 ToolCalls、JSON Mode、Partial Mode、自动上下文缓存和联网搜索。
特点
上下文 256k,适合长文档问答、仓库级代码辅助、复杂资料整理和需要较长工具链的 Agent 场景,是多数团队更稳的统一接入入口。
如果你想在成本、长上下文能力和功能完整度之间找生产平衡点,K2.5 通常比直接全量上旗舰更合理,复杂节点再按需切到 K2.6。
适合人群
长文本应用、仓库级代码辅助、复杂资料整理和高频 Agent 服务团队

Moonshot V1

经典生成
输入价格
¥2
输出价格
¥10
用量
Moonshot V1 是经典生成模型系列,按 8K、32K、128K 三种上下文长度定价,Vision Preview 版本与对应文本版价格相同,区别主要在上下文窗口大小。
模型
moonshot-v1-8k 输入 ¥2.00、输出 ¥10.00 / 百万 tokens,适合短文本、轻量问答和高频低成本调用;moonshot-v1-32k 为 ¥5/¥20,适合中等长度生成。
特点
moonshot-v1-128k 输入 ¥10.00、输出 ¥30.00 / 百万 tokens,上下文 131,072 tokens,适合更长文档场景;Vision 系列(8K/32K/128K preview)按同档文本价计费。
如果你只需要经典文本或图片理解、且对上下文长度有明确档位需求,V1 系列通常比 K2 多模态旗舰更便宜;复杂 Agent 与长程代码仍建议优先 K2.5 / K2.6。
适合人群
短文本生成、按上下文分档选型、Vision 图片理解与成本敏感的传统 NLP 场景

注意事项

  • 官方以每百万 tokens(1M tokens)计价;K2.6 为缓存命中 ¥1.10、未命中输入 ¥6.50、输出 ¥27.00;K2.5 为 ¥0.70 / ¥4.00 / ¥21.00;K2 系列为 ¥1.00 / ¥4.00 / ¥16.00,Turbo 与 Thinking Turbo 为 ¥1.00 / ¥8.00 / ¥58.00;Moonshot V1 按 8K/32K/128K 与 Vision 系列分别定价。
  • 2026-06-12 至 07-02 有限时充值赠券活动:单笔充值满 ¥500 最高赠 30%,详见 platform.kimi.com/docs/pricing/promotion;结束时间以官网为准。
  • 联网搜索 `$web_search` 每次成功触发另收 ¥0.03,搜索结果 token 会在下次 `/chat/completions` 调用时计入总消耗;做 Agent 时要把工具成本一起算进去。
  • 文件抽取与存储接口限时免费,但抽取后的文档内容作为 Input 传给模型时仍按 token 计费;上传文档本身不产生额外文件接口费用。

支持的编程工具

OpenAI-compatible APIClaude CodeClineRoo Code

价格与模型数据均来源于厂商官方网站

常见问题

Kimi API 的价格对比和计费应该先看哪几个套餐价格?Kimi API 的官网入口、购买入口和控制台在哪里?Kimi API key 申请后,接入和配置要注意哪些开放 API 边界?Kimi API 有优惠、免费额度、年付或 Batch 和缓存折扣吗?Kimi API 的额度、限速、使用限制和重置规则怎么判断?Kimi API 的模型、工具和能力分别适合哪些场景?

Kimi API 的价格对比和计费应该先看哪几个套餐价格?

Kimi API 是开放 API 的按量计费,不是会员订阅套餐;价格对比要把缓存命中、未命中输入和输出的套餐价格分开看。Moonshot V1 入门价为 ¥2 / ¥10 / 百万 tokens,Kimi 模型中的生产主力和编程旗舰价格更高,适合按任务复杂度分层调用。实际计费还要叠加工具调用和缓存命中率,以官网价格页为准。

Kimi API 的官网入口、购买入口和控制台在哪里?

Kimi API 的官网入口和官方入口都在 Moonshot 平台,本文记录的购买入口指向 platform.kimi.com 的模型与价格文档。充值、用量查看、API key 管理和订阅入口应在控制台完成,具体页面位置以官网导航为准。不要把 kimi.com 会员入口当成开放 API 控制台,两套产品的额度和计费不互通。

Kimi API key 申请后,接入和配置要注意哪些开放 API 边界?

API key 和 key 申请用于 Moonshot 开放 API 接入,配置到后端、Claude Code、Cline 或 Roo Code 时要按 OpenAI-compatible API 的方式处理。Kimi 会员里的专属额度、Kimi Code 额度不等同于开放 API 余额,不能直接拿会员订阅抵扣 API 按量计费。生产接入前还要确认模型、工具、缓存和限速是否符合你的调用链。

Kimi API 有优惠、免费额度、年付或 Batch 和缓存折扣吗?

Kimi API 文件抽取与存储接口有过限时免费,充值活动也出现过首购或满额赠券优惠,但免费额度、年付和折扣规则都要以官网活动页为准。Batch/批量任务适合离线吞吐取舍,缓存命中则会直接降低输入成本,例如部分 Kimi 模型缓存价低于未命中输入价。若要计算优惠后的真实成本,应同时看 Batch、缓存、工具调用和活动结束时间。

Kimi API 的额度、限速、使用限制和重置规则怎么判断?

Kimi API 的额度主要看账户余额与 token 消耗,限速和使用限制则与 Tier0 到 Tier5 的累计充值等级相关。usage limit、rate limit、RPM/TPM 和并发上限会影响高并发上线,重置或升级规则以控制台与官方文档展示为准。上线前不要只看单价,还要确认当前账号等级能否承载目标流量。

Kimi API 的模型、工具和能力分别适合哪些场景?

Kimi 模型适合长文本、长代码、推理和 Agent 场景,Moonshot V1 更适合经典文本生成、不同上下文长度和 Vision 图片理解。工具方面,ToolCalls、JSON Mode、Partial Mode、自动上下文缓存和 `$web_search` 能力适合复杂代码 Agent、联网搜索和结构化输出。需要编程主力可优先评估 Kimi Code 相关模型系列,轻量高频调用则可从 Moonshot V1 入门档开始。