Kimi API
Kimi API 价格对比要从官网入口、API key 申请和三段式 token 计费一起看:K2.7 Code 是当前编程旗舰,标准版缓存命中 ¥1.30、未命中输入 ¥6.50、输出 ¥27/百万 tokens,HighSpeed 翻倍换更快输出;K2.6 旗舰多模态为 ¥1.10 / ¥6.50 / ¥27,K2.5 则以 ¥0.70 / ¥4.00 / ¥21 更适合生产跑量。这个页面会把 Moonshot 平台入口、API key 配置、充值赠券优惠、Tier0–Tier5 限速、自动缓存、ToolCalls、JSON Mode、Batch/批量任务取舍、`$web_search` ¥0.03/次、文件抽取限免、Claude Code / Cline / Roo Code 接入和 Kimi 会员额度差异放在一起,评估复杂代码 Agent、联网搜索与长上下文业务的真实计费成本。
Kimi API Token API 核心模型
`kimi-k2-0905-preview` 是当前 K2 预览系列主力,上下文 256k,在 0711 版本基础上增强 Agentic Coding、前端代码美观度与上下文理解能力;缓存命中 ¥1、未命中输入 ¥4、输出 ¥16 / 百万 tokens。
`kimi-k2-thinking` 适合通用 Agentic 与深度推理,`kimi-k2-thinking-turbo` 和 `kimi-k2-turbo-preview` 是高速版本;常规 Thinking 为 ¥1/¥4/¥16,Turbo 系列为 ¥1/¥8/¥58 / 百万 tokens。
当前 API 旗舰模型 `kimi-k2.6`:长程代码与 Agent 连续执行能力更强,支持视觉/视频输入与思考模式,缓存命中 ¥1.10、未命中输入 ¥6.50、输出 ¥27.00 / 百万 tokens,上下文 262,144 tokens。
主流生产模型 `kimi-k2.5`:256k 上下文,覆盖代码、工具调用与 `$web_search`;缓存命中 ¥0.70、未命中输入 ¥4.00、输出 ¥21.00 / 百万 tokens,适合作为长期主力接入。
经典长文本模型 `moonshot-v1-128k` 与 `moonshot-v1-128k-vision-preview`:输入 ¥10.00、输出 ¥30.00 / 百万 tokens,上下文 131,072 tokens;Vision 版支持图片理解并按同档计价。
其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。
Kimi API Token API 套餐 价格对比
Kimi K2.7 Code
编程旗舰Kimi K2.7 Code
编程旗舰kimi-k2.7-code 是 Kimi 当前最强 Coding 模型,同时支持文本、图片与视频输入,仅支持思考模式,适合复杂工程、多步 Agent 与长链路代码改造。kimi-k2.7-code-highspeed 与标准版同模型,输出约 180 tokens/s,短上下文可达 260 tokens/s;单价为缓存命中 ¥2.60、未命中输入 ¥13、输出 ¥54 / 百万 tokens。Kimi K2.6
旗舰模型Kimi K2.6
旗舰模型kimi-k2.6 是当前最智能的 API 模型,长程代码编写能力更强更稳,指令遵循与自我纠错也有明显提升,适合把复杂工程任务集中交给旗舰处理。单价高于 K2.5,更像关键路径模型而非默认入口:真正复杂、重要、难容错的任务更适合交给它,日常高频流量仍可优先走 K2.5。
Kimi K2.5
生产主力推荐Kimi K2.5
生产主力推荐kimi-k2.5 是主流生产模型,在 Agent、代码、视觉理解与通用智能任务上表现均衡,缓存命中输入价仅 ¥0.70/百万 tokens,更适合长期稳定跑量。如果你想在成本、长上下文能力和功能完整度之间找生产平衡点,K2.5 通常比直接全量上旗舰更合理,复杂节点再按需切到 K2.6。
Moonshot V1
经典生成Moonshot V1
经典生成moonshot-v1-8k 输入 ¥2.00、输出 ¥10.00 / 百万 tokens,适合短文本、轻量问答和高频低成本调用;moonshot-v1-32k 为 ¥5/¥20,适合中等长度生成。moonshot-v1-128k 输入 ¥10.00、输出 ¥30.00 / 百万 tokens,上下文 131,072 tokens,适合更长文档场景;Vision 系列(8K/32K/128K preview)按同档文本价计费。如果你只需要经典文本或图片理解、且对上下文长度有明确档位需求,V1 系列通常比 K2 多模态旗舰更便宜;复杂 Agent 与长程代码仍建议优先 K2.5 / K2.6。
注意事项
- 官方以每百万 tokens(1M tokens)计价;K2.6 为缓存命中 ¥1.10、未命中输入 ¥6.50、输出 ¥27.00;K2.5 为 ¥0.70 / ¥4.00 / ¥21.00;K2 系列为 ¥1.00 / ¥4.00 / ¥16.00,Turbo 与 Thinking Turbo 为 ¥1.00 / ¥8.00 / ¥58.00;Moonshot V1 按 8K/32K/128K 与 Vision 系列分别定价。
- 2026-06-12 至 07-02 有限时充值赠券活动:单笔充值满 ¥500 最高赠 30%,详见 platform.kimi.com/docs/pricing/promotion;结束时间以官网为准。
- 联网搜索 `$web_search` 每次成功触发另收 ¥0.03,搜索结果 token 会在下次 `/chat/completions` 调用时计入总消耗;做 Agent 时要把工具成本一起算进去。
- 文件抽取与存储接口限时免费,但抽取后的文档内容作为 Input 传给模型时仍按 token 计费;上传文档本身不产生额外文件接口费用。
支持的编程工具
价格与模型数据均来源于厂商官方网站
常见问题
Kimi API 的价格对比和计费应该先看哪几个套餐价格?
Kimi API 是开放 API 的按量计费,不是会员订阅套餐;价格对比要把缓存命中、未命中输入和输出的套餐价格分开看。Moonshot V1 入门价为 ¥2 / ¥10 / 百万 tokens,Kimi 模型中的生产主力和编程旗舰价格更高,适合按任务复杂度分层调用。实际计费还要叠加工具调用和缓存命中率,以官网价格页为准。
Kimi API 的官网入口、购买入口和控制台在哪里?
Kimi API 的官网入口和官方入口都在 Moonshot 平台,本文记录的购买入口指向 platform.kimi.com 的模型与价格文档。充值、用量查看、API key 管理和订阅入口应在控制台完成,具体页面位置以官网导航为准。不要把 kimi.com 会员入口当成开放 API 控制台,两套产品的额度和计费不互通。
Kimi API key 申请后,接入和配置要注意哪些开放 API 边界?
API key 和 key 申请用于 Moonshot 开放 API 接入,配置到后端、Claude Code、Cline 或 Roo Code 时要按 OpenAI-compatible API 的方式处理。Kimi 会员里的专属额度、Kimi Code 额度不等同于开放 API 余额,不能直接拿会员订阅抵扣 API 按量计费。生产接入前还要确认模型、工具、缓存和限速是否符合你的调用链。
Kimi API 有优惠、免费额度、年付或 Batch 和缓存折扣吗?
Kimi API 文件抽取与存储接口有过限时免费,充值活动也出现过首购或满额赠券优惠,但免费额度、年付和折扣规则都要以官网活动页为准。Batch/批量任务适合离线吞吐取舍,缓存命中则会直接降低输入成本,例如部分 Kimi 模型缓存价低于未命中输入价。若要计算优惠后的真实成本,应同时看 Batch、缓存、工具调用和活动结束时间。
Kimi API 的额度、限速、使用限制和重置规则怎么判断?
Kimi API 的额度主要看账户余额与 token 消耗,限速和使用限制则与 Tier0 到 Tier5 的累计充值等级相关。usage limit、rate limit、RPM/TPM 和并发上限会影响高并发上线,重置或升级规则以控制台与官方文档展示为准。上线前不要只看单价,还要确认当前账号等级能否承载目标流量。
Kimi API 的模型、工具和能力分别适合哪些场景?
Kimi 模型适合长文本、长代码、推理和 Agent 场景,Moonshot V1 更适合经典文本生成、不同上下文长度和 Vision 图片理解。工具方面,ToolCalls、JSON Mode、Partial Mode、自动上下文缓存和 `$web_search` 能力适合复杂代码 Agent、联网搜索和结构化输出。需要编程主力可优先评估 Kimi Code 相关模型系列,轻量高频调用则可从 Moonshot V1 入门档开始。