返回全部对比

MiniMax API

M3 旗舰

MiniMax API 价格对比要从官网入口申请普通 API key 后的按量计费看起,而不是和 Token Plan 积分池混用。MiniMax-M3 是 1M 上下文、原生多模态旗舰,≤512K 输入永久五折后为 ¥2.1/¥8.4 每百万 tokens;MiniMax-M2.7 与 highspeed 适合生产主力流量,缓存读 ¥0.42、缓存写 ¥2.625 可压低长上下文成本,service_tier priority 按 1.5× 计费。这个页面会把优惠、API key 申请、限速与接入配置、Speech-2.8、Hailuo 2.3 视频、image-01、Music-2.6、Agent API 和语音/视频预付资源包放在一起,帮助判断 MiniMax API 更适合复杂 Agent、长上下文代码还是多模态内容生成。

Token API
订阅套餐Token API

MiniMax API Token API 核心模型

MiniMax-M3MiniMax-M2.7MiniMax-M2.7-highspeedSpeech-2.8MiniMax Hailuo 2.3image-01Music-2.6
MiniMax-M3

当前 API 旗舰 `MiniMax-M3`:原生多模态、1M 上下文,≤512k 输入永久五折 ¥2.1/¥8.4 / 百万 tokens,>512k 五折价 ¥4.2/¥16.8,缓存读 ¥0.42、写 ¥2.625。

MiniMax-M2.7

生产主力 `MiniMax-M2.7`:输入 ¥2.1、输出 ¥8.4 / 百万 tokens,缓存读 ¥0.42、写 ¥2.625,适合 Agent、长上下文与日常大规模调用。

MiniMax-M2.7-highspeed

高速版 `MiniMax-M2.7-highspeed`:输入 ¥4.2、输出 ¥16.8 / 百万 tokens,效果与 M2.7 一致但速度更快,缓存读写价格与 M2.7 相同。

Speech-2.8

语音模型 Speech-2.8-HD / Turbo,同步 T2A ¥2-3.5/万字符,异步长文本同价;音色设计/复刻首次合成时收取 ¥9.9/音色。

MiniMax Hailuo 2.3

视频模型 Hailuo 2.3 / 2.3 Fast,文生视频与图生视频 ¥1.35-4/条(Fast 图生 768P 6s ¥1.35、10s ¥2.25、1080P 6s ¥2.31;标准 768P 6s ¥2、10s ¥4、1080P 6s ¥3.5),适合内容生成与多媒体工作流。

更多模型详情请查看官网

其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。

前往官网

MiniMax API Token API 套餐 价格对比

MiniMax-M3

旗舰多模态
输入价格
¥2.1
输出价格
¥8.4
用量
MiniMax-M3 是原生多模态、1M 上下文的 Frontier Coding 模型,≤512k 输入目前永久五折 ¥2.1/¥8.4 / 百万 tokens,适合复杂 Agent 与长程代码任务。
模型
支持 ToolCalls、交错思维链与多模态输入;输入超过 512k 按五折价 ¥4.2/¥16.8 计价且限时限量供应,高并发场景可通过 service_tier 优先档加速。
特点
缓存命中可显著降低成本;若任务复杂度高、单次调用资源消耗大,M3 更适合作为关键路径模型而非全量默认入口。
日常高频、成本敏感的生产流量仍可优先 M2.7,在复杂节点按需切到 M3。
适合人群
复杂 Agent、长程代码与多模态高价值任务团队

MiniMax-M2.7

最新主力推荐
输入价格
¥2.1
输出价格
¥8.4
用量
输入、输出以及缓存读写分别计费,因此它非常适合在长上下文和高频重复上下文场景里通过缓存把整体成本做得更可控。
模型
模型是 MiniMax-M2.7,这一档更适合作为生产主力模型来承接 Agent、多模态工作流和多数需要综合能力的业务任务。
特点
如果你既要效果、又要长期控制调用成本,同时又希望接口和工作流足够统一,这档通常会比直接冲高速版更均衡。
它尤其适合连续会话、长上下文应用、工具型 Agent 和需要稳定长期放量的生产服务。
适合人群
高性价比生产调用、长上下文应用和 Agent 工作流团队

MiniMax-M2.7-highspeed

高速版
输入价格
¥4.2
输出价格
¥16.8
用量
这档更强调速度和吞吐,而不是明显改变模型效果,因此更适合把实时性和交互响应放在更高优先级的业务。
模型
MiniMax-M2.7-highspeed 特别适合高并发接口、交互式产品、实时助手和对等待时间更敏感的用户体验场景。
特点
如果你已经确认 M2.7 的效果足够,但用户规模或交互节奏让普通速度成为瓶颈,高速版通常就是更自然的升级方向。
它更像一档“为速度买单”的版本,因此是否值得升级,关键要看延迟是否真的直接影响业务转化和体验。
适合人群
高并发交互产品、实时助手和更重视响应速度的业务团队

注意事项

  • M3 ≤512k 输入永久五折,现价 ¥2.1/¥8.4(刊例 ¥4.2/¥16.8);>512k 输入同为五折价 ¥4.2/¥16.8(刊例 ¥8.4/¥33.6),该能力目前限时限量供应。
  • M2.7 / M2.7-highspeed 常规定价:输入 ¥2.1 或 ¥4.2、输出 ¥8.4 或 ¥16.8 / 百万 tokens;缓存读 ¥0.42、写 ¥2.625。M3 优先档(service_tier=priority)按标准价 1.5 倍计费。
  • 语音、视频、图像、音乐等模态另有独立刊例价;Music-2.6 与歌词生成当前标注限免,详见按量计费文档。
  • 大批量语音/视频另有预付资源包:HD 语音包 ¥630 起(200 万字符/月)、Turbo ¥360 起;视频包 ¥7,000 起(含积分池,按模型/分辨率扣减)。与 Token Plan、按量余额三套体系独立。

支持的编程工具

OpenAI-style APICacheAgent

价格与模型数据均来源于厂商官方网站

常见问题

MiniMax API 的价格对比该看套餐价格还是按量计费?MiniMax API 的官网入口、购买入口和控制台在哪里?MiniMax API key 申请后,接入和配置与开放 API 有什么边界?MiniMax API 现在有哪些优惠、免费额度、Batch、缓存或折扣?MiniMax API 的额度、限速、使用限制和重置规则怎么看?MiniMax API 的模型、工具、能力和场景适合哪些业务?

MiniMax API 的价格对比该看套餐价格还是按量计费?

MiniMax API 页面主要看按量计费,不是 Token Plan 的套餐价格;普通 API key 会按输入、输出和缓存读写分别结算。价格对比时可先看 MiniMax 模型的 ¥2.1/¥8.4 / 百万 tokens,再比较高速档、语音、视频、图像等不同模态的刊例价。若你要买订阅额度,应转到 Token Plan 页面,避免把按量计费和订阅套餐价格混在一起。

MiniMax API 的官网入口、购买入口和控制台在哪里?

MiniMax API 的官网入口和官方入口是开放平台按量计费文档与控制台,页面中的购买入口指向官方 pricing-paygo。申请或管理余额、查看用量、配置 key 都应在控制台完成;订阅入口则属于 Token Plan,不是普通开放 API 按量入口。购买前建议从官方入口确认当前价格、优惠和可用模型。

MiniMax API key 申请后,接入和配置与开放 API 有什么边界?

普通 API key 申请后用于开放 API 接入,可配置 OpenAI-style API、Anthropic 兼容协议、Cache 和 Agent 等能力。它和 Token Plan 的订阅 key 不可混用,开放 API 按量扣账户余额,订阅 key 则走积分池。做接入配置时要确认当前项目使用的是普通 API key 还是订阅 key,否则计费和额度口径会不同。

MiniMax API 现在有哪些优惠、免费额度、Batch、缓存或折扣?

当前文件明确写到的优惠是 MiniMax 模型 ≤512k 和 >512k 输入五折,Music 与歌词生成也标注限免,是否有免费额度、首购或年付优惠需以官网为准。Batch 在该文件没有明确价格,不能按默认折扣编造;缓存有明确价格,缓存读 ¥0.42、缓存写 ¥2.625 / 百万 tokens,可降低长上下文重复调用成本。大批量语音和视频另有预付资源包,但它们与 API 按量余额、Token Plan 是独立体系。

MiniMax API 的额度、限速、使用限制和重置规则怎么看?

MiniMax API 是开放 API 按量计费,额度主要取决于账户余额、模型价格和控制台策略,而不是订阅套餐的固定重置。限速、usage limit、rate limit 与使用限制应在官方控制台和文档中查看,文件只明确 M3 >512k 能力限时限量供应、priority 档按 1.5× 计费。若需要固定窗口额度和重置规则,应看 Token Plan,而不是普通 API key。

MiniMax API 的模型、工具、能力和场景适合哪些业务?

MiniMax API 覆盖 MiniMax 模型、语音模型、视频模型、图像模型和音乐模型,FAQ 中不需要写具体版本号也能判断能力边界。工具上支持 OpenAI-style API、Cache 和 Agent,适合复杂 Agent、长上下文代码、多模态内容生成、语音合成和 Hailuo 视频场景。若业务更看重速度,可考虑 highspeed 档;若更看重成本,先用主力 MiniMax 模型并结合缓存。