返回全部对比

OpenAI API

按量计费·1,050,000 上下文

OpenAI API 这页专门做 API key 申请、官网入口和价格对比,不把 ChatGPT Plus / Pro 会员额度混进来:Playground、Responses API、Chat Completions、Codex CLI、Cursor、Cline 与生产服务都走 platform.openai.com 独立余额。GPT-5.6 Sol 1,050,000 上下文按 $5 输入、$30 输出/百万 tokens 计费,GPT-5.6 Luna 入口价为 $0.20/$1.20;同时要看 Prompt 缓存命中价、Batch API 半价、Flex 低价档、Web Search $10/千次、Realtime 语音、GPT-Image-2、限速和长上下文倍率,才能判断 OpenAI API 是否适合作为产品或编码 Agent 底座。

Token API
订阅套餐Token API

OpenAI API Token API 核心模型

GPT-5.6 SolGPT-5.6 TerraGPT-5.6 LunaGPT-Image-2GPT-Realtime-1.5GPT-Realtime-TranslateGPT-Realtime-Whisper
GPT-5.6 Sol

API 旗舰(gpt-5.6-sol,gpt-5.6 alias):Standard 输入 $5、输出 $30 / 百万 tokens,1,050,000 上下文、最大 128K 输出,支持 xhigh reasoning 与全套 Agent 工具,是复杂编码与专业任务默认首选。

GPT-5.6 Terra

更实惠的专业模型(gpt-5.6-terra):输入 $2、输出 $12 / 百万 tokens,1,050,000 上下文、最大 128K 输出,能力与成本平衡,适合作为生产主力。

GPT-5.6 Luna

低成本模型(gpt-5.6-luna):输入 $0.20、输出 $1.20 / 百万 tokens,1,050,000 上下文、最大 128K 输出,低延迟低成本,适合子 Agent 与大量轻量请求。

GPT-Image-2

最新图像生成/编辑 API,按图像与文本 modality 分别 token 计费(图像输出 $30/M 等),用于 images/generations 与 images/edits 端点。

GPT-Realtime-1.5

openai.com/api/pricing 当前最强实时语音模型,文本/音频/图像多 modality 分别定价,经 v1/realtime 提供低延迟语音对话。

更多模型详情请查看官网

其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。

前往官网

OpenAI API Token API 套餐 价格对比

GPT-5.6 Sol

旗舰推理推荐
输入价格
$5
输出价格
$30
用量
model id 为 gpt-5.6-sol(gpt-5.6 alias),当前 API 旗舰:Standard 输入 $5 / 百万 tokens、输出 $30 / 百万 tokens,1,050,000 上下文、最大 128K 输出,适合复杂推理、专业编码与多步 Agent。
模型
支持 reasoning.effort(none / low / medium / high / xhigh)、Functions、Web search、File search、Computer use、Code interpreter 等工具;可通过 Chat Completions 或 Responses API 调用。
特点
缓存命中输入仅 $0.50 / 百万 tokens;长上下文 >272K 输入时整段会话按更高倍率计费,重复前缀场景务必启用 Prompt caching。
适合把 OpenAI 当核心生产底座的复杂应用、Codex 类编码 Agent、长文档分析与高 stakes 知识工作流。
适合人群
复杂推理与编码任务、生产级 Agent 系统、需要最强 API 能力的开发者

GPT-5.6 Terra

高性价比旗舰
输入价格
$2
输出价格
$12
用量
model id 为 gpt-5.6-terra,定位「更实惠的专业工作模型」:输入 $2 / 百万 tokens、输出 $12 / 百万 tokens,1,050,000 上下文、最大 128K 输出,能力与成本介于 Sol 与 Luna 之间。
模型
同样支持 Functions、Web search、File search、Computer use 等工具链,适合大量生产请求中需要较强能力但希望控制单价的场景。
特点
缓存命中输入 $0.20 / 百万 tokens,Batch API 可再享约 50% 折扣,适合离线批处理与可延迟任务。
若 GPT-5.6 Sol 单价偏高而 Luna 能力不够,Terra 通常是 API 侧的主力平衡点。
适合人群
中等复杂度生产调用、需要 1,050,000 上下文但希望比 Sol 更省成本的团队

GPT-5.6 Luna

高速低成本
输入价格
$0.20
输出价格
$1.20
用量
model id 为 gpt-5.6-luna,当前低成本档:输入 $0.20 / 百万 tokens、输出 $1.20 / 百万 tokens,1,050,000 上下文、最大 128K 输出,面向编码、Computer use 与子 Agent。
模型
延迟更低、单价更省,适合高频轻量补全、路由前置分类、批量格式化与成本敏感的大量 API 调用。
特点
缓存命中输入可低至 $0.02 / 百万 tokens;需要更低延迟与成本时优先选择 Luna。
适合子 Agent、工具链中的中间步骤、以及「先跑 Luna、难题再升 Sol」的分层架构。
适合人群
高频批量调用、子 Agent、成本敏感的生产补全与轻量推理

GPT-Image-2

图像生成
输入价格
$8
输出价格
$30
用量
GPT-Image-2 是官方最新图像生成与编辑模型,图像 modality 输入 $8 / 百万 tokens、输出 $30 / 百万 tokens,文本输入 $5 / 百万 tokens(均有缓存命中价)。
模型
通过 v1/images/generations 与 v1/images/edits 等端点调用,适合应用内出图、广告素材与多模态工作流,不能简单套用纯 chat 的输入/输出单价。
特点
图像 token 化计费,实际单张成本取决于分辨率与提示复杂度;上线前应用 Playground 或小额测试估算。
适合人群
需要官方图像生成/编辑 API 的产品与创意工作流

GPT-Realtime-1.5

实时语音
输入价格
$4
输出价格
$24
用量
GPT-Realtime-1.5 面向实时语音交互,文本输入 $4 / 百万 tokens、输出 $24 / 百万 tokens;音频输入 $32 / 百万、输出 $64 / 百万;图像输入 $5 / 百万(均有缓存价)。
模型
通过 v1/realtime 会话接入,适合语音助手、客服与低延迟对话产品;成本需按音频时长与文本比例综合估算。
特点
与纯文本 chat 模型计费口径不同,选型时应单独对比 Realtime 与「Transcribe + chat + TTS」组合方案的总成本。
适合人群
实时语音产品、低延迟对话与多模态语音助手开发者

GPT-Realtime-Translate

同声传译
输入价格
$0.034
输出价格
分钟
用量
GPT-Realtime-Translate 提供实时语音同声传译,按 $0.034 / 分钟($0.00057 / 秒)计费,适合会议、直播与跨语言客服场景。
模型
不走传统输入/输出 token 单价,而是按音频时长计费;长时运行场景应提前估算分钟级成本。
适合人群
实时口译、跨语言会议与直播同传产品

GPT-Realtime-Whisper

流式转写
输入价格
$0.017
输出价格
分钟
用量
GPT-Realtime-Whisper 提供流式语音转文字,按 $0.017 / 分钟($0.00028 / 秒)计费,说话内容随讲随出文本。
模型
适合实时字幕、会议记录与语音输入链路;与 GPT-4o Transcribe 等批式转写模型定位不同,按场景选型。
适合人群
实时字幕、会议听写与低延迟语音输入应用

注意事项

  • 下列价格为 Standard 处理、上下文 <270K 的刊例价;Batch API 输入/输出约半价;Data residency 区域处理对 GPT-5.6 系列加收 10%。GPT-5.6 系列输入 >272K tokens 时整段请求输入 2x、输出 1.5x。
  • Prompt 缓存命中价:GPT-5.6 Sol 输入 $0.50/M、GPT-5.6 Terra $0.20/M、GPT-5.6 Luna $0.02/M;重复 system prompt 与长前缀场景应设计缓存以降本。
  • Web Search 工具 $10 / 千次调用(搜索内容 tokens 免费);Containers 按容器规格计费(2026/03/31 起改为按 20 分钟会话计费)。
  • ChatGPT Plus / Business / Enterprise 订阅不包含标准 API 用量;Playground 与生产 API 共用余额,按 dashboard 用量报表结算。

支持的编程工具

OpenAI APIResponses APIChat CompletionsCodex CLICursorCline

价格与模型数据均来源于厂商官方网站

常见问题

OpenAI API 的价格对比应该先看哪几个套餐价格?OpenAI API key 的官网入口和购买入口在哪里?OpenAI API key 申请后,Codex CLI、Cursor、Cline 要怎么接入配置?OpenAI API 有优惠、免费额度、年付或 Batch 缓存折扣吗?OpenAI API 的额度、限速和 usage limit 怎么重置?OpenAI API 支持哪些模型、工具和典型场景?

OpenAI API 的价格对比应该先看哪几个套餐价格?

OpenAI API 是按量计费,不是 ChatGPT Plus 或 Pro 的订阅额度;套餐价格主要体现在不同 GPT 文本模型、图像模型和实时语音模型的输入、输出或分钟单价。做价格对比时,先按 USD 口径比较入门文本模型 $0.20 / $1.20 每百万 tokens、旗舰文本模型 $5 / $30 每百万 tokens,再把 Web Search、Realtime、图像等工具成本单独计入。具体计费和刊例价以官网价格页为准。

OpenAI API key 的官网入口和购买入口在哪里?

OpenAI API 的官网入口是 platform.openai.com,购买入口和订阅入口都应从官方控制台进入,而不是从 ChatGPT 网页订阅页混用。注册后在控制台创建项目、充值或绑定账单,再进入 API keys 页面生成 key。页面里的 Playground 与生产 API 共用同一套余额。

OpenAI API key 申请后,Codex CLI、Cursor、Cline 要怎么接入配置?

API key 申请在 platform.openai.com 完成,接入 Codex CLI、Cursor、Cline 或自建服务时,把 key 配置到对应工具或服务端环境变量中即可。这里的开放 API 按量计费,和 ChatGPT Go/Plus/Pro 的订阅额度是边界清晰的两套体系;订阅不会赠送标准 API key 用量。生产环境建议只在服务端配置 key,避免暴露在前端。

OpenAI API 有优惠、免费额度、年付或 Batch 缓存折扣吗?

本文件没有写明固定首购优惠、免费额度或 API 年付价,是否有活动以官网和控制台为准。可明确利用的优惠主要是 Batch API 对输入和输出约 50% 折扣,以及 Prompt 缓存命中后的低价输入;重复 system prompt、长前缀和离线批处理都适合设计缓存或 Batch 来降本。不要把 ChatGPT 订阅折扣当成开放 API 折扣。

OpenAI API 的额度、限速和 usage limit 怎么重置?

OpenAI API 的额度主要看控制台余额、项目用量和 usage limit,不是 ChatGPT 订阅消息数。限速与 rate limit 会按账号、模型和接口能力分层,具体重置窗口与可提升额度以控制台提示为准;长上下文、Realtime、Batch 和工具调用也可能有独立使用限制。上线前应在 dashboard 里设置预算与告警。

OpenAI API 支持哪些模型、工具和典型场景?

本页覆盖 GPT 模型、图像模型、实时语音模型、同声传译和流式转写等能力,不在 FAQ 中写具体版本号。工具侧包括 Responses API、Chat Completions、Functions、Web Search、File Search、Computer use、Code interpreter,以及 Codex CLI、Cursor、Cline 等接入场景。复杂推理和专业编码可选旗舰 GPT 模型,高频轻量任务可选 mini 档,图像生成、语音助手和会议转写则应按 modality 或分钟成本单独估算。