返回全部对比

Gemini API

按量计费·1M 上下文

Gemini API 这页用于比较 Google AI Studio / Vertex AI 官网入口、API key 申请、价格与免费额度,而不是 Google AI Plus / Pro / Ultra 订阅额度:Gemini 3.1 Flash-Lite 从输入 $0.25、输出 $1.50/百万 tokens 起步,Gemini 3.5 Flash 是 $1.50/$9 的搜索 grounding 高速主力,Gemini 3.1 Pro 按 ≤200K 与 >200K 上下文分档计费。这里会把 Paid tier、限速、Batch API 半价、Context caching 存储费、Flex / Priority、Grounding 每月 5,000 次免费后 $14/千次、Live API 和图像生成计费口径放在一起,方便判断 Gemini API 是否适合生产应用、AI Studio 试用或搜索增强 Agent。

Token API
订阅套餐Token API

Gemini API Token API 核心模型

Gemini 3.5 FlashGemini 3.1 ProGemini 3.1 Flash-LiteGemini 2.5 ProGemini 2.5 FlashGemini 3.1 Flash ImageGemini 3.1 Flash Live
Gemini 3.5 Flash

API 高速旗舰(gemini-3.5-flash):$1.50 输入 / $9 输出 per MTok,frontier 智能 + search grounding,Free tier 可试用。

Gemini 3.1 Pro

API 最强 Pro 预览(gemini-3.1-pro-preview):$2/$12 per MTok(≤200K),多模态 Agent 与 vibe-coding,Paid only。

Gemini 3.1 Flash-Lite

极致性价比(gemini-3.1-flash-lite):$0.25/$1.50 per MTok,高 volume Agent 与翻译首选。

Gemini 2.5 Pro

上一代 Pro(gemini-2.5-pro):$1.25/$10 per MTok(≤200K),编码与复杂推理;新集成优先 3.x 系列。

Gemini 3.1 Flash Image

图像生成 API(gemini-3.1-flash-image):文本输入 $0.50/M,图像输出按分辨率计价(约 $0.045–$0.151/张),与纯 chat 计费分离。

更多模型详情请查看官网

其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。

前往官网

Gemini API Token API 套餐 价格对比

Gemini 3.5 Flash

旗舰高速推荐
输入价格
$1.50
输出价格
$9
用量
model id 为 gemini-3.5-flash,当前 API 主推的高速旗舰:Standard 输入 $1.50 / 百万 tokens、输出 $9 / 百万 tokens,结合前沿智能与 superior search / grounding。
模型
Free tier 在 AI Studio 可免费调用(有速率限制);Paid tier 解锁更高 RPS、Context caching 与 Grounding with Google Search / Maps。
特点
Batch API 输入 $0.75/M、输出 $4.50/M;Flex 与 Priority 档分别 $0.75/$4.50 与 $2.70/$16.20 per MTok,适合延迟敏感与高峰吞吐场景。
适合需要搜索 grounding、快速 Agent 循环与日常生产 API 的默认选型;复杂多模态 Agent 可升 3.1 Pro。
适合人群
搜索 grounding Agent、高速生产 API、日常智能应用

Gemini 3.1 Pro

旗舰 Pro
输入价格
$2
输出价格
$12
用量
model id 为 gemini-3.1-pro-preview(及 customtools 变体),当前最强多模态理解 + Agent / vibe-coding 能力之一。
模型
Standard 计价:prompt ≤200K tokens 时输入 $2 / 输出 $12 per MTok;超过 200K 时输入 $4 / 输出 $18 per MTok。
特点
Paid tier only(Free tier 不可用);支持 Context caching、Batch 半价与 Grounding;适合复杂代码库分析、长文档 Agent 与高自主性工作流。
与 gemini.google 订阅里的 3.1 Pro 是同一模型族,但 API 按 token 独立计费,不受 Plus / Pro / Ultra 用量倍数约束。
适合人群
复杂 Agent、长上下文多模态、vibe-coding 与 repo 级分析

Gemini 3.1 Flash-Lite

极致性价比
输入价格
$0.25
输出价格
$1.50
用量
model id 为 gemini-3.1-flash-lite,官方定位最高性价比:Standard 文本/图像/视频输入 $0.25 / 百万 tokens、输出 $1.50 / 百万 tokens。
模型
优化高 volume Agent 任务、翻译与简单数据处理;Free tier 可免费调用,Paid 解锁 caching 与更高 RPS。
特点
Batch API 输入 $0.125/M、输出 $0.75/M;适合路由层、批量分类与成本敏感的大规模调用。
音频输入 Standard $0.50/M、Batch $0.25/M,集成语音场景时需单独估算。
适合人群
高并发轻量任务、翻译、路由与子 Agent

Gemini 2.5 Pro

上一代 Pro
输入价格
$1.25
输出价格
$10
用量
model id 为 gemini-2.5-pro,上一代多用途旗舰,擅长编码与复杂推理;新集成优先 3.5 Flash / 3.1 Pro。
模型
Standard:prompt ≤200K 时 $1.25 输入 / $10 输出 per MTok;超过 200K 时 $2.50 / $15 per MTok。
特点
Free tier 可免费调用(有限制);Grounding with Google Search 1,500 RPD 免费后 $35 / 千次 grounded prompts。
已有 2.5 Pro 集成的存量系统可继续计费运行,迁移计划应评估 3.1 Pro 的多模态 Agent 收益。
适合人群
存量 2.5 Pro 集成、编码与复杂推理(迁移中)

Gemini 2.5 Flash

混合推理
输入价格
$0.30
输出价格
$2.50
用量
model id 为 gemini-2.5-flash,首个支持 thinking budgets 的混合推理 Flash,1M token 上下文窗口。
模型
Standard 文本/图像/视频输入 $0.30 / 百万 tokens、输出 $2.50 / 百万 tokens;Free tier 可免费调用。
特点
Grounding with Google Search 与 Flash-Lite 共享 500 RPD(Free)/ 1,500 RPD(Paid)免费额度。
适合需要可控 thinking 深度、1M 上下文但不必上 3.5 Flash 价位的生产场景。
适合人群
1M 上下文、可控 thinking、中等成本生产 API

Gemini 3.1 Flash Image

图像生成
输入价格
$0.50
输出价格
$0.067
用量
model id 为 gemini-3.1-flash-image,面向高速交互式图像生成与编辑;Standard 文本/图像输入 $0.50 / 百万 tokens。
模型
图像输出按 token 计价($60/M image tokens):0.5K 约 $0.045/张、1K $0.067、2K $0.101、4K $0.151;与纯 chat API 计费口径不同。
特点
Batch API 输入 $0.25/M、图像输出 $30/M(约半价);Paid tier only,适合高吞吐视觉生成流水线。
适合人群
图像生成、编辑与高吞吐视觉 API

Gemini 3.1 Flash Live

实时对话
输入价格
$0.75
输出价格
$4.50
用量
model id 为 gemini-3.1-flash-live-preview,低延迟 audio-to-audio 实时对话模型,支持声学细节、数值精度与多模态感知。
模型
Paid tier Standard:文本输入 $0.75 / 输出 $4.50 per MTok;音频输入 $3 或约 $0.005/min、输出 $12 或约 $0.018/min;图像/视频输入 $1 或约 $0.002/min。
特点
Free tier 可免费调用(有速率限制);适合语音助手、实时翻译与 voice-first Agent,集成前需单独估算音频/视频分钟成本。
适合人群
实时语音对话、Live API 与 voice-first 应用

注意事项

  • 下列价格为 Paid tier Standard 处理、USD / 百万 tokens;Free tier 在 AI Studio 对部分模型提供免费输入/输出额度(内容可能用于改进产品),生产环境应升级 Paid。
  • Gemini 3.1 Pro / 2.5 Pro 输入输出在 prompt ≤200K 与 >200K tokens 时分档计价(如 3.1 Pro Standard:$2/$12 vs $4/$18 per MTok)。
  • Batch API 输入/输出约 50% 折扣;Context caching 另计 storage 费用(通常 $0.50–$4.50 / 百万 tokens / 小时,因模型而异)。
  • 图像生成(3.1 Flash Image 等)与 Live API 音频/视频计费口径与纯文本 chat 不同;集成前需按场景单独估算。

支持的编程工具

Gemini APIGoogle AI StudioVertex AIContext CachingBatch APIGroundingLive API

价格与模型数据均来源于厂商官方网站

常见问题

Gemini API 做价格对比时,Flash、Pro 和 Flash-Lite 怎么选?Gemini API 的官网入口、购买入口和控制台分别在哪里?Gemini API key 申请后,和 Google AI 订阅额度有什么边界?Gemini API 有优惠、免费额度、Batch 或缓存折扣吗?Gemini API 的额度、限速和 usage limit 怎么重置?Gemini API 的模型、工具和能力适合哪些场景?

Gemini API 做价格对比时,Flash、Pro 和 Flash-Lite 怎么选?

Gemini API 是 USD 口径的按量计费,不是 Google AI Plus / Pro / Ultra 订阅额度。套餐价格可按输入、输出、上下文长度和是否用 Grounding 来做价格对比:Flash-Lite 起步最低,Flash 更适合高速生产与搜索增强,Pro 适合复杂多模态和长上下文任务。实际计费还会受 Standard、Flex、Priority、Batch 与缓存读写影响,最终以 ai.google.dev 定价页为准。

Gemini API 的官网入口、购买入口和控制台分别在哪里?

Gemini API 的官网入口和官方入口是 ai.google.dev,日常试用与购买入口通常从 Google AI Studio 开始。控制台侧可以在 AI Studio 管理 API key、项目与 Paid tier,企业部署也可走 Vertex AI。订阅入口 gemini.google/subscriptions 面向消费者 Gemini 订阅,不等同于开放 API 的购买入口。

Gemini API key 申请后,和 Google AI 订阅额度有什么边界?

Gemini API key 申请、接入和配置在 Google AI Studio / ai.google.dev 完成,用于开放 API 调用并按 token 独立计费。Google AI Plus / Pro / Ultra 的订阅额度只用于 Gemini App、Workspace 等消费者权益,不会自动变成 API key 额度。自建应用、Agent 或 Vertex AI 集成要单独配置 API 项目、账单和权限。

Gemini API 有优惠、免费额度、Batch 或缓存折扣吗?

AI Studio 的 Free tier 对部分 Gemini 模型有免费额度,但有速率限制,生产环境通常要升级 Paid tier。优惠主要体现在 Batch API 对输入/输出约 50% 折扣,缓存可降低重复长前缀读取成本,但缓存 storage 会另按小时计费。年付、首购或额外折扣没有在该文件中明确列出,需以官网活动为准。

Gemini API 的额度、限速和 usage limit 怎么重置?

Gemini API 的额度和限速取决于 Free tier 或 Paid tier、模型、RPS/TPM/RPM 等 usage limit,以及 Google 对项目的动态风控。Free tier 通常 rate limit 更低,Paid tier 提供更高吞吐,但具体使用限制与重置规则要看 AI Studio 或 Vertex AI 控制台展示。不要把 Gemini App 的 5 小时订阅刷新规则当成开放 API 重置规则。

Gemini API 的模型、工具和能力适合哪些场景?

Gemini API 覆盖 Gemini 模型中的文本模型、推理模型、图像模型和 Live API 实时能力,不在 FAQ 中区分具体版本号。工具上可结合 Google AI Studio、Vertex AI、Batch API、Context Caching、Grounding 和 Live API:搜索增强 Agent 适合 Flash,复杂多模态与代码场景适合 Pro,高 volume 翻译或分类适合 Flash-Lite。图像生成和语音/视频场景的计费口径不同,集成前要单独估算。