Gemini API
Gemini API 这页用于比较 Google AI Studio / Vertex AI 官网入口、API key 申请、价格与免费额度,而不是 Google AI Plus / Pro / Ultra 订阅额度:Gemini 3.1 Flash-Lite 从输入 $0.25、输出 $1.50/百万 tokens 起步,Gemini 3.5 Flash 是 $1.50/$9 的搜索 grounding 高速主力,Gemini 3.1 Pro 按 ≤200K 与 >200K 上下文分档计费。这里会把 Paid tier、限速、Batch API 半价、Context caching 存储费、Flex / Priority、Grounding 每月 5,000 次免费后 $14/千次、Live API 和图像生成计费口径放在一起,方便判断 Gemini API 是否适合生产应用、AI Studio 试用或搜索增强 Agent。
Gemini API Token API 核心模型
API 高速旗舰(gemini-3.5-flash):$1.50 输入 / $9 输出 per MTok,frontier 智能 + search grounding,Free tier 可试用。
API 最强 Pro 预览(gemini-3.1-pro-preview):$2/$12 per MTok(≤200K),多模态 Agent 与 vibe-coding,Paid only。
极致性价比(gemini-3.1-flash-lite):$0.25/$1.50 per MTok,高 volume Agent 与翻译首选。
上一代 Pro(gemini-2.5-pro):$1.25/$10 per MTok(≤200K),编码与复杂推理;新集成优先 3.x 系列。
图像生成 API(gemini-3.1-flash-image):文本输入 $0.50/M,图像输出按分辨率计价(约 $0.045–$0.151/张),与纯 chat 计费分离。
其余核心模型名称仍在上方展示,完整说明以官网最新页面为准。
Gemini API Token API 套餐 价格对比
Gemini 3.5 Flash
旗舰高速推荐Gemini 3.5 Flash
旗舰高速推荐适合需要搜索 grounding、快速 Agent 循环与日常生产 API 的默认选型;复杂多模态 Agent 可升 3.1 Pro。
Gemini 3.1 Pro
旗舰 ProGemini 3.1 Pro
旗舰 Pro与 gemini.google 订阅里的 3.1 Pro 是同一模型族,但 API 按 token 独立计费,不受 Plus / Pro / Ultra 用量倍数约束。
Gemini 3.1 Flash-Lite
极致性价比Gemini 3.1 Flash-Lite
极致性价比音频输入 Standard $0.50/M、Batch $0.25/M,集成语音场景时需单独估算。
Gemini 2.5 Pro
上一代 ProGemini 2.5 Pro
上一代 Pro已有 2.5 Pro 集成的存量系统可继续计费运行,迁移计划应评估 3.1 Pro 的多模态 Agent 收益。
Gemini 2.5 Flash
混合推理Gemini 2.5 Flash
混合推理适合需要可控 thinking 深度、1M 上下文但不必上 3.5 Flash 价位的生产场景。
Gemini 3.1 Flash Image
图像生成Gemini 3.1 Flash Image
图像生成Gemini 3.1 Flash Live
实时对话Gemini 3.1 Flash Live
实时对话注意事项
- 下列价格为 Paid tier Standard 处理、USD / 百万 tokens;Free tier 在 AI Studio 对部分模型提供免费输入/输出额度(内容可能用于改进产品),生产环境应升级 Paid。
- Gemini 3.1 Pro / 2.5 Pro 输入输出在 prompt ≤200K 与 >200K tokens 时分档计价(如 3.1 Pro Standard:$2/$12 vs $4/$18 per MTok)。
- Batch API 输入/输出约 50% 折扣;Context caching 另计 storage 费用(通常 $0.50–$4.50 / 百万 tokens / 小时,因模型而异)。
- 图像生成(3.1 Flash Image 等)与 Live API 音频/视频计费口径与纯文本 chat 不同;集成前需按场景单独估算。
支持的编程工具
价格与模型数据均来源于厂商官方网站
常见问题
Gemini API 做价格对比时,Flash、Pro 和 Flash-Lite 怎么选?
Gemini API 是 USD 口径的按量计费,不是 Google AI Plus / Pro / Ultra 订阅额度。套餐价格可按输入、输出、上下文长度和是否用 Grounding 来做价格对比:Flash-Lite 起步最低,Flash 更适合高速生产与搜索增强,Pro 适合复杂多模态和长上下文任务。实际计费还会受 Standard、Flex、Priority、Batch 与缓存读写影响,最终以 ai.google.dev 定价页为准。
Gemini API 的官网入口、购买入口和控制台分别在哪里?
Gemini API 的官网入口和官方入口是 ai.google.dev,日常试用与购买入口通常从 Google AI Studio 开始。控制台侧可以在 AI Studio 管理 API key、项目与 Paid tier,企业部署也可走 Vertex AI。订阅入口 gemini.google/subscriptions 面向消费者 Gemini 订阅,不等同于开放 API 的购买入口。
Gemini API key 申请后,和 Google AI 订阅额度有什么边界?
Gemini API key 申请、接入和配置在 Google AI Studio / ai.google.dev 完成,用于开放 API 调用并按 token 独立计费。Google AI Plus / Pro / Ultra 的订阅额度只用于 Gemini App、Workspace 等消费者权益,不会自动变成 API key 额度。自建应用、Agent 或 Vertex AI 集成要单独配置 API 项目、账单和权限。
Gemini API 有优惠、免费额度、Batch 或缓存折扣吗?
AI Studio 的 Free tier 对部分 Gemini 模型有免费额度,但有速率限制,生产环境通常要升级 Paid tier。优惠主要体现在 Batch API 对输入/输出约 50% 折扣,缓存可降低重复长前缀读取成本,但缓存 storage 会另按小时计费。年付、首购或额外折扣没有在该文件中明确列出,需以官网活动为准。
Gemini API 的额度、限速和 usage limit 怎么重置?
Gemini API 的额度和限速取决于 Free tier 或 Paid tier、模型、RPS/TPM/RPM 等 usage limit,以及 Google 对项目的动态风控。Free tier 通常 rate limit 更低,Paid tier 提供更高吞吐,但具体使用限制与重置规则要看 AI Studio 或 Vertex AI 控制台展示。不要把 Gemini App 的 5 小时订阅刷新规则当成开放 API 重置规则。
Gemini API 的模型、工具和能力适合哪些场景?
Gemini API 覆盖 Gemini 模型中的文本模型、推理模型、图像模型和 Live API 实时能力,不在 FAQ 中区分具体版本号。工具上可结合 Google AI Studio、Vertex AI、Batch API、Context Caching、Grounding 和 Live API:搜索增强 Agent 适合 Flash,复杂多模态与代码场景适合 Pro,高 volume 翻译或分类适合 Flash-Lite。图像生成和语音/视频场景的计费口径不同,集成前要单独估算。