对比 Gemini API 路由
从任务出发选择:旗舰推理、生产级 Flash 流量、低成本提取,或长上下文多模态分析。
| 路由 | 适合场景 | 价格 | 上下文窗口 | 模态 | 状态 |
|---|---|---|---|---|---|
Gemini 3.8 Flash 最新 Flash — GA | Google 最新 Flash,面向更高准确率的编程与智能体任务;需与 3.7 Flash 对比额外 Token 用量。 | $0.675/$3.375 per MTok | 1M | 文本、图片、视频、音频、PDF 输入 | 可用 |
Gemini 3.7 Flash Flash — GA | Gemini 3 系列 agentic 主力,代码生成与终端执行更强。 | $0.675/$3.375 per MTok | 1M | 文本 | 可用 |
Gemini 3.6 Flash Flash — GA | 最新 Flash 级高效主力,适合编程、agent 和知识类工作。 | $0.675/$3.375 per MTok | 1M | 文本 | 可用 |
Gemini 3.5 Flash-Lite Flash Lite | 快速的 3.5 级路由,适合高吞吐分类、提取和低延迟任务;默认只做最少量思考。 | $0.271/$2.25 per MTok | 1M | 文本 | 可用 |
| 最高质量的 Gemini 推理、编程、agent 和长上下文分析。 | $1.865/$11.183 <=200K; $3.73/$16.774 >200K | 1M input / 64K output | 文本、代码、图片、视频、音频、PDF 输入 | Preview flagship | |
Gemini 3.5 Flash 稳定版 — GA 可用于生产 | Agentic 工作流、编程 agent、子 agent 部署和长周期生产任务,Flash 级别成本。 | $1.35/$8.10 per MTok | 1M input / 65K output | 文本、图片、视频、音频、PDF 输入 | Stable (GA) |
Gemini 3 Flash Preview 高速 Gemini 3 | 需要 Gemini 3 能力和低延迟响应的多模态应用。 | $0.467/$2.796 per MTok (audio in: $0.933) | 1M input / 64K output | 文本、图片、视频、音频、PDF 输入 | Preview route |
Gemini 3.1 Flash Lite Preview Flash Lite | Gemini 3 代的大批量翻译、分类、提取和文本批处理任务。 | $0.234/$1.399 per MTok (audio in: $0.467) | 1M input / 64K output | 文本、图片、视频、音频、PDF 输入 | Preview route |
Gemini 2.5 Pro 稳定 Pro | 生产级推理、编程辅助、分析和复杂多模态任务。 | $1.165/$9.318 <=200K; $2.33/$13.977 >200K | 1M input / 64K output | 文本、图片、视频、音频、PDF 输入 | Stable deep reasoning |
Gemini 2.5 Flash 生产级 Flash | 快速聊天、提取、摘要和多模态生产流量。 | $0.281/$2.33 per MTok (audio in: $0.933) | 1M input / 64K output | 文本、图片、视频、音频、PDF 输入 | Production workhorse |
Gemini 2.5 Flash Lite Flash Lite | 高并发分类、提取、路由和轻量聊天流程。 | $0.095/$0.374 per MTok (audio in: $0.281) | 1M input / 64K output | 文本和音频输入 | Flash Lite |
如何判断该用哪个 Gemini 模型
按以下 4 条规则在 Pro、Flash 和 Lite 之间快速缩小选择范围。
先看推理深度
复杂编程 agent、多步工具调用、深度文档分析和高精度输出——首选 Gemini 3.1 Pro 或 Gemini 2.5 Pro。
再看延迟和吞吐需求
生产级聊天、客服机器人、实时提取和高频多模态应用——对比 Gemini 3 Flash 或 Gemini 2.5 Flash。
再看成本敏感度
大批量分类、文本批处理、路由分发和轻量提取——对比 Gemini 3.1 Flash Lite 或 Gemini 2.5 Flash Lite。
如果你已经清楚任务类型,可以在下表中找到推荐的起点。
按场景选择 Gemini 模型:推理、速度、成本和多模态任务
将你的主要任务匹配到合适的 Gemini 路由。
| 你的任务 | 推荐起点 | 适合场景 | 注意事项 |
|---|---|---|---|
| 复杂推理和编程 agent | Gemini 3.1 Pro | 需要最高质量的 Gemini 推理、多步工具调用或深度代码分析 | 比较当前 token 费率与每个完成任务的实际用量。 |
| 稳定深度推理 + 多模态 | Gemini 2.5 Pro | 需要生产级推理能力、广泛多模态支持和经过验证的稳定性 | 能力上限略低于 3.1 Pro |
| 更高准确率的编程与智能体工作流 | Gemini 3.8 Flash | 需要 Google 最新 Flash 路由处理编程、智能体、多模态分析与百万上下文 | Token 用量高于 3.7 Flash——请比较每个验收任务的总成本 |
| 低延迟多模态应用 | Gemini 3 Flash | 需要 Gemini 3 代能力的快速响应,覆盖文本、图像、音频和视频 | Preview 路由——请确认稳定性要求 |
| 生产级聊天和提取 | Gemini 2.5 Flash | 需要经过验证的生产级主力模型,处理聊天、摘要和大规模提取 | 大多数生产任务的良好默认选择 |
| 批量文本工作负载 | Gemini 2.5 Flash Lite | 任务是分类、路由或短回复,成本控制最重要 | 仅支持文本和音频输入 |
| 混合复杂度的文本任务 | EvoLink Smart Router | 同一流水线中既有简单任务也有复杂任务,跨 Gemini 和其他供应商 | 不想维护手动模型路由逻辑时最佳 |
Gemini API 工作流:agent、聊天、文档和多模态处理
看看 Gemini 模型如何融入真实产品、agent 和内容处理流水线。
推理和编程 agent
用于代码生成、bug 修复、多步工具调用和复杂分析 agent。如果输出质量直接影响产品表现,从 Gemini 3.1 Pro 开始测试;需要更稳定的表现则对比 Gemini 2.5 Pro。
生产级聊天和客服
适合客服机器人、应用内助手、知识库问答和高频多轮对话。先用 Gemini 2.5 Flash 验证吞吐,再用同一批流量跑 Flash Lite,结合当前每 token 费率比较回答质量。
长文档和多模态分析
用于 PDF 分析、视频理解、音频转录和多文件研究工作流。Gemini 的 1M 上下文窗口和原生多模态支持让 Pro 和 Flash 路由成为强有力的选择。
Agent 路由与混合任务
分类、提取、推理和生成共存于同一流水线的场景。使用 EvoLink Smart Router 通过 evolink/auto 在 Gemini 和其他供应商之间自动路由。
查看 Gemini 模型详情
在此页面对比后,访问各模型页面查看价格详情、Playground 和集成指南。
Gemini 3.8 Flash
最新 Flash — GA
- 上下文
- 1M
- 价格
- $0.675/$3.375 per MTok
Gemini 3.7 Flash
Flash — GA
- 上下文
- 1M
- 价格
- $0.675/$3.375 per MTok
Gemini 3.6 Flash
Flash — GA
- 上下文
- 1M
- 价格
- $0.675/$3.375 per MTok
Gemini 3.5 Flash-Lite
Flash Lite
- 上下文
- 1M
- 价格
- $0.271/$2.25 per MTok
Gemini 3.1 Pro Preview
旗舰推理
- 上下文
- 1M input / 64K output
- 价格
- $1.865/$11.183 <=200K; $3.73/$16.774 >200K
Gemini 3.5 Flash
稳定版 — GA 可用于生产
- 上下文
- 1M input / 65K output
- 价格
- $1.35/$8.10 per MTok
Gemini 3 Flash Preview
高速 Gemini 3
- 上下文
- 1M input / 64K output
- 价格
- $0.467/$2.796 per MTok (audio in: $0.933)
Gemini 3.1 Flash Lite Preview
Flash Lite
- 上下文
- 1M input / 64K output
- 价格
- $0.234/$1.399 per MTok (audio in: $0.467)
Gemini 2.5 Pro
稳定 Pro
- 上下文
- 1M input / 64K output
- 价格
- $1.165/$9.318 <=200K; $2.33/$13.977 >200K
Gemini 2.5 Flash
生产级 Flash
- 上下文
- 1M input / 64K output
- 价格
- $0.281/$2.33 per MTok (audio in: $0.933)
Gemini 2.5 Flash Lite
Flash Lite
- 上下文
- 1M input / 64K output
- 价格
- $0.095/$0.374 per MTok (audio in: $0.281)
通过一个 EvoLink API 访问所有 Gemini 模型
全部 11 条 Gemini 路由均通过单个 EvoLink API key 和 OpenAI 兼容端点提供。只需更改 model 参数即可在 Pro、Flash 和 Lite 之间切换,无需额外账号或密钥。
将 model="gemini-3.1-pro" 改为 model="gemini-2.5-flash",无需重构集成。如何看待 Gemini API 成本:Pro vs Flash vs Lite
Pro 路由:推理价值证明溢价合理
Gemini 3.1 Pro / Gemini 2.5 Pro — 适合评估复杂编程、文档分析和多步推理;请比较完成任务的质量与实际成本。
Flash 路由:生产流量的最佳平衡
Gemini 3 Flash 和 2.5 Flash 以 Pro 价格的零头提供强大的多模态能力。在考虑 Pro 之前,先用这些路由处理聊天、摘要和大规模提取。
Lite 路由:最大限度降低简单高并发任务成本
Gemini 3.1 Flash Lite 和 2.5 Flash Lite 适合先测试分类、路由、批量文本和短回复等不依赖深度推理的场景。上量前先到各模型页核对当前的每 token 费率。
价格概览
输入价区间: $0.095–$3.73 / 1M tokens (EvoLink).
Gemini 3.8 Flash
$0.675/$3.375 /MTok
Context: 1M
Google 最新一代 Flash,代码与 Agent 任务精度更高,1M 上下文;token 用量比 3.7 Flash 更高,预算要留出余量。
Gemini 3.7 Flash
$0.675/$3.375 /MTok
Context: 1M
Gemini 3.7 Flash · 输入 $0.675 · 输出 $3.375 / 1M tokens.
Gemini 3.6 Flash
$0.675/$3.375 /MTok
Context: 1M
高效 Flash 级模型,$0.675/$3.375 per MTok,多步编排与代码重构表现稳定,1M 上下文。
Gemini 3.5 Flash-Lite
$0.271/$2.25 /MTok
Context: 1M
Gemini 3.5 Flash-Lite · 输入 $0.271 · 输出 $2.25 / 1M tokens.
Gemini 3.1 Pro
$1.865/$11.183 — $3.73/$16.774 /MTok
Context: 1M
旗舰推理,1M 上下文。分级定价:200K 以内 $1.865/$11.183,200K 以上 $3.73/$16.774。
Gemini 3.5 Flash
$1.35/$8.10 /MTok
Context: 1M
GA 稳定版 Flash,适合 agentic 工作流和编程,$1.35/$8.10 per MTok,1M 上下文,内置推理。
Gemini 3 Flash
$0.467/$2.796 /MTok
Context: 1M
Gemini 3 代 Flash 路由,$0.467/$2.796 per MTok,1M 上下文。
Gemini 3.1 Flash Lite
$0.234/$1.399 /MTok
Context: 1M
Gemini 3.1 Flash Lite · 输入 $0.234 · 输出 $1.399 / 1M tokens.
Gemini 2.5 Pro
$1.165/$9.318 — $2.33/$13.977 /MTok
Context: 1M
稳定深度推理,200K 以内 $1.165/$9.318,200K 以上 $2.33/$13.977。
Gemini 2.5 Flash
$0.281/$2.33 /MTok
Context: 1M
生产主力,$0.281/$2.33 per MTok,支持全多模态。
Gemini 2.5 Flash Lite
$0.095/$0.374 /MTok
Context: 1M
Gemini 2.5 Flash Lite · 输入 $0.095 · 输出 $0.374 / 1M tokens.
Gemini 指南与对比
在选择路由前,可以参考这些指南获取更多背景信息。
Gemini 3.8 Flash vs Gemini 3.7 Flash
对比准确率、Token 消耗、价格周期和每个验收任务的总成本。
Gemini 3.8 Flash API 怎么用
完成首次请求、参数迁移,并加入生产灰度与回滚控制。
Gemini 3 Pro 弃用迁移指南
将旧版 Gemini 3 Pro Preview 流量迁移到当前 Gemini 路由,避免影响生产环境。
OpenCode 集成 Gemini 路由
了解如何通过 EvoLink 的统一 API 层同时使用 Gemini、Claude 和 GPT 模型。
Gemini 3.5 Pro API 发布追踪
追踪公开 API 可用性、Google 官方确认与发布延期报道。
Gemini 3.5 Pro vs Gemini 3.5 Flash
在选择模型前,对比 Flash 已确认数据与仍待发布的 Pro 路由。
Gemini 4 API 可用状态
Google 已确认 Gemini 4 开始预训练;追踪公共 API 状态、模型 ID、价格与 EvoLink 路由核验进展。
Gemini API 常见问题
Everything you need to know about the product and billing.