GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验
Gemini 模型系列

Gemini API 模型系列

通过一个 EvoLink API 对比 Gemini 3.8 Flash、3.7 Flash、Pro、Flash 与 Lite 路由的当前价格、上下文、模态、准确率和 Token 用量,为任务选择合适模型。

Gemini 4 尚未发布,目前没有公开 API,也没有 EvoLink 路由。追踪 Gemini 4 API 接入进展

对比 Gemini API 路由

从任务出发选择:旗舰推理、生产级 Flash 流量、低成本提取,或长上下文多模态分析。

路由适合场景价格上下文窗口模态状态
Gemini 3.8 Flash

最新 Flash — GA

Google 最新 Flash,面向更高准确率的编程与智能体任务;需与 3.7 Flash 对比额外 Token 用量。$0.675/$3.375 per MTok1M文本、图片、视频、音频、PDF 输入可用
Gemini 3.7 Flash

Flash — GA

Gemini 3 系列 agentic 主力,代码生成与终端执行更强。$0.675/$3.375 per MTok1M文本可用
Gemini 3.6 Flash

Flash — GA

最新 Flash 级高效主力,适合编程、agent 和知识类工作。$0.675/$3.375 per MTok1M文本可用
快速的 3.5 级路由,适合高吞吐分类、提取和低延迟任务;默认只做最少量思考。$0.271/$2.25 per MTok1M文本可用
最高质量的 Gemini 推理、编程、agent 和长上下文分析。$1.865/$11.183 <=200K; $3.73/$16.774 >200K1M input / 64K output文本、代码、图片、视频、音频、PDF 输入Preview flagship
Gemini 3.5 Flash

稳定版 — GA 可用于生产

Agentic 工作流、编程 agent、子 agent 部署和长周期生产任务,Flash 级别成本。$1.35/$8.10 per MTok1M input / 65K output文本、图片、视频、音频、PDF 输入Stable (GA)
Gemini 3 Flash Preview

高速 Gemini 3

需要 Gemini 3 能力和低延迟响应的多模态应用。$0.467/$2.796 per MTok (audio in: $0.933)1M input / 64K output文本、图片、视频、音频、PDF 输入Preview route
Gemini 3 代的大批量翻译、分类、提取和文本批处理任务。$0.234/$1.399 per MTok (audio in: $0.467)1M input / 64K output文本、图片、视频、音频、PDF 输入Preview route
Gemini 2.5 Pro

稳定 Pro

生产级推理、编程辅助、分析和复杂多模态任务。$1.165/$9.318 <=200K; $2.33/$13.977 >200K1M input / 64K output文本、图片、视频、音频、PDF 输入Stable deep reasoning
Gemini 2.5 Flash

生产级 Flash

快速聊天、提取、摘要和多模态生产流量。$0.281/$2.33 per MTok (audio in: $0.933)1M input / 64K output文本、图片、视频、音频、PDF 输入Production workhorse
高并发分类、提取、路由和轻量聊天流程。$0.095/$0.374 per MTok (audio in: $0.281)1M input / 64K output文本和音频输入Flash Lite

如何判断该用哪个 Gemini 模型

按以下 4 条规则在 Pro、Flash 和 Lite 之间快速缩小选择范围。

1

先看推理深度

复杂编程 agent、多步工具调用、深度文档分析和高精度输出——首选 Gemini 3.1 Pro 或 Gemini 2.5 Pro。

2

再看延迟和吞吐需求

生产级聊天、客服机器人、实时提取和高频多模态应用——对比 Gemini 3 Flash 或 Gemini 2.5 Flash。

3

再看成本敏感度

大批量分类、文本批处理、路由分发和轻量提取——对比 Gemini 3.1 Flash Lite 或 Gemini 2.5 Flash Lite。

4

最后考虑混合复杂度场景

如果同一流水线混合了简单分类和深度推理步骤,可以考虑 EvoLink Smart Router 而不是固定一个 Gemini 模型。

Smart Router →

如果你已经清楚任务类型,可以在下表中找到推荐的起点。

按场景选择 Gemini 模型:推理、速度、成本和多模态任务

将你的主要任务匹配到合适的 Gemini 路由。

你的任务推荐起点适合场景注意事项
复杂推理和编程 agentGemini 3.1 Pro需要最高质量的 Gemini 推理、多步工具调用或深度代码分析比较当前 token 费率与每个完成任务的实际用量。
稳定深度推理 + 多模态Gemini 2.5 Pro需要生产级推理能力、广泛多模态支持和经过验证的稳定性能力上限略低于 3.1 Pro
更高准确率的编程与智能体工作流Gemini 3.8 Flash需要 Google 最新 Flash 路由处理编程、智能体、多模态分析与百万上下文Token 用量高于 3.7 Flash——请比较每个验收任务的总成本
低延迟多模态应用Gemini 3 Flash需要 Gemini 3 代能力的快速响应,覆盖文本、图像、音频和视频Preview 路由——请确认稳定性要求
生产级聊天和提取Gemini 2.5 Flash需要经过验证的生产级主力模型,处理聊天、摘要和大规模提取大多数生产任务的良好默认选择
批量文本工作负载Gemini 2.5 Flash Lite任务是分类、路由或短回复,成本控制最重要仅支持文本和音频输入
混合复杂度的文本任务EvoLink Smart Router同一流水线中既有简单任务也有复杂任务,跨 Gemini 和其他供应商不想维护手动模型路由逻辑时最佳

Gemini API 工作流:agent、聊天、文档和多模态处理

看看 Gemini 模型如何融入真实产品、agent 和内容处理流水线。

推理和编程 agent

用于代码生成、bug 修复、多步工具调用和复杂分析 agent。如果输出质量直接影响产品表现,从 Gemini 3.1 Pro 开始测试;需要更稳定的表现则对比 Gemini 2.5 Pro。

生产级聊天和客服

适合客服机器人、应用内助手、知识库问答和高频多轮对话。先用 Gemini 2.5 Flash 验证吞吐,再用同一批流量跑 Flash Lite,结合当前每 token 费率比较回答质量。

长文档和多模态分析

用于 PDF 分析、视频理解、音频转录和多文件研究工作流。Gemini 的 1M 上下文窗口和原生多模态支持让 Pro 和 Flash 路由成为强有力的选择。

Agent 路由与混合任务

分类、提取、推理和生成共存于同一流水线的场景。使用 EvoLink Smart Router 通过 evolink/auto 在 Gemini 和其他供应商之间自动路由。

查看 Gemini 模型详情

在此页面对比后,访问各模型页面查看价格详情、Playground 和集成指南。

通过一个 EvoLink API 访问所有 Gemini 模型

全部 11 条 Gemini 路由均通过单个 EvoLink API key 和 OpenAI 兼容端点提供。只需更改 model 参数即可在 Pro、Flash 和 Lite 之间切换,无需额外账号或密钥。

将 model="gemini-3.1-pro" 改为 model="gemini-2.5-flash",无需重构集成。
一个 API key 访问所有 Gemini 模型
兼容 OpenAI 的接入端点
更改 model 参数即可切换模型
统一的账单和用量可视化

如何看待 Gemini API 成本:Pro vs Flash vs Lite

Pro 路由:推理价值证明溢价合理

Gemini 3.1 Pro / Gemini 2.5 Pro — 适合评估复杂编程、文档分析和多步推理;请比较完成任务的质量与实际成本。

Flash 路由:生产流量的最佳平衡

Gemini 3 Flash 和 2.5 Flash 以 Pro 价格的零头提供强大的多模态能力。在考虑 Pro 之前,先用这些路由处理聊天、摘要和大规模提取。

Lite 路由:最大限度降低简单高并发任务成本

Gemini 3.1 Flash Lite 和 2.5 Flash Lite 适合先测试分类、路由、批量文本和短回复等不依赖深度推理的场景。上量前先到各模型页核对当前的每 token 费率。

价格概览

输入价区间: $0.095–$3.73 / 1M tokens (EvoLink).

Gemini 3.8 Flash

$0.675/$3.375 /MTok

Context: 1M

Google 最新一代 Flash,代码与 Agent 任务精度更高,1M 上下文;token 用量比 3.7 Flash 更高,预算要留出余量。

Gemini 3.7 Flash

$0.675/$3.375 /MTok

Context: 1M

Gemini 3.7 Flash · 输入 $0.675 · 输出 $3.375 / 1M tokens.

Gemini 3.6 Flash

$0.675/$3.375 /MTok

Context: 1M

高效 Flash 级模型,$0.675/$3.375 per MTok,多步编排与代码重构表现稳定,1M 上下文。

Gemini 3.5 Flash-Lite

$0.271/$2.25 /MTok

Context: 1M

Gemini 3.5 Flash-Lite · 输入 $0.271 · 输出 $2.25 / 1M tokens.

Gemini 3.1 Pro

$1.865/$11.183 — $3.73/$16.774 /MTok

Context: 1M

旗舰推理,1M 上下文。分级定价:200K 以内 $1.865/$11.183,200K 以上 $3.73/$16.774。

Gemini 3.5 Flash

$1.35/$8.10 /MTok

Context: 1M

GA 稳定版 Flash,适合 agentic 工作流和编程,$1.35/$8.10 per MTok,1M 上下文,内置推理。

Gemini 3 Flash

$0.467/$2.796 /MTok

Context: 1M

Gemini 3 代 Flash 路由,$0.467/$2.796 per MTok,1M 上下文。

Gemini 3.1 Flash Lite

$0.234/$1.399 /MTok

Context: 1M

Gemini 3.1 Flash Lite · 输入 $0.234 · 输出 $1.399 / 1M tokens.

Gemini 2.5 Pro

$1.165/$9.318 — $2.33/$13.977 /MTok

Context: 1M

稳定深度推理,200K 以内 $1.165/$9.318,200K 以上 $2.33/$13.977。

Gemini 2.5 Flash

$0.281/$2.33 /MTok

Context: 1M

生产主力,$0.281/$2.33 per MTok,支持全多模态。

Gemini 2.5 Flash Lite

$0.095/$0.374 /MTok

Context: 1M

Gemini 2.5 Flash Lite · 输入 $0.095 · 输出 $0.374 / 1M tokens.

Gemini 指南与对比

在选择路由前,可以参考这些指南获取更多背景信息。

Gemini API 常见问题

Everything you need to know about the product and billing.

更高准确率的编程与智能体工作流先评估 Gemini 3.8 Flash,更看重 Token 效率时选 Gemini 3.7 Flash,最高推理质量选 Gemini 3.1 Pro,成本优先选 Flash Lite。
适合。多条 Gemini 路由支持超大 context window,非常适合 PDF 分析、文档审阅、检索工作流和多文件推理。
回答质量、编程和多步推理优先时选 Pro;速度、生产吞吐量和可控成本优先时选 Flash。
EvoLink 列出 11 条 Gemini 路由,包括 Gemini 3.8 Flash、3.7 Flash、3.6 Flash、3.5 Flash-Lite、3.1 Pro、3.5 Flash、3 Flash Preview、3.1 Flash Lite Preview,以及 Gemini 2.5 Pro、Flash 和 Flash Lite。全部可通过一个 API key 和 OpenAI 兼容端点访问。
此集合当前最低输入价: Gemini 2.5 Flash Lite. 输入 $0.095 · 输出 $0.374 / 1M tokens.
可以。EvoLink 提供单个 API key 访问所有 Gemini 模型,以及 GPT、Claude 等 170+ 其他模型。只需更改 model 参数即可切换,无需额外账号或密钥。