Seedance 2.5 已上线 EvoLink立即体验
一条高速 AI 光路穿过暗色生产网关
发布观察

Gemini 3.7 Flash 发布:2026 年 8 月 13 日上线了什么

EvoLink Team
EvoLink Team
Product Team
2026年8月14日
9 分钟阅读

直接答案:今天已确认的事实

Gemini 3.7 Flash 已正式发布(GA)。 Google 于 2026 年 8 月 13 日发布该模型,称其为"迄今最智能的编程与智能体主力模型"。以下事实截至 2026 年 8 月 14 日已对照 Google 官方文档核实:
  • 模型 ID:gemini-3.7-flash——稳定版,无 preview 后缀。
  • 上下文窗口 1,048,576 Token;最大输出 65,536 Token。
  • 输入:文本、图像、视频、音频、PDF。输出:仅文本。
  • 官方介绍价:每百万 Token 输入 $0.75 / 输出 $3.75,限时至 2026 年 12 月 31 日,2027 年 1 月 1 日起恢复 $1.50 / $7.50。思考 Token 按输出价计费。
  • 与 Gemini 3.6 Flash 同价——升级理由是能力和 Token 效率,不是更低的价目表。
  • 不是新的预训练模型:官方模型卡将其描述为在 Gemini 3.6 Flash 推理基础上的算法改进,距 3.6 发布仅三周。
EvoLink 上的价格、代码示例与生产指南,请见 Gemini 3.7 Flash API 页面

相比 Gemini 3.6 Flash 改了什么

Google 公布的相对 Gemini 3.6 Flash 的基准变化(以下均为 Google 官方模型卡数字,在独立复测出现之前应视为厂商口径):
基准Gemini 3.7 FlashGemini 3.6 Flash
FrontierCode 1.1(生产编码)43.6%34.4%
DeepSWE v1.1(长程软件工程)65.3%~49%(各来源基线略有出入)
Terminal-bench 2.1(终端执行)85.8%78.0%
AutomationBench(智能体)30.4%17.0%
WebDev Arena1588 Elo1538 Elo
GDM-MRCR v2 128k(长上下文)97.0%91.8%
如果你要判断现有 3.6 负载该不该迁移,决策指南在这里:Gemini 3.7 Flash vs Gemini 3.6 Flash
发布叙事的重心是智能体可靠性:更少的失败智能体循环、更好的受阻恢复能力,以及更强的设计稿转代码与代码库审计表现。目前唯一的独立测量来自 Artificial Analysis:输出速度顶级,但幻觉率高于 3.6 Flash——投入生产前值得在自己的任务上验证。

思考档位:minimal 没了

Gemini 3.7 Flash 引入可调思考档位——lowmedium(默认)、high。对存量 Flash 用户有两个直接影响:
  1. minimal 不复存在。 向 Gemini API 传入会直接报错,low 成为最便宜的推理下限。原来依赖 minimal 的高并发分类和抽取管道,应把 Gemini 3.5 Flash-Lite 作为低成本路由进行基准测试。
  2. 可用的最低推理档位是 low,且思考 Token 按输出价计费——输出成本取决于你选择的思考档位,而不仅是回答长度。
在 EvoLink 上,仍然发送 reasoning_effort: "none""minimal" 的请求将被自动降级为 low 而不会失败,迁移期间旧代码可以继续运行。

破坏性 API 变更与迁移清单

从 Gemini 3.6 Flash 迁移 = 换模型 ID + 参数清理:

  • 模型改为 gemini-3.7-flash(带连字符的形式是页面 URL,不是 API 参数)。
  • 移除自定义 temperaturetop_ptop_kcandidate_count——3.7 Flash 上已废弃。
  • 把数值型 thinking_budget 替换为字符串参数 thinking_level
  • low 替代 minimal,或把这类流量路由到 Lite 层模型。
  • 重跑代表性提示词:价目表相同不代表 Token 消耗相同,部分首发反馈观察到单任务 Token 用量高于 3.6。

发布 ≠ 所有渠道都能调用

Gemini 3.7 Flash 模型路由正在三个 API 渠道上逐一验证
Gemini 3.7 Flash 模型路由正在三个 API 渠道上逐一验证

Google 侧 GA 不等于你使用的每个通道都已上线。截至 2026 年 8 月 14 日的状态:

  • 官方渠道:Gemini API / AI Studio、Android Studio、Google Antigravity、Gemini Enterprise Agent Platform,以及 Gemini App 的 Spark。
  • 聚合平台:OpenRouter 发布当天即上架;kie.ai 一天内跟进。其余多数聚合平台以开放权重模型为主,大概率不会上架——这是一个闭源、仅 API 的模型,没有可自托管的权重。
  • EvoLinkgemini-3.7-flash 同时支持 OpenAI 兼容的 /v1/chat/completions 和 Gemini 原生 API。切换生产流量前,先在自己的 key 上验证路由:
curl -s https://api.evolink.ai/v1/models \
  -H "Authorization: Bearer $EVOLINK_API_KEY" | grep gemini-3.7-flash
gemini-3.6-flash 仍以相同价格保留在相同端点上,因此可以灰度迁移,一旦出现回退可立即切回。

价格:介绍价窗口很关键

头条价 $0.75 / $3.75 是有到期日的介绍价。Google 公布的时间表:
至 2026-12-312027-01-01 起
输入 / 百万 Token$0.75$1.50
输出(含思考)/ 百万$3.75$7.50
缓存读取 / 百万$0.075$0.15

对智能体类负载来说,缓存读取才是真正的杠杆:$0.075/百万 Token 意味着缓存命中只要全新输入的十分之一,因此只要系统提示词、仓库说明和工具 schema 这段前缀在多次调用间保持一致,缓存就会持续回本。

Batch 在两个价段均为半价。如果你在为 2027 年做成本模型,请用标准价而不是首发价。该模型在 EvoLink 的当前价格实时展示在 Gemini 3.7 Flash 价格模块

值得持续监控的信号

  • 独立基准复测——目前只有一家独立机构发布了测量数据。
  • 幻觉率后续——首发的回退信号需要更多数据。
  • 你自己的单任务 Token 差值——效率结论取决于工作负载。
  • 聚合平台铺开——OpenRouter 与 kie.ai 之外是否有平台跟进。
  • 未来的 Pro 版本——Google Pro 线最新模型仍是 gemini-3.1-pro-preview
  • 2026 年 12 月 31 日——介绍价到期日。

FAQ

Gemini 3.7 Flash 是什么时候发布的?

2026 年 8 月 13 日,以正式可用(GA)的稳定版发布——已在 Google 官方 API changelog 与模型卡中确认。

Gemini 3.7 Flash 的模型 ID 是什么?

gemini-3.7-flash(带点号),官方 Gemini API 与 EvoLink 一致。带连字符的形式只出现在页面 URL 中。

Gemini 3.7 Flash 是新模型还是升级?

官方模型卡将其描述为在 Gemini 3.6 Flash 推理基础上的算法改进,而不是新的预训练模型。

Gemini 3.7 Flash 比 3.6 Flash 贵吗?

不贵——两者价目表相同,包括截至 2026 年 12 月 31 日的介绍价窗口。

minimal 思考档位去哪了?

已被移除。现有档位为 low、medium、high;向 Gemini API 传入 minimal 会报错。EvoLink 将把存量 minimal 请求自动降级为 low。

从 3.6 迁移会遇到哪些参数变更?

自定义 temperature、top_p、top_k 和 candidate_count 已废弃,数值型 thinking_budget 改为 thinking_level 字符串。

有 Gemini 3.7 Pro 吗?

没有。官方未宣布 3.5 或 3.7 Pro;Pro 线最新模型仍是 gemini-3.1-pro-preview。

今天在哪里能用上 Gemini 3.7 Flash API?

Google 的 Gemini API / AI Studio、Antigravity、Enterprise Agent Platform;聚合平台中的 OpenRouter 和 kie.ai;EvoLink 侧见上文滚动开放说明——请确认该 ID 出现在你 key 的 /v1/models 列表中。

准备好把 AI 成本降低 89% 吗?

现在就开始使用 EvoLink,体验智能 API 路由的强大能力。