
Gemini 3.7 Flash 发布:2026 年 8 月 13 日上线了什么

直接答案:今天已确认的事实
- 模型 ID:
gemini-3.7-flash——稳定版,无 preview 后缀。 - 上下文窗口 1,048,576 Token;最大输出 65,536 Token。
- 输入:文本、图像、视频、音频、PDF。输出:仅文本。
- 官方介绍价:每百万 Token 输入 $0.75 / 输出 $3.75,限时至 2026 年 12 月 31 日,2027 年 1 月 1 日起恢复 $1.50 / $7.50。思考 Token 按输出价计费。
- 与 Gemini 3.6 Flash 同价——升级理由是能力和 Token 效率,不是更低的价目表。
- 它不是新的预训练模型:官方模型卡将其描述为在 Gemini 3.6 Flash 推理基础上的算法改进,距 3.6 发布仅三周。
相比 Gemini 3.6 Flash 改了什么
| 基准 | Gemini 3.7 Flash | Gemini 3.6 Flash |
|---|---|---|
| FrontierCode 1.1(生产编码) | 43.6% | 34.4% |
| DeepSWE v1.1(长程软件工程) | 65.3% | ~49%(各来源基线略有出入) |
| Terminal-bench 2.1(终端执行) | 85.8% | 78.0% |
| AutomationBench(智能体) | 30.4% | 17.0% |
| WebDev Arena | 1588 Elo | 1538 Elo |
| GDM-MRCR v2 128k(长上下文) | 97.0% | 91.8% |
思考档位:minimal 没了
low、medium(默认)、high。对存量 Flash 用户有两个直接影响:minimal不复存在。 向 Gemini API 传入会直接报错,low成为最便宜的推理下限。原来依赖minimal的高并发分类和抽取管道,应把 Gemini 3.5 Flash-Lite 作为低成本路由进行基准测试。- 可用的最低推理档位是
low,且思考 Token 按输出价计费——输出成本取决于你选择的思考档位,而不仅是回答长度。
reasoning_effort: "none" 或 "minimal" 的请求将被自动降级为 low 而不会失败,迁移期间旧代码可以继续运行。破坏性 API 变更与迁移清单
从 Gemini 3.6 Flash 迁移 = 换模型 ID + 参数清理:
- 模型改为
gemini-3.7-flash(带连字符的形式是页面 URL,不是 API 参数)。 - 移除自定义
temperature、top_p、top_k和candidate_count——3.7 Flash 上已废弃。 - 把数值型
thinking_budget替换为字符串参数thinking_level。 - 用
low替代minimal,或把这类流量路由到 Lite 层模型。 - 重跑代表性提示词:价目表相同不代表 Token 消耗相同,部分首发反馈观察到单任务 Token 用量高于 3.6。
发布 ≠ 所有渠道都能调用

Google 侧 GA 不等于你使用的每个通道都已上线。截至 2026 年 8 月 14 日的状态:
- 官方渠道:Gemini API / AI Studio、Android Studio、Google Antigravity、Gemini Enterprise Agent Platform,以及 Gemini App 的 Spark。
- 聚合平台:OpenRouter 发布当天即上架;kie.ai 一天内跟进。其余多数聚合平台以开放权重模型为主,大概率不会上架——这是一个闭源、仅 API 的模型,没有可自托管的权重。
- EvoLink:
gemini-3.7-flash同时支持 OpenAI 兼容的/v1/chat/completions和 Gemini 原生 API。切换生产流量前,先在自己的 key 上验证路由:
curl -s https://api.evolink.ai/v1/models \
-H "Authorization: Bearer $EVOLINK_API_KEY" | grep gemini-3.7-flashgemini-3.6-flash 仍以相同价格保留在相同端点上,因此可以灰度迁移,一旦出现回退可立即切回。价格:介绍价窗口很关键
| 至 2026-12-31 | 2027-01-01 起 | |
|---|---|---|
| 输入 / 百万 Token | $0.75 | $1.50 |
| 输出(含思考)/ 百万 | $3.75 | $7.50 |
| 缓存读取 / 百万 | $0.075 | $0.15 |
对智能体类负载来说,缓存读取才是真正的杠杆:$0.075/百万 Token 意味着缓存命中只要全新输入的十分之一,因此只要系统提示词、仓库说明和工具 schema 这段前缀在多次调用间保持一致,缓存就会持续回本。
值得持续监控的信号
- 独立基准复测——目前只有一家独立机构发布了测量数据。
- 幻觉率后续——首发的回退信号需要更多数据。
- 你自己的单任务 Token 差值——效率结论取决于工作负载。
- 聚合平台铺开——OpenRouter 与 kie.ai 之外是否有平台跟进。
- 未来的 Pro 版本——Google Pro 线最新模型仍是
gemini-3.1-pro-preview。 - 2026 年 12 月 31 日——介绍价到期日。
FAQ
Gemini 3.7 Flash 是什么时候发布的?
2026 年 8 月 13 日,以正式可用(GA)的稳定版发布——已在 Google 官方 API changelog 与模型卡中确认。
Gemini 3.7 Flash 的模型 ID 是什么?
gemini-3.7-flash(带点号),官方 Gemini API 与 EvoLink 一致。带连字符的形式只出现在页面 URL 中。Gemini 3.7 Flash 是新模型还是升级?
官方模型卡将其描述为在 Gemini 3.6 Flash 推理基础上的算法改进,而不是新的预训练模型。
Gemini 3.7 Flash 比 3.6 Flash 贵吗?
不贵——两者价目表相同,包括截至 2026 年 12 月 31 日的介绍价窗口。
minimal 思考档位去哪了?
已被移除。现有档位为 low、medium、high;向 Gemini API 传入 minimal 会报错。EvoLink 将把存量 minimal 请求自动降级为 low。
从 3.6 迁移会遇到哪些参数变更?
自定义 temperature、top_p、top_k 和 candidate_count 已废弃,数值型 thinking_budget 改为 thinking_level 字符串。
有 Gemini 3.7 Pro 吗?
没有。官方未宣布 3.5 或 3.7 Pro;Pro 线最新模型仍是 gemini-3.1-pro-preview。
今天在哪里能用上 Gemini 3.7 Flash API?
/v1/models 列表中。

