
Gemini 3.7 Flash Release: Was am 13. August 2026 ausgeliefert wurde

Die direkte Antwort: Was ist Stand heute bestätigt?
- Modell-ID:
gemini-3.7-flash— ein stabiles Release, ohne Preview-Suffix. - Kontextfenster: 1,048,576 Tokens; maximaler Output: 65,536 Tokens.
- Input: Text, Bild, Video, Audio, PDF. Output: nur Text.
- Offizieller Einführungspreis: $0.75 Input / $3.75 Output pro 1M Tokens bis zum 31. Dezember 2026, danach $1.50 / $7.50 ab dem 1. Januar 2027. Thinking-Tokens werden zum Output-Preis abgerechnet.
- Gleicher Preis wie Gemini 3.6 Flash — das Upgrade-Argument sind Fähigkeiten und Token-Effizienz, nicht ein günstigerer Tarif.
- Es ist kein neu vortrainiertes Modell: Googles Model Card beschreibt es als algorithmische Verbesserungen auf der Reasoning-Basis von Gemini 3.6 Flash, ausgeliefert drei Wochen nach 3.6.
Was sich gegenüber Gemini 3.6 Flash geändert hat
| Benchmark | Gemini 3.7 Flash | Gemini 3.6 Flash |
|---|---|---|
| FrontierCode 1.1 (Produktions-Coding) | 43.6% | 34.4% |
| DeepSWE v1.1 (Long-Horizon SWE) | 65.3% | ~49% (Baseline-Werte variieren je nach Quelle) |
| Terminal-bench 2.1 (Terminal-Ausführung) | 85.8% | 78.0% |
| AutomationBench (agentisch) | 30.4% | 17.0% |
| WebDev Arena | 1588 Elo | 1538 Elo |
| GDM-MRCR v2 128k (langer Kontext) | 97.0% | 91.8% |
Thinking-Level: minimal ist weg
low, medium (Standard) und high. Zwei Konsequenzen für bestehende Flash-Nutzer:minimalexistiert nicht mehr. Wer es an die Gemini API sendet, erhält einen Fehler;lowist damit die günstigste Reasoning-Stufe. Klassifikations- und Extraktions-Pipelines mit hohem Volumen, die sich aufminimalverlassen haben, sollten stattdessen Gemini 3.5 Flash-Lite als Low-Cost-Route benchmarken.- Die niedrigste verfügbare Reasoning-Stufe ist
low, und Thinking-Tokens werden zum Output-Preis abgerechnet — die Output-Kosten hängen also vom gewählten Thinking-Level ab, nicht nur von der Antwortlänge.
reasoning_effort: "none" oder "minimal" senden, automatisch auf low heruntergestuft statt fehlzuschlagen — migrierter Code läuft also weiter, während Sie ihn aktualisieren.Breaking API Changes und die Migrations-Checkliste
Die Migration von Gemini 3.6 Flash ist ein Modell-ID-Tausch plus Parameter-Hygiene:
- Modell auf
gemini-3.7-flashumstellen (die Variante mit Bindestrichen ist eine Seiten-URL, kein API-Parameter). - Eigene Werte für
temperature,top_p,top_kundcandidate_countentfernen — sie sind auf 3.7 Flash deprecated. - Numerische
thinking_budget-Werte durch den String-Parameterthinking_levelersetzen. minimaldurchlowersetzen oder diesen Traffic auf ein Lite-Modell umleiten.- Repräsentative Prompts erneut durchlaufen lassen: gleicher Tarif heißt nicht gleicher Token-Verbrauch, und einige Launch-Day-Berichte beobachteten einen höheren Token-Verbrauch pro Task als bei 3.6.
Release heißt nicht API-Verfügbarkeit überall

GA bei Google bedeutet nicht, dass das Modell auf jedem Kanal live ist, den Sie nutzen. Stand 14. August 2026:
- Offizielle Kanäle: Gemini API / AI Studio, Android Studio, Google Antigravity, Gemini Enterprise Agent Platform sowie die Spark-Experience der Gemini-App.
- Aggregatoren: OpenRouter listete das Modell ab Tag null; kie.ai zog innerhalb eines Tages nach. Die meisten anderen Aggregations-Plattformen konzentrieren sich auf Open-Weight-Modelle und werden es voraussichtlich gar nicht anbieten — es ist ein geschlossenes, reines API-Modell ohne Weights zum Selbst-Hosten.
- EvoLink:
gemini-3.7-flashsteht sowohl auf dem OpenAI-kompatiblen Endpoint/v1/chat/completionsals auch auf der nativen Gemini API zur Verfügung. Prüfen Sie die Route mit Ihrem eigenen Key, bevor Sie Produktions-Traffic umstellen:
curl -s https://api.evolink.ai/v1/models \
-H "Authorization: Bearer $EVOLINK_API_KEY" | grep gemini-3.7-flashgemini-3.6-flash bleibt zum selben Preis auf denselben Endpoints verfügbar — Sie können die Migration also schrittweise ausrollen und bei Regressionen sofort zurückschalten.Preise: Das Einführungsfenster zählt
| Bis 31. Dez. 2026 | Ab 1. Jan. 2027 | |
|---|---|---|
| Input / 1M Tokens | $0.75 | $1.50 |
| Output (inkl. Thinking) / 1M | $3.75 | $7.50 |
| Cache Read / 1M | $0.075 | $0.15 |
Für Agenten-Workloads ist der Cache Read der entscheidende Hebel: Mit $0,075 pro 1M Token kostet ein Cache-Treffer ein Zehntel frischer Eingabe-Token. Stabile System-Prompts, Repository-Anweisungen und Tool-Schemas rechnen sich also, sobald das Präfix über mehrere Aufrufe hinweg identisch bleibt.
Signale, die man im Blick behalten sollte
- Unabhängige Benchmark-Replikationen — bisher hat nur ein unabhängiger Tracker Messungen veröffentlicht.
- Follow-ups zur Halluzinationsrate — das Regressionssignal vom Launch-Tag braucht mehr Daten.
- Die eigenen Token-pro-Task-Deltas — die Effizienz-Aussage ist workload-abhängig.
- Aggregator-Rollout — ob über OpenRouter und kie.ai hinaus weitere Plattformen das Modell listen.
- Ein künftiges Pro-Release — Googles neuestes Modell der Pro-Linie ist weiterhin
gemini-3.1-pro-preview. - 31. Dezember 2026 — das Ende des Einführungspreises.
FAQ
Wann wurde Gemini 3.7 Flash veröffentlicht?
Am 13. August 2026, als allgemein verfügbares (GA) stabiles Modell — bestätigt in Googles offiziellem API-Changelog und der Model Card.
Wie lautet die Modell-ID von Gemini 3.7 Flash?
gemini-3.7-flash, mit Punkten, sowohl auf der offiziellen Gemini API als auch auf EvoLink. Die Variante mit Bindestrichen taucht nur in Seiten-URLs auf.Ist Gemini 3.7 Flash ein neues Modell oder ein Update?
Googles Model Card beschreibt es als algorithmische Verbesserungen auf der Reasoning-Basis von Gemini 3.6 Flash, nicht als neu vortrainiertes Modell.
Kostet Gemini 3.7 Flash mehr als 3.6 Flash?
Nein — beide teilen sich denselben Tarif, inklusive des Einführungsfensters bis zum 31. Dezember 2026.
Was ist mit dem Thinking-Level minimal passiert?
Es wurde entfernt. Die Level sind jetzt low, medium und high; wer minimal an die Gemini API sendet, erhält einen Fehler. EvoLink stuft Legacy-Requests mit minimal automatisch auf low herunter.
Welche Parameter brechen bei der Migration von 3.6?
Eigene Werte für temperature, top_p, top_k und candidate_count sind deprecated, und das numerische thinking_budget weicht dem String thinking_level.
Gibt es ein Gemini 3.7 Pro?
Nein. Weder ein 3.5 Pro noch ein 3.7 Pro wurde angekündigt; das neueste Modell der Pro-Linie bleibt gemini-3.1-pro-preview.
Wo kann ich die Gemini 3.7 Flash API heute nutzen?
/v1/models-Liste Ihres Keys erscheint.

