Gemini API Family
Vergleichen Sie Gemini 3.8 Flash, 3.7 Flash, Pro, Flash und Lite ueber eine EvoLink API nach Preis, Kontext, Modalitaet, Genauigkeit und Token-Nutzung.
11 Routen
Pro-, Flash- und Lite-Stufen fuer jedes Budget
Einheitlicher API-Zugang
OpenAI-kompatibel, ein Schluessel fuer alle Gemini
Nach Workflow waehlen
Pro vs. Flash vs. Lite zur Aufgabe zuordnen
Gemini API Routen vergleichen
Starten Sie beim Workload: Flagship-Reasoning, Flash-Produktionstraffic, kostenguenstige Extraktion oder multimodale Long-Context-Analyse.
| Route | Ideal fuer | Preise | Kontextfenster | Modalitaet | Status |
|---|---|---|---|---|---|
Gemini 3.8 Flash Neuestes Flash — GA | Googles neuestes Flash fuer genaueres Coding und agentische Aufgaben; den hoeheren Token-Verbrauch mit 3.7 Flash vergleichen. | $0.675/$3.375 per MTok | 1M | Text, Bild, Video, Audio, PDF Eingaben | Verfuegbar |
Gemini 3.7 Flash Flash — GA | Agentisches Arbeitspferd der Gemini-3-Familie mit staerkerer Codegenerierung und Terminal-Ausfuehrung. | $0.675/$3.375 per MTok | 1M | Text | Verfuegbar |
Gemini 3.6 Flash Flash — GA | Neuestes effizientes Flash-Arbeitspferd fuer Coding, Agenten und Wissensarbeit. | $0.675/$3.375 per MTok | 1M | Text | Verfuegbar |
Gemini 3.5 Flash-Lite Flash Lite | Schnelle Route der 3.5-Klasse für Klassifizierung, Extraktion und latenzarme Aufgaben mit hohem Durchsatz; denkt standardmäßig nur minimal. | $0.271/$2.25 per MTok | 1M | Text | Verfuegbar |
Gemini 3.1 Pro Preview Flagship-Reasoning | Hohe Gemini Reasoning-Qualitaet, Coding, Agents und Long-Context-Analyse. | $1.865/$11.183 <=200K; $3.73/$16.774 >200K | 1M input / 64K output | Text, Code, Bild, Video, Audio, PDF Eingaben | Preview flagship |
Gemini 3.5 Flash Stabil — GA fuer Produktion | Agentische Workflows, Coding-Agenten, Sub-Agent-Deployment und langfristige Produktionsaufgaben zu Flash-Kosten. | $1.35/$8.10 per MTok | 1M input / 65K output | Text, Bild, Video, Audio, PDF Eingaben | Stable (GA) |
Gemini 3 Flash Preview Schnelles Gemini 3 | Latenzarme multimodale Apps mit staerkerem Gemini 3 Verhalten. | $0.467/$2.796 per MTok (audio in: $0.933) | 1M input / 64K output | Text, Bild, Video, Audio, PDF Eingaben | Preview route |
Gemini 3.1 Flash Lite Preview Flash Lite | Hochvolumige Übersetzung, Klassifizierung, Extraktion und Text-Batch-Verarbeitung der Gemini-3-Generation. | $0.234/$1.399 per MTok (audio in: $0.467) | 1M input / 64K output | Text, Bild, Video, Audio, PDF Eingaben | Preview route |
Gemini 2.5 Pro Stabiles Pro | Produktions-Reasoning, Coding-Hilfe, Analyse und komplexe multimodale Aufgaben. | $1.165/$9.318 <=200K; $2.33/$13.977 >200K | 1M input / 64K output | Text, Bild, Video, Audio, PDF Eingaben | Stable deep reasoning |
Gemini 2.5 Flash Produktions-Flash | Schneller Chat, Extraktion, Zusammenfassungen und multimodaler Produktionstraffic. | $0.281/$2.33 per MTok (audio in: $0.933) | 1M input / 64K output | Text, Bild, Video, Audio, PDF Eingaben | Production workhorse |
Gemini 2.5 Flash Lite Flash Lite | Hochvolumige Klassifizierung, Extraktion, Routing und leichte Chat-Flows. | $0.095/$0.374 per MTok (audio in: $0.281) | 1M input / 64K output | Text und Audio Eingaben | Flash Lite |
Wie Sie das richtige Gemini-Modell auswaehlen
Folgen Sie diesen 4 Regeln, um Ihre Auswahl ueber Pro-, Flash- und Lite-Stufen einzugrenzen.
Beginnen Sie mit der Reasoning-Tiefe
Komplexe Coding-Agenten, Multi-Step-Tool-Nutzung, tiefe Dokumentanalyse und hochpraezise Ausgabe — starten Sie mit Gemini 3.1 Pro oder Gemini 2.5 Pro.
Dann pruefen Sie Latenz- und Durchsatz-Bedarf
Produktions-Chat, Support-Bots, Echtzeit-Extraktion und hochfrequente multimodale Apps — vergleichen Sie Gemini 3 Flash oder Gemini 2.5 Flash.
Dann pruefen Sie die Kostensensibilitaet
Hochvolumige Klassifizierung, Batch-Textverarbeitung, Routing und leichte Extraktion — vergleichen Sie Gemini 3.1 Flash Lite oder Gemini 2.5 Flash Lite.
Schliesslich: gemischte Workflows bedenken
Wenn dieselbe Pipeline einfache Klassifizierung mit tiefem Reasoning mischt, ziehen Sie EvoLink Smart Router in Betracht, anstatt ein Gemini-Modell fest zu codieren.
Smart Router →Wenn Sie Ihren Aufgabentyp bereits kennen, finden Sie den empfohlenen Startpunkt in der Tabelle unten.
Gemini-Modell nach Workflow waehlen: Reasoning, Geschwindigkeit, Kosten und multimodale Aufgaben
Ordnen Sie Ihre Hauptaufgabe der richtigen Gemini-Route zu.
| Ihre Aufgabe | Empfohlener Start | Passt gut, wenn … | Beachten Sie |
|---|---|---|---|
| Komplexes Reasoning und Coding-Agenten | Gemini 3.1 Pro | Sie die hoechste Gemini-Reasoning-Qualitaet, Multi-Step-Tool-Nutzung oder tiefe Code-Analyse benoetigen | Vergleichen Sie aktuelle Token-Tarife und den Gesamtverbrauch pro abgeschlossener Aufgabe. |
| Stabiles Deep Reasoning mit Multimodal | Gemini 2.5 Pro | Sie produktionstaugliches Reasoning mit breiter multimodaler Unterstuetzung und bewiesener Stabilitaet brauchen | Etwas niedrigere Leistungsobergrenze als 3.1 Pro |
| Coding und Agenten-Workflows mit hoeherer Genauigkeit | Gemini 3.8 Flash | Sie Googles neueste Flash-Route fuer Coding, Agenten, multimodale Analyse und 1M Kontext benoetigen | Hoeherer Token-Verbrauch als 3.7 Flash — Kosten pro akzeptierter Aufgabe vergleichen |
| Latenzarme multimodale Apps | Gemini 3 Flash | Sie schnelle Antworten mit Gemini-3-Generierungsfaehigkeiten ueber Text, Bild, Audio und Video brauchen | Preview-Route — Stabilitaetsanforderungen pruefen |
| Produktions-Chat und Extraktion | Gemini 2.5 Flash | Sie ein bewaehrtes Produktions-Arbeitspferd fuer Chat, Zusammenfassungen und skalierte Extraktion brauchen | Guter Default fuer die meisten Produktions-Workloads |
| Batch-Text-Workloads | Gemini 2.5 Flash Lite | Aufgaben Klassifizierung, Routing oder kurze Antworten sind, bei denen Kosten am wichtigsten sind | Beschraenkt auf Text- und Audio-Input |
| Text-Workflows mit gemischter Komplexitaet | EvoLink Smart Router | Dieselbe Pipeline einfache und komplexe Aufgaben ueber Gemini und andere Anbieter enthaelt | Am besten, wenn Sie keine manuelle Modell-Routing-Logik pflegen moechten |
Gemini-API-Workflows: Agenten, Chat, Dokumente und multimodale Verarbeitung
Sehen Sie, wie Gemini-Modelle in echte Produkte, Agenten und Content-Verarbeitungspipelines passen.
Reasoning- und Coding-Agenten
Fuer Code-Generierung, Bug-Fixing, Multi-Step-Tool-Nutzung und komplexe Analyse-Agenten. Wenn die Output-Qualitaet direkt das Produktverhalten beeinflusst, starten Sie mit Gemini 3.1 Pro. Fuer bewiesene Stabilitaet vergleichen Sie Gemini 2.5 Pro.
Produktions-Chat und Support
Für Support-Bots, In-App-Assistenten, Wissensdatenbank-Q&A und häufige Multi-Turn-Gespräche. Starten Sie mit Gemini 2.5 Flash für bewährten Durchsatz, lassen Sie denselben Traffic dann über Flash Lite laufen und vergleichen Sie die Antwortqualität mit den aktuellen Token-Tarifen.
Lange Dokument- und multimodale Analyse
Fuer PDF-Analyse, Video-Verstaendnis, Audio-Transkription und Multi-Datei-Research-Workflows. Geminis 1M-Kontextfenster und native multimodale Unterstuetzung machen Pro- und Flash-Routen zu starken Optionen.
Agenten-Routing und gemischte Aufgaben
Fuer Workflows, in denen Klassifizierung, Extraktion, Reasoning und Generierung in derselben Pipeline koexistieren. Nutzen Sie EvoLink Smart Router, um automatisch zwischen Gemini und anderen Anbietern via evolink/auto zu routen.
Gemini-Modelldetails ansehen
Jede Route verlinkt auf eine eigene Modellseite mit Preisen, Spezifikationen und Integrationsdetails.
Gemini 3.8 Flash
Neuestes Flash — GA
- Kontextfenster
- 1M
- Preise
- $0.675/$3.375 per MTok
Gemini 3.7 Flash
Flash — GA
- Kontextfenster
- 1M
- Preise
- $0.675/$3.375 per MTok
Gemini 3.6 Flash
Flash — GA
- Kontextfenster
- 1M
- Preise
- $0.675/$3.375 per MTok
Gemini 3.5 Flash-Lite
Flash Lite
- Kontextfenster
- 1M
- Preise
- $0.271/$2.25 per MTok
Gemini 3.1 Pro Preview
Flagship-Reasoning
- Kontextfenster
- 1M input / 64K output
- Preise
- $1.865/$11.183 <=200K; $3.73/$16.774 >200K
Gemini 3.5 Flash
Stabil — GA fuer Produktion
- Kontextfenster
- 1M input / 65K output
- Preise
- $1.35/$8.10 per MTok
Gemini 3 Flash Preview
Schnelles Gemini 3
- Kontextfenster
- 1M input / 64K output
- Preise
- $0.467/$2.796 per MTok (audio in: $0.933)
Gemini 3.1 Flash Lite Preview
Flash Lite
- Kontextfenster
- 1M input / 64K output
- Preise
- $0.234/$1.399 per MTok (audio in: $0.467)
Gemini 2.5 Pro
Stabiles Pro
- Kontextfenster
- 1M input / 64K output
- Preise
- $1.165/$9.318 <=200K; $2.33/$13.977 >200K
Gemini 2.5 Flash
Produktions-Flash
- Kontextfenster
- 1M input / 64K output
- Preise
- $0.281/$2.33 per MTok (audio in: $0.933)
Gemini 2.5 Flash Lite
Flash Lite
- Kontextfenster
- 1M input / 64K output
- Preise
- $0.095/$0.374 per MTok (audio in: $0.281)
Zugriff auf alle Gemini-Modelle ueber eine einzige EvoLink-API
Alle 11 Gemini-Routen sind ueber einen einzigen EvoLink-API-Schluessel und einen OpenAI-kompatiblen Endpunkt verfuegbar. Wechseln Sie zwischen Pro, Flash und Lite durch Aendern des model-Parameters — keine separaten Konten oder Schluessel noetig.
Wechseln Sie model="gemini-3.1-pro" zu model="gemini-2.5-flash" ohne Ihre Integration neu zu bauen.Gemini-API-Kosten richtig einschaetzen: Pro vs. Flash vs. Lite
Pro-Routen: Reasoning rechtfertigt den Aufpreis
Gemini 3.1 Pro / Gemini 2.5 Pro — Für komplexes Coding, Dokumentanalyse und mehrstufiges Reasoning; vergleichen Sie Qualität und Kosten pro abgeschlossener Aufgabe.
Flash-Routen: beste Balance fuer Produktionsvolumen
Gemini 3 Flash und 2.5 Flash liefern starke multimodale Faehigkeiten zu einem Bruchteil der Pro-Preise. Starten Sie hier fuer Chat, Zusammenfassungen und skalierte Extraktion, bevor Sie Pro in Betracht ziehen.
Lite-Routen: Kosten minimieren fuer einfache Massenaufgaben
Gemini 3.1 Flash Lite und 2.5 Flash Lite sind die Routen, die Sie für Klassifizierung, Routing, Batch-Text und kurze Antworten ohne tiefes Reasoning zuerst testen sollten. Prüfen Sie vor größeren Volumen den aktuellen Token-Tarif jeder Route auf ihrer Modellseite.
Pricing summary
Eingabepreisspanne: $0.095–$3.73 / 1M tokens (EvoLink).
Gemini 3.8 Flash
$0.675/$3.375 /MTok
Context: 1M
Googles neuestes Flash für präziseres Coding und agentische Arbeit — 1M Context; mit höherem Token-Verbrauch als 3.7 Flash rechnen.
Gemini 3.7 Flash
$0.675/$3.375 /MTok
Context: 1M
Gemini 3.7 Flash · Eingabe $0.675 · Ausgabe $3.375 / 1M tokens.
Gemini 3.6 Flash
$0.675/$3.375 /MTok
Context: 1M
Effizientes Flash-Modell zu $0.675/$3.375 per MTok, stark bei mehrstufiger Orchestrierung und Refactoring, 1M Kontext.
Gemini 3.5 Flash-Lite
$0.271/$2.25 /MTok
Context: 1M
Gemini 3.5 Flash-Lite · Eingabe $0.271 · Ausgabe $2.25 / 1M tokens.
Gemini 3.1 Pro
$1.865/$11.183 — $3.73/$16.774 /MTok
Context: 1M
Flagship reasoning with 1M context. Tiered pricing: $1.865/$11.183 under 200K, $3.73/$16.774 over 200K input tokens.
Gemini 3.5 Flash
$1.35/$8.10 /MTok
Context: 1M
GA-stabiler Flash fuer agentische Workflows und Coding bei $1.35/$8.10 per MTok mit 1M Kontext und integriertem Reasoning.
Gemini 3 Flash
$0.467/$2.796 /MTok
Context: 1M
Gemini 3 generation Flash route at $0.467/$2.796 per MTok with 1M context.
Gemini 3.1 Flash Lite
$0.234/$1.399 /MTok
Context: 1M
Gemini 3.1 Flash Lite · Eingabe $0.234 · Ausgabe $1.399 / 1M tokens.
Gemini 2.5 Pro
$1.165/$9.318 — $2.33/$13.977 /MTok
Context: 1M
Stable deep reasoning at $1.165/$9.318 under 200K, $2.33/$13.977 over 200K.
Gemini 2.5 Flash
$0.281/$2.33 /MTok
Context: 1M
Production workhorse at $0.281/$2.33 per MTok with full multimodal support.
Gemini 2.5 Flash Lite
$0.095/$0.374 /MTok
Context: 1M
Gemini 2.5 Flash Lite · Eingabe $0.095 · Ausgabe $0.374 / 1M tokens.
Gemini Leitfaeden und Vergleiche
Nutzen Sie diese Leitfaeden, wenn Sie vor der Routenwahl mehr Kontext benoetigen.
Gemini 3.8 Flash vs Gemini 3.7 Flash
Genauigkeit, Token-Verbrauch, Preiszeiträume und Kosten pro akzeptierter Aufgabe vergleichen.
Gemini 3.8 Flash API verwenden
Erste Anfrage, Parametermigration, Canary und Rollback für die Produktion umsetzen.
Gemini 3 Pro Deprecation-Migrationsleitfaden
Migrieren Sie alten Gemini 3 Pro Preview Traffic auf aktuelle Gemini Routen, ohne das Produktionsverhalten zu beeintraechtigen.
OpenCode-Integration mit Gemini Routen
Erfahren Sie, wie Sie ueber EvoLinks einheitliche API-Schicht auf Gemini neben Claude und GPT Modellen zugreifen koennen.
Gemini 3.5 Pro API Release-Tracker
Verfolgen Sie die oeffentliche API-Verfuegbarkeit, Googles offizielle Bestaetigung und Berichte ueber Startverzoegerungen.
Gemini 3.5 Pro vs Gemini 3.5 Flash
Vergleichen Sie bestaetigte Flash-Daten mit der noch ausstehenden Pro-Route, bevor Sie ein Modell waehlen.
Gemini 4 API Verfuegbarkeit
Google hat das Pre-Training von Gemini 4 bestaetigt; verfolgen Sie den oeffentlichen API-Status, die Modell-ID, die Preise und die Pruefung der EvoLink-Route.
Gemini API FAQ
Everything you need to know about the product and billing.