GPT Image 2.5 Flare & Sunburst sind jetzt auf EvoLink verfügbarGPT Image 2.5 testen
Gemini API Family

Gemini API Family

Vergleichen Sie Gemini 3.8 Flash, 3.7 Flash, Pro, Flash und Lite ueber eine EvoLink API nach Preis, Kontext, Modalitaet, Genauigkeit und Token-Nutzung.

Gemini 4 ist noch nicht veröffentlicht und hat weder eine API noch eine EvoLink-Route.Gemini 4 API-Verfügbarkeit verfolgen

Gemini API Routen vergleichen

Starten Sie beim Workload: Flagship-Reasoning, Flash-Produktionstraffic, kostenguenstige Extraktion oder multimodale Long-Context-Analyse.

RouteIdeal fuerPreiseKontextfensterModalitaetStatus
Gemini 3.8 Flash

Neuestes Flash — GA

Googles neuestes Flash fuer genaueres Coding und agentische Aufgaben; den hoeheren Token-Verbrauch mit 3.7 Flash vergleichen.$0.675/$3.375 per MTok1MText, Bild, Video, Audio, PDF EingabenVerfuegbar
Gemini 3.7 Flash

Flash — GA

Agentisches Arbeitspferd der Gemini-3-Familie mit staerkerer Codegenerierung und Terminal-Ausfuehrung.$0.675/$3.375 per MTok1MTextVerfuegbar
Gemini 3.6 Flash

Flash — GA

Neuestes effizientes Flash-Arbeitspferd fuer Coding, Agenten und Wissensarbeit.$0.675/$3.375 per MTok1MTextVerfuegbar
Schnelle Route der 3.5-Klasse für Klassifizierung, Extraktion und latenzarme Aufgaben mit hohem Durchsatz; denkt standardmäßig nur minimal.$0.271/$2.25 per MTok1MTextVerfuegbar
Gemini 3.1 Pro Preview

Flagship-Reasoning

Hohe Gemini Reasoning-Qualitaet, Coding, Agents und Long-Context-Analyse.$1.865/$11.183 <=200K; $3.73/$16.774 >200K1M input / 64K outputText, Code, Bild, Video, Audio, PDF EingabenPreview flagship
Gemini 3.5 Flash

Stabil — GA fuer Produktion

Agentische Workflows, Coding-Agenten, Sub-Agent-Deployment und langfristige Produktionsaufgaben zu Flash-Kosten.$1.35/$8.10 per MTok1M input / 65K outputText, Bild, Video, Audio, PDF EingabenStable (GA)
Gemini 3 Flash Preview

Schnelles Gemini 3

Latenzarme multimodale Apps mit staerkerem Gemini 3 Verhalten.$0.467/$2.796 per MTok (audio in: $0.933)1M input / 64K outputText, Bild, Video, Audio, PDF EingabenPreview route
Hochvolumige Übersetzung, Klassifizierung, Extraktion und Text-Batch-Verarbeitung der Gemini-3-Generation.$0.234/$1.399 per MTok (audio in: $0.467)1M input / 64K outputText, Bild, Video, Audio, PDF EingabenPreview route
Gemini 2.5 Pro

Stabiles Pro

Produktions-Reasoning, Coding-Hilfe, Analyse und komplexe multimodale Aufgaben.$1.165/$9.318 <=200K; $2.33/$13.977 >200K1M input / 64K outputText, Bild, Video, Audio, PDF EingabenStable deep reasoning
Gemini 2.5 Flash

Produktions-Flash

Schneller Chat, Extraktion, Zusammenfassungen und multimodaler Produktionstraffic.$0.281/$2.33 per MTok (audio in: $0.933)1M input / 64K outputText, Bild, Video, Audio, PDF EingabenProduction workhorse
Hochvolumige Klassifizierung, Extraktion, Routing und leichte Chat-Flows.$0.095/$0.374 per MTok (audio in: $0.281)1M input / 64K outputText und Audio EingabenFlash Lite

Wie Sie das richtige Gemini-Modell auswaehlen

Folgen Sie diesen 4 Regeln, um Ihre Auswahl ueber Pro-, Flash- und Lite-Stufen einzugrenzen.

1

Beginnen Sie mit der Reasoning-Tiefe

Komplexe Coding-Agenten, Multi-Step-Tool-Nutzung, tiefe Dokumentanalyse und hochpraezise Ausgabe — starten Sie mit Gemini 3.1 Pro oder Gemini 2.5 Pro.

2

Dann pruefen Sie Latenz- und Durchsatz-Bedarf

Produktions-Chat, Support-Bots, Echtzeit-Extraktion und hochfrequente multimodale Apps — vergleichen Sie Gemini 3 Flash oder Gemini 2.5 Flash.

3

Dann pruefen Sie die Kostensensibilitaet

Hochvolumige Klassifizierung, Batch-Textverarbeitung, Routing und leichte Extraktion — vergleichen Sie Gemini 3.1 Flash Lite oder Gemini 2.5 Flash Lite.

4

Schliesslich: gemischte Workflows bedenken

Wenn dieselbe Pipeline einfache Klassifizierung mit tiefem Reasoning mischt, ziehen Sie EvoLink Smart Router in Betracht, anstatt ein Gemini-Modell fest zu codieren.

Smart Router →

Wenn Sie Ihren Aufgabentyp bereits kennen, finden Sie den empfohlenen Startpunkt in der Tabelle unten.

Gemini-Modell nach Workflow waehlen: Reasoning, Geschwindigkeit, Kosten und multimodale Aufgaben

Ordnen Sie Ihre Hauptaufgabe der richtigen Gemini-Route zu.

Ihre AufgabeEmpfohlener StartPasst gut, wenn …Beachten Sie
Komplexes Reasoning und Coding-AgentenGemini 3.1 ProSie die hoechste Gemini-Reasoning-Qualitaet, Multi-Step-Tool-Nutzung oder tiefe Code-Analyse benoetigenVergleichen Sie aktuelle Token-Tarife und den Gesamtverbrauch pro abgeschlossener Aufgabe.
Stabiles Deep Reasoning mit MultimodalGemini 2.5 ProSie produktionstaugliches Reasoning mit breiter multimodaler Unterstuetzung und bewiesener Stabilitaet brauchenEtwas niedrigere Leistungsobergrenze als 3.1 Pro
Coding und Agenten-Workflows mit hoeherer GenauigkeitGemini 3.8 FlashSie Googles neueste Flash-Route fuer Coding, Agenten, multimodale Analyse und 1M Kontext benoetigenHoeherer Token-Verbrauch als 3.7 Flash — Kosten pro akzeptierter Aufgabe vergleichen
Latenzarme multimodale AppsGemini 3 FlashSie schnelle Antworten mit Gemini-3-Generierungsfaehigkeiten ueber Text, Bild, Audio und Video brauchenPreview-Route — Stabilitaetsanforderungen pruefen
Produktions-Chat und ExtraktionGemini 2.5 FlashSie ein bewaehrtes Produktions-Arbeitspferd fuer Chat, Zusammenfassungen und skalierte Extraktion brauchenGuter Default fuer die meisten Produktions-Workloads
Batch-Text-WorkloadsGemini 2.5 Flash LiteAufgaben Klassifizierung, Routing oder kurze Antworten sind, bei denen Kosten am wichtigsten sindBeschraenkt auf Text- und Audio-Input
Text-Workflows mit gemischter KomplexitaetEvoLink Smart RouterDieselbe Pipeline einfache und komplexe Aufgaben ueber Gemini und andere Anbieter enthaeltAm besten, wenn Sie keine manuelle Modell-Routing-Logik pflegen moechten

Gemini-API-Workflows: Agenten, Chat, Dokumente und multimodale Verarbeitung

Sehen Sie, wie Gemini-Modelle in echte Produkte, Agenten und Content-Verarbeitungspipelines passen.

Reasoning- und Coding-Agenten

Fuer Code-Generierung, Bug-Fixing, Multi-Step-Tool-Nutzung und komplexe Analyse-Agenten. Wenn die Output-Qualitaet direkt das Produktverhalten beeinflusst, starten Sie mit Gemini 3.1 Pro. Fuer bewiesene Stabilitaet vergleichen Sie Gemini 2.5 Pro.

Produktions-Chat und Support

Für Support-Bots, In-App-Assistenten, Wissensdatenbank-Q&A und häufige Multi-Turn-Gespräche. Starten Sie mit Gemini 2.5 Flash für bewährten Durchsatz, lassen Sie denselben Traffic dann über Flash Lite laufen und vergleichen Sie die Antwortqualität mit den aktuellen Token-Tarifen.

Lange Dokument- und multimodale Analyse

Fuer PDF-Analyse, Video-Verstaendnis, Audio-Transkription und Multi-Datei-Research-Workflows. Geminis 1M-Kontextfenster und native multimodale Unterstuetzung machen Pro- und Flash-Routen zu starken Optionen.

Agenten-Routing und gemischte Aufgaben

Fuer Workflows, in denen Klassifizierung, Extraktion, Reasoning und Generierung in derselben Pipeline koexistieren. Nutzen Sie EvoLink Smart Router, um automatisch zwischen Gemini und anderen Anbietern via evolink/auto zu routen.

Gemini-Modelldetails ansehen

Jede Route verlinkt auf eine eigene Modellseite mit Preisen, Spezifikationen und Integrationsdetails.

Zugriff auf alle Gemini-Modelle ueber eine einzige EvoLink-API

Alle 11 Gemini-Routen sind ueber einen einzigen EvoLink-API-Schluessel und einen OpenAI-kompatiblen Endpunkt verfuegbar. Wechseln Sie zwischen Pro, Flash und Lite durch Aendern des model-Parameters — keine separaten Konten oder Schluessel noetig.

Wechseln Sie model="gemini-3.1-pro" zu model="gemini-2.5-flash" ohne Ihre Integration neu zu bauen.
Ein API-Schluessel fuer alle Gemini-Modelle
OpenAI-kompatibler Endpunkt
Modelle wechseln durch Aendern des model-Parameters
Einheitliche Abrechnung und Nutzungsuebersicht

Gemini-API-Kosten richtig einschaetzen: Pro vs. Flash vs. Lite

Pro-Routen: Reasoning rechtfertigt den Aufpreis

Gemini 3.1 Pro / Gemini 2.5 Pro — Für komplexes Coding, Dokumentanalyse und mehrstufiges Reasoning; vergleichen Sie Qualität und Kosten pro abgeschlossener Aufgabe.

Flash-Routen: beste Balance fuer Produktionsvolumen

Gemini 3 Flash und 2.5 Flash liefern starke multimodale Faehigkeiten zu einem Bruchteil der Pro-Preise. Starten Sie hier fuer Chat, Zusammenfassungen und skalierte Extraktion, bevor Sie Pro in Betracht ziehen.

Lite-Routen: Kosten minimieren fuer einfache Massenaufgaben

Gemini 3.1 Flash Lite und 2.5 Flash Lite sind die Routen, die Sie für Klassifizierung, Routing, Batch-Text und kurze Antworten ohne tiefes Reasoning zuerst testen sollten. Prüfen Sie vor größeren Volumen den aktuellen Token-Tarif jeder Route auf ihrer Modellseite.

Pricing summary

Eingabepreisspanne: $0.095–$3.73 / 1M tokens (EvoLink).

Gemini 3.8 Flash

$0.675/$3.375 /MTok

Context: 1M

Googles neuestes Flash für präziseres Coding und agentische Arbeit — 1M Context; mit höherem Token-Verbrauch als 3.7 Flash rechnen.

Gemini 3.7 Flash

$0.675/$3.375 /MTok

Context: 1M

Gemini 3.7 Flash · Eingabe $0.675 · Ausgabe $3.375 / 1M tokens.

Gemini 3.6 Flash

$0.675/$3.375 /MTok

Context: 1M

Effizientes Flash-Modell zu $0.675/$3.375 per MTok, stark bei mehrstufiger Orchestrierung und Refactoring, 1M Kontext.

Gemini 3.5 Flash-Lite

$0.271/$2.25 /MTok

Context: 1M

Gemini 3.5 Flash-Lite · Eingabe $0.271 · Ausgabe $2.25 / 1M tokens.

Gemini 3.1 Pro

$1.865/$11.183 — $3.73/$16.774 /MTok

Context: 1M

Flagship reasoning with 1M context. Tiered pricing: $1.865/$11.183 under 200K, $3.73/$16.774 over 200K input tokens.

Gemini 3.5 Flash

$1.35/$8.10 /MTok

Context: 1M

GA-stabiler Flash fuer agentische Workflows und Coding bei $1.35/$8.10 per MTok mit 1M Kontext und integriertem Reasoning.

Gemini 3 Flash

$0.467/$2.796 /MTok

Context: 1M

Gemini 3 generation Flash route at $0.467/$2.796 per MTok with 1M context.

Gemini 3.1 Flash Lite

$0.234/$1.399 /MTok

Context: 1M

Gemini 3.1 Flash Lite · Eingabe $0.234 · Ausgabe $1.399 / 1M tokens.

Gemini 2.5 Pro

$1.165/$9.318 — $2.33/$13.977 /MTok

Context: 1M

Stable deep reasoning at $1.165/$9.318 under 200K, $2.33/$13.977 over 200K.

Gemini 2.5 Flash

$0.281/$2.33 /MTok

Context: 1M

Production workhorse at $0.281/$2.33 per MTok with full multimodal support.

Gemini 2.5 Flash Lite

$0.095/$0.374 /MTok

Context: 1M

Gemini 2.5 Flash Lite · Eingabe $0.095 · Ausgabe $0.374 / 1M tokens.

Gemini Leitfaeden und Vergleiche

Nutzen Sie diese Leitfaeden, wenn Sie vor der Routenwahl mehr Kontext benoetigen.

Gemini API FAQ

Everything you need to know about the product and billing.

Starten Sie mit Gemini 3.8 Flash fuer genaueres Coding und Agenten-Workflows, mit Gemini 3.7 Flash bei hoher Token-Sensitivitaet, mit Gemini 3.1 Pro fuer maximale Reasoning-Qualitaet und mit Flash Lite bei striktem Kostenfokus.
Ja. Mehrere Gemini Routen unterstuetzen sehr grosse Kontextfenster und eignen sich damit fuer PDF-Analyse, Dokumentenpruefung, Retrieval-Workflows und Reasoning ueber mehrere Dateien.
Waehlen Sie Pro, wenn Antwortqualitaet, Coding und mehrstufiges Reasoning am wichtigsten sind. Waehlen Sie Flash, wenn Geschwindigkeit, Produktionsdurchsatz und planbare Kosten Vorrang haben.
Niedrigster Eingabepreis in dieser Sammlung: Gemini 2.5 Flash Lite. Eingabe $0.095 · Ausgabe $0.374 / 1M tokens.