Gemini API Family
Comparez Gemini 3.8 Flash, 3.7 Flash, Pro, Flash et Lite via une API EvoLink selon le tarif, le contexte, les modalites, la precision et les tokens.
11 routes
Niveaux Pro, Flash et Lite pour chaque budget
Acces API unifie
Compatible OpenAI, une cle pour tout Gemini
Choisir par workflow
Associer Pro vs Flash vs Lite a votre tache
Comparer les routes Gemini API
Choisissez selon le workload : raisonnement flagship, trafic Flash de production, extraction a bas cout ou analyse multimodale long contexte.
| Route | Ideal pour | Tarifs | Fenetre de contexte | Modalite | Statut |
|---|---|---|---|---|---|
Gemini 3.8 Flash Flash le plus recent — GA | Le nouveau Flash de Google pour le code et les agents avec plus de precision ; comparez sa consommation avec 3.7 Flash. | $0.675/$3.375 per MTok | 1M | Texte, image, video, audio, PDF en entree | Disponible |
Gemini 3.7 Flash Flash — GA | Modele agentique principal de la famille Gemini 3, avec une meilleure generation de code et execution terminal. | $0.675/$3.375 per MTok | 1M | Texte | Disponible |
Gemini 3.6 Flash Flash — GA | Le plus recent modele Flash efficace pour le code, les agents et le travail de connaissance. | $0.675/$3.375 per MTok | 1M | Texte | Disponible |
Gemini 3.5 Flash-Lite Flash Lite | Route 3.5 rapide pour la classification, l'extraction et les tâches à faible latence à haut débit ; réflexion minimale par défaut. | $0.271/$2.25 per MTok | 1M | Texte | Disponible |
Gemini 3.1 Pro Preview Raisonnement flagship | Meilleure qualite Gemini pour raisonnement, code, agents et analyse long contexte. | $1.865/$11.183 <=200K; $3.73/$16.774 >200K | 1M input / 64K output | Texte, code, image, video, audio, PDF en entree | Preview flagship |
Gemini 3.5 Flash Stable — GA pour la production | Workflows agentiques, agents de code, deploiement de sous-agents et taches de production longue duree au cout Flash. | $1.35/$8.10 per MTok | 1M input / 65K output | Texte, image, video, audio, PDF en entree | Stable (GA) |
Gemini 3 Flash Preview Gemini 3 rapide | Apps multimodales a faible latence qui ont besoin du comportement Gemini 3. | $0.467/$2.796 per MTok (audio in: $0.933) | 1M input / 64K output | Texte, image, video, audio, PDF en entree | Preview route |
Gemini 3.1 Flash Lite Preview Flash Lite | Traduction, classification, extraction et traitement de texte par lots à fort volume sur la génération Gemini 3. | $0.234/$1.399 per MTok (audio in: $0.467) | 1M input / 64K output | Texte, image, video, audio, PDF en entree | Preview route |
Gemini 2.5 Pro Pro stable | Raisonnement de production, aide au code, analyse et taches multimodales complexes. | $1.165/$9.318 <=200K; $2.33/$13.977 >200K | 1M input / 64K output | Texte, image, video, audio, PDF en entree | Stable deep reasoning |
Gemini 2.5 Flash Flash production | Chat rapide, extraction, resumes et trafic multimodal de production. | $0.281/$2.33 per MTok (audio in: $0.933) | 1M input / 64K output | Texte, image, video, audio, PDF en entree | Production workhorse |
Gemini 2.5 Flash Lite Flash Lite | Classification, extraction, routage et chat leger a haut volume. | $0.095/$0.374 per MTok (audio in: $0.281) | 1M input / 64K output | Texte et audio en entree | Flash Lite |
Comment choisir le bon modele Gemini
Suivez ces 4 regles pour affiner votre choix entre les niveaux Pro, Flash et Lite.
Commencez par la profondeur de raisonnement
Agents de code complexes, utilisation d'outils multi-etapes, analyse documentaire approfondie et sortie haute precision — commencez avec Gemini 3.1 Pro ou Gemini 2.5 Pro.
Puis verifiez les besoins en latence et debit
Chat de production, bots de support, extraction en temps reel et apps multimodales a haute frequence — comparez Gemini 3 Flash ou Gemini 2.5 Flash.
Puis verifiez la sensibilite au cout
Classification a haut volume, traitement de texte par lots, routage et extraction legere — comparez Gemini 3.1 Flash Lite ou Gemini 2.5 Flash Lite.
Enfin, considerez les workflows de complexite mixte
Si la meme pipeline melange classification simple et etapes de raisonnement profond, envisagez EvoLink Smart Router au lieu de coder en dur un seul modele Gemini.
Smart Router →Si vous connaissez deja votre type de tache, trouvez le point de depart recommande dans le tableau ci-dessous.
Choisir un modele Gemini par workflow : raisonnement, vitesse, cout et taches multimodales
Associez votre tache principale a la bonne route Gemini.
| Votre tache | Depart recommande | Bon choix si… | A surveiller |
|---|---|---|---|
| Raisonnement complexe et agents de code | Gemini 3.1 Pro | Vous avez besoin de la meilleure qualite de raisonnement Gemini, d'utilisation d'outils multi-etapes ou d'analyse de code approfondie | Comparez les tarifs actuels par token et l’usage total par tâche terminée. |
| Deep reasoning stable avec multimodal | Gemini 2.5 Pro | Vous avez besoin d'un raisonnement de niveau production avec un large support multimodal et une stabilite prouvee | Plafond de capacite legerement inferieur a 3.1 Pro |
| Code et agents avec une precision accrue | Gemini 3.8 Flash | Vous avez besoin de la nouvelle route Flash de Google pour le code, les agents, l'analyse multimodale et le contexte 1M | Consomme plus de tokens que 3.7 Flash — comparez le cout par tache acceptee |
| Apps multimodales a faible latence | Gemini 3 Flash | Vous avez besoin de reponses rapides avec les capacites Gemini 3 en texte, image, audio et video | Route preview — verifiez les exigences de stabilite |
| Chat et extraction de production | Gemini 2.5 Flash | Vous avez besoin d'un modele de production eprouve pour le chat, les resumes et l'extraction a l'echelle | Bon defaut pour la plupart des workloads de production |
| Traitements de texte en lot | Gemini 2.5 Flash Lite | Les taches sont de la classification, du routage ou des reponses courtes ou le cout prime | Limite aux entrees texte et audio uniquement |
| Workflows textuels de complexite mixte | EvoLink Smart Router | La meme pipeline a des taches simples et complexes entre Gemini et d'autres fournisseurs | Ideal quand vous ne voulez pas de logique de routage manuelle |
Workflows API Gemini : agents, chat, documents et traitement multimodal
Decouvrez comment les modeles Gemini s'integrent dans des produits reels, des agents et des pipelines de traitement de contenu.
Agents de raisonnement et de code
Pour la generation de code, la correction de bugs, l'utilisation d'outils multi-etapes et les agents d'analyse complexes. Si la qualite de sortie affecte directement le comportement du produit, commencez avec Gemini 3.1 Pro. Pour une stabilite prouvee, comparez Gemini 2.5 Pro.
Chat et support de production
Pour les bots de support, les assistants intégrés, les Q&R sur base de connaissances et les conversations multi-tours fréquentes. Commencez par Gemini 2.5 Flash pour un débit éprouvé, puis faites passer le même trafic par Flash Lite et comparez la qualité des réponses aux tarifs par token actuels.
Analyse documentaire et multimodale longue
Pour l'analyse de PDFs, la comprehension video, la transcription audio et les workflows de recherche multi-fichiers. La fenetre de contexte 1M de Gemini et son support multimodal natif font des routes Pro et Flash des choix solides.
Routage d'agents et taches mixtes
Pour les workflows ou classification, extraction, raisonnement et generation coexistent dans la meme pipeline. Utilisez EvoLink Smart Router pour router automatiquement entre Gemini et d'autres fournisseurs via evolink/auto.
Voir les details de chaque modele Gemini
Chaque route renvoie vers une page modele dediee avec tarifs, specifications et details d'integration.
Gemini 3.8 Flash
Flash le plus recent — GA
- Fenetre de contexte
- 1M
- Tarifs
- $0.675/$3.375 per MTok
Gemini 3.7 Flash
Flash — GA
- Fenetre de contexte
- 1M
- Tarifs
- $0.675/$3.375 per MTok
Gemini 3.6 Flash
Flash — GA
- Fenetre de contexte
- 1M
- Tarifs
- $0.675/$3.375 per MTok
Gemini 3.5 Flash-Lite
Flash Lite
- Fenetre de contexte
- 1M
- Tarifs
- $0.271/$2.25 per MTok
Gemini 3.1 Pro Preview
Raisonnement flagship
- Fenetre de contexte
- 1M input / 64K output
- Tarifs
- $1.865/$11.183 <=200K; $3.73/$16.774 >200K
Gemini 3.5 Flash
Stable — GA pour la production
- Fenetre de contexte
- 1M input / 65K output
- Tarifs
- $1.35/$8.10 per MTok
Gemini 3 Flash Preview
Gemini 3 rapide
- Fenetre de contexte
- 1M input / 64K output
- Tarifs
- $0.467/$2.796 per MTok (audio in: $0.933)
Gemini 3.1 Flash Lite Preview
Flash Lite
- Fenetre de contexte
- 1M input / 64K output
- Tarifs
- $0.234/$1.399 per MTok (audio in: $0.467)
Gemini 2.5 Pro
Pro stable
- Fenetre de contexte
- 1M input / 64K output
- Tarifs
- $1.165/$9.318 <=200K; $2.33/$13.977 >200K
Gemini 2.5 Flash
Flash production
- Fenetre de contexte
- 1M input / 64K output
- Tarifs
- $0.281/$2.33 per MTok (audio in: $0.933)
Gemini 2.5 Flash Lite
Flash Lite
- Fenetre de contexte
- 1M input / 64K output
- Tarifs
- $0.095/$0.374 per MTok (audio in: $0.281)
Accedez a tous les modeles Gemini via une seule API EvoLink
Les 11 routes Gemini sont disponibles via une seule cle API EvoLink et un endpoint compatible OpenAI. Passez de Pro a Flash ou Lite en changeant le parametre model — aucun compte ni cle supplementaire necessaire.
Passez de model="gemini-3.1-pro" a model="gemini-2.5-flash" sans reconstruire votre integration.Comment evaluer le cout de l'API Gemini : Pro vs Flash vs Lite
Routes Pro : le raisonnement justifie le premium
Gemini 3.1 Pro / Gemini 2.5 Pro — Évaluez ces routes pour le code complexe, l’analyse documentaire et le raisonnement en plusieurs étapes ; comparez la qualité et le coût par tâche terminée.
Routes Flash : meilleur equilibre pour le volume de production
Gemini 3 Flash et 2.5 Flash offrent de solides capacites multimodales a une fraction du prix Pro. Commencez ici pour le chat, les resumes et l'extraction a l'echelle de production avant de considerer Pro.
Routes Lite : minimiser les couts pour les taches simples a haut volume
Gemini 3.1 Flash Lite et 2.5 Flash Lite sont les routes à tester en premier pour la classification, le routage, le texte par lots et les réponses courtes qui n'exigent pas de raisonnement profond. Vérifiez le tarif par token actuel de chaque route sur sa page modèle avant de monter en volume.
Pricing summary
Fourchette des prix d’entrée: $0.095–$3.73 / 1M tokens (EvoLink).
Gemini 3.8 Flash
$0.675/$3.375 /MTok
Context: 1M
Le Flash le plus récent de Google pour un coding et des tâches agentiques plus précis — 1M de contexte ; prévoyez une consommation de tokens supérieure à 3.7 Flash.
Gemini 3.7 Flash
$0.675/$3.375 /MTok
Context: 1M
Gemini 3.7 Flash · Entrée $0.675 · Sortie $3.375 / 1M tokens.
Gemini 3.6 Flash
$0.675/$3.375 /MTok
Context: 1M
Modele Flash efficace a $0.675/$3.375 per MTok, solide pour l'orchestration multi-etapes et le refactoring, 1M de contexte.
Gemini 3.5 Flash-Lite
$0.271/$2.25 /MTok
Context: 1M
Gemini 3.5 Flash-Lite · Entrée $0.271 · Sortie $2.25 / 1M tokens.
Gemini 3.1 Pro
$1.865/$11.183 — $3.73/$16.774 /MTok
Context: 1M
Flagship reasoning with 1M context. Tiered pricing: $1.865/$11.183 under 200K, $3.73/$16.774 over 200K input tokens.
Gemini 3.5 Flash
$1.35/$8.10 /MTok
Context: 1M
Flash GA stable pour les workflows agentiques et le code a $1.35/$8.10 per MTok avec 1M de contexte et raisonnement integre.
Gemini 3 Flash
$0.467/$2.796 /MTok
Context: 1M
Gemini 3 generation Flash route at $0.467/$2.796 per MTok with 1M context.
Gemini 3.1 Flash Lite
$0.234/$1.399 /MTok
Context: 1M
Gemini 3.1 Flash Lite · Entrée $0.234 · Sortie $1.399 / 1M tokens.
Gemini 2.5 Pro
$1.165/$9.318 — $2.33/$13.977 /MTok
Context: 1M
Stable deep reasoning at $1.165/$9.318 under 200K, $2.33/$13.977 over 200K.
Gemini 2.5 Flash
$0.281/$2.33 /MTok
Context: 1M
Production workhorse at $0.281/$2.33 per MTok with full multimodal support.
Gemini 2.5 Flash Lite
$0.095/$0.374 /MTok
Context: 1M
Gemini 2.5 Flash Lite · Entrée $0.095 · Sortie $0.374 / 1M tokens.
Guides et comparatifs Gemini
Consultez ces guides lorsque vous avez besoin de plus de contexte avant de choisir une route.
Gemini 3.8 Flash vs Gemini 3.7 Flash
Comparez précision, consommation de tokens, périodes tarifaires et coût par tâche acceptée.
Comment utiliser l’API Gemini 3.8 Flash
Effectuez la première requête, migrez les paramètres et ajoutez canary et rollback en production.
Guide de migration apres deprecation de Gemini 3 Pro
Migrez l'ancien trafic Gemini 3 Pro Preview vers les routes Gemini actuelles sans perturber le comportement en production.
Integration OpenCode avec les routes Gemini
Decouvrez comment acceder a Gemini aux cotes de Claude et GPT via la couche API unifiee d'EvoLink.
Suivi du lancement de l'API Gemini 3.5 Pro
Suivez la disponibilite publique de l'API, la confirmation officielle de Google et les retards de lancement signales.
Gemini 3.5 Pro vs Gemini 3.5 Flash
Comparez les donnees Flash confirmees a la route Pro encore en attente avant de choisir un modele.
Disponibilite de l'API Gemini 4
Google a confirme le pre-entrainement de Gemini 4 ; suivez le statut de l'API publique, l'ID du modele, les tarifs et la verification de la route EvoLink.
FAQ Gemini API
Everything you need to know about the product and billing.