
Sortie de Gemini 3.7 Flash : ce qui a été livré le 13 août 2026

La réponse directe : que sait-on de confirmé aujourd'hui ?
- ID du modèle :
gemini-3.7-flash— une version stable, sans suffixe preview. - Fenêtre de contexte : 1,048,576 tokens ; sortie maximale : 65,536 tokens.
- Entrée : texte, image, vidéo, audio, PDF. Sortie : texte uniquement.
- Tarif de lancement officiel : $0.75 en entrée / $3.75 en sortie par 1M de tokens jusqu'au 31 décembre 2026, puis $1.50 / $7.50 à partir du 1er janvier 2027. Les tokens de thinking sont facturés au tarif de sortie.
- Même prix que Gemini 3.6 Flash — l'argument de la mise à niveau tient aux capacités et à l'efficacité en tokens, pas à une grille tarifaire plus basse.
- Ce n'est pas un nouveau modèle pré-entraîné : la model card de Google le décrit comme des améliorations algorithmiques appliquées au socle de raisonnement de Gemini 3.6 Flash, livrées trois semaines après la 3.6.
Ce qui change par rapport à Gemini 3.6 Flash
| Benchmark | Gemini 3.7 Flash | Gemini 3.6 Flash |
|---|---|---|
| FrontierCode 1.1 (code en production) | 43.6% | 34.4% |
| DeepSWE v1.1 (SWE longue durée) | 65.3% | ~49% (les chiffres de référence varient selon la source) |
| Terminal-bench 2.1 (exécution en terminal) | 85.8% | 78.0% |
| AutomationBench (agentique) | 30.4% | 17.0% |
| WebDev Arena | 1588 Elo | 1538 Elo |
| GDM-MRCR v2 128k (contexte long) | 97.0% | 91.8% |
Niveaux de thinking : minimal disparaît
low, medium (par défaut) et high. Deux conséquences pour les utilisateurs actuels de Flash :minimaln'existe plus. L'envoyer à l'API Gemini renvoie une erreur ;lowdevient donc le plancher de raisonnement le moins cher. Les pipelines de classification et d'extraction à fort volume qui reposaient surminimaldevraient benchmarker Gemini 3.5 Flash-Lite comme alternative low-cost.- Le niveau de raisonnement le plus bas disponible est
low, et les tokens de thinking sont facturés au tarif de sortie — le coût de sortie dépend donc du niveau de thinking choisi, pas seulement de la longueur de la réponse.
reasoning_effort: "none" ou "minimal" seront automatiquement rétrogradées vers low au lieu d'échouer, pour que le code migré continue de fonctionner pendant que vous le mettez à jour.Breaking changes API et checklist de migration
Migrer depuis Gemini 3.6 Flash se résume à un changement d'ID de modèle plus un peu d'hygiène de paramètres :
- Passez le modèle à
gemini-3.7-flash(la forme avec tirets est une URL de page, pas un paramètre d'API). - Supprimez les valeurs personnalisées de
temperature,top_p,top_ketcandidate_count— elles sont dépréciées sur 3.7 Flash. - Remplacez les valeurs numériques de
thinking_budgetpar le paramètre chaînethinking_level. - Remplacez
minimalparlow, ou routez ce trafic vers un modèle de la gamme Lite. - Rejouez des prompts représentatifs : une grille tarifaire identique ne garantit pas une consommation de tokens identique, et certains retours du jour du lancement ont observé une consommation par tâche supérieure à celle de la 3.6.
Sortie ne veut pas dire disponibilité API partout

La GA chez Google ne signifie pas que le modèle est actif sur tous les canaux que vous utilisez. État au 14 août 2026 :
- Canaux officiels : Gemini API / AI Studio, Android Studio, Google Antigravity, Gemini Enterprise Agent Platform, et l'expérience Spark de l'application Gemini.
- Agrégateurs : OpenRouter l'a référencé dès le jour J ; kie.ai a suivi en moins d'un jour. La plupart des autres plateformes d'agrégation se concentrent sur les modèles open-weight et ne le proposeront probablement jamais — c'est un modèle fermé, accessible uniquement par API, sans poids à auto-héberger.
- EvoLink :
gemini-3.7-flashest disponible à la fois sur l'endpoint compatible OpenAI/v1/chat/completionset sur l'API Gemini native. Vérifiez la route sur votre propre clé avant de basculer le trafic de production :
curl -s https://api.evolink.ai/v1/models \
-H "Authorization: Bearer $EVOLINK_API_KEY" | grep gemini-3.7-flashgemini-3.6-flash reste disponible au même tarif sur les mêmes endpoints : vous pouvez donc étaler la migration et revenir en arrière instantanément en cas de régression.Tarifs : la fenêtre de lancement compte
| Jusqu'au 31 déc. 2026 | À partir du 1er janv. 2027 | |
|---|---|---|
| Entrée / 1M tokens | $0.75 | $1.50 |
| Sortie (thinking inclus) / 1M | $3.75 | $7.50 |
| Lecture de cache / 1M | $0.075 | $0.15 |
Pour les charges de travail agentiques, la lecture de cache est le vrai levier : à 0,075 $ par million de tokens, un hit de cache coûte un dixième d'un token d'entrée classique. Les system prompts stables, les instructions de dépôt et les schémas d'outils deviennent donc rentables dès que le préfixe reste identique d'un appel à l'autre.
Les signaux à surveiller
- Les réplications indépendantes des benchmarks — un seul tracker indépendant a publié des mesures pour l'instant.
- Le suivi du taux d'hallucination — le signal de régression du jour du lancement demande plus de données.
- Vos propres écarts de tokens par tâche — l'argument d'efficacité dépend de la charge de travail.
- Le déploiement chez les agrégateurs — voir si une plateforme au-delà d'OpenRouter et kie.ai référence le modèle.
- Une future version Pro — le modèle le plus récent de la gamme Pro de Google reste
gemini-3.1-pro-preview. - Le 31 décembre 2026 — l'expiration du tarif de lancement.
FAQ
Quand Gemini 3.7 Flash est-il sorti ?
Le 13 août 2026, en tant que modèle stable en disponibilité générale (GA) — confirmé dans le changelog officiel de l'API Google et la model card.
Quel est l'ID du modèle Gemini 3.7 Flash ?
gemini-3.7-flash, avec des points, aussi bien sur l'API Gemini officielle que sur EvoLink. La forme avec tirets n'apparaît que dans les URL de pages.Gemini 3.7 Flash est-il un nouveau modèle ou une mise à jour ?
La model card de Google le décrit comme des améliorations algorithmiques sur le socle de raisonnement de Gemini 3.6 Flash, plutôt que comme un nouveau modèle pré-entraîné.
Gemini 3.7 Flash coûte-t-il plus cher que 3.6 Flash ?
Non — les deux partagent la même grille tarifaire, y compris la fenêtre de lancement jusqu'au 31 décembre 2026.
Qu'est-il arrivé au niveau de thinking minimal ?
Il a été supprimé. Les niveaux sont désormais low, medium et high ; envoyer minimal à l'API Gemini provoque une erreur. EvoLink est configuré pour rétrograder automatiquement les anciennes requêtes minimal vers low.
Quels paramètres cassent lors de la migration depuis 3.6 ?
Les valeurs personnalisées de temperature, top_p, top_k et candidate_count sont dépréciées, et le thinking_budget numérique cède la place à la chaîne thinking_level.
Existe-t-il un Gemini 3.7 Pro ?
Non. Aucun Pro 3.5 ou 3.7 n'a été annoncé ; le modèle le plus récent de la gamme Pro reste gemini-3.1-pro-preview.
Où peut-on utiliser l'API Gemini 3.7 Flash aujourd'hui ?
/v1/models de votre clé.

