Seedance 2.5 est disponible sur EvoLinkEssayer Seedance 2.5
Une route d’IA lumineuse accélère à travers une passerelle de production sombre
Veille des sorties

Sortie de Gemini 3.7 Flash : ce qui a été livré le 13 août 2026

EvoLink Team
EvoLink Team
Product Team
14 août 2026
8 min de lecture

La réponse directe : que sait-on de confirmé aujourd'hui ?

Gemini 3.7 Flash est disponible en version générale (GA). Google l'a publié le 13 août 2026, en le présentant comme « notre modèle workhorse le plus intelligent à ce jour pour le code et les agents ». Ces faits sont confirmés par la documentation officielle de Google au 14 août 2026 :
  • ID du modèle : gemini-3.7-flash — une version stable, sans suffixe preview.
  • Fenêtre de contexte : 1,048,576 tokens ; sortie maximale : 65,536 tokens.
  • Entrée : texte, image, vidéo, audio, PDF. Sortie : texte uniquement.
  • Tarif de lancement officiel : $0.75 en entrée / $3.75 en sortie par 1M de tokens jusqu'au 31 décembre 2026, puis $1.50 / $7.50 à partir du 1er janvier 2027. Les tokens de thinking sont facturés au tarif de sortie.
  • Même prix que Gemini 3.6 Flash — l'argument de la mise à niveau tient aux capacités et à l'efficacité en tokens, pas à une grille tarifaire plus basse.
  • Ce n'est pas un nouveau modèle pré-entraîné : la model card de Google le décrit comme des améliorations algorithmiques appliquées au socle de raisonnement de Gemini 3.6 Flash, livrées trois semaines après la 3.6.
Pour les tarifs sur EvoLink, des exemples de code et les recommandations de mise en production, consultez la page API Gemini 3.7 Flash.

Ce qui change par rapport à Gemini 3.6 Flash

Les écarts de benchmarks publiés par Google face à Gemini 3.6 Flash (tous les chiffres viennent de Google, via la model card officielle — considérez-les comme des chiffres éditeur tant que des réplications indépendantes n'ont pas été publiées) :
BenchmarkGemini 3.7 FlashGemini 3.6 Flash
FrontierCode 1.1 (code en production)43.6%34.4%
DeepSWE v1.1 (SWE longue durée)65.3%~49% (les chiffres de référence varient selon la source)
Terminal-bench 2.1 (exécution en terminal)85.8%78.0%
AutomationBench (agentique)30.4%17.0%
WebDev Arena1588 Elo1538 Elo
GDM-MRCR v2 128k (contexte long)97.0%91.8%
Si vous évaluez la migration d'une charge de travail 3.6 existante, le guide de décision est ici : Gemini 3.7 Flash vs Gemini 3.6 Flash.
Le récit de lancement met l'accent sur la fiabilité agentique : moins de boucles d'agent en échec, une meilleure reprise après blocage, et un comportement renforcé en design-to-code et en audit de codebase. La couverture indépendante du jour du lancement reprend largement ces chiffres ; les seules mesures indépendantes à ce stade viennent d'Artificial Analysis, qui a relevé une vitesse de sortie parmi les meilleures du marché mais aussi un taux d'hallucination plus élevé que celui de 3.6 Flash — à vérifier sur vos propres tâches avant de promouvoir le modèle en production.

Niveaux de thinking : minimal disparaît

Gemini 3.7 Flash introduit des niveaux de thinking réglables — low, medium (par défaut) et high. Deux conséquences pour les utilisateurs actuels de Flash :
  1. minimal n'existe plus. L'envoyer à l'API Gemini renvoie une erreur ; low devient donc le plancher de raisonnement le moins cher. Les pipelines de classification et d'extraction à fort volume qui reposaient sur minimal devraient benchmarker Gemini 3.5 Flash-Lite comme alternative low-cost.
  2. Le niveau de raisonnement le plus bas disponible est low, et les tokens de thinking sont facturés au tarif de sortie — le coût de sortie dépend donc du niveau de thinking choisi, pas seulement de la longueur de la réponse.
Sur EvoLink, les requêtes qui envoient encore reasoning_effort: "none" ou "minimal" seront automatiquement rétrogradées vers low au lieu d'échouer, pour que le code migré continue de fonctionner pendant que vous le mettez à jour.

Breaking changes API et checklist de migration

Migrer depuis Gemini 3.6 Flash se résume à un changement d'ID de modèle plus un peu d'hygiène de paramètres :

  • Passez le modèle à gemini-3.7-flash (la forme avec tirets est une URL de page, pas un paramètre d'API).
  • Supprimez les valeurs personnalisées de temperature, top_p, top_k et candidate_count — elles sont dépréciées sur 3.7 Flash.
  • Remplacez les valeurs numériques de thinking_budget par le paramètre chaîne thinking_level.
  • Remplacez minimal par low, ou routez ce trafic vers un modèle de la gamme Lite.
  • Rejouez des prompts représentatifs : une grille tarifaire identique ne garantit pas une consommation de tokens identique, et certains retours du jour du lancement ont observé une consommation par tâche supérieure à celle de la 3.6.

Sortie ne veut pas dire disponibilité API partout

La route du modèle Gemini 3.7 Flash est vérifiée sur trois canaux API
La route du modèle Gemini 3.7 Flash est vérifiée sur trois canaux API

La GA chez Google ne signifie pas que le modèle est actif sur tous les canaux que vous utilisez. État au 14 août 2026 :

  • Canaux officiels : Gemini API / AI Studio, Android Studio, Google Antigravity, Gemini Enterprise Agent Platform, et l'expérience Spark de l'application Gemini.
  • Agrégateurs : OpenRouter l'a référencé dès le jour J ; kie.ai a suivi en moins d'un jour. La plupart des autres plateformes d'agrégation se concentrent sur les modèles open-weight et ne le proposeront probablement jamais — c'est un modèle fermé, accessible uniquement par API, sans poids à auto-héberger.
  • EvoLink : gemini-3.7-flash est disponible à la fois sur l'endpoint compatible OpenAI /v1/chat/completions et sur l'API Gemini native. Vérifiez la route sur votre propre clé avant de basculer le trafic de production :
curl -s https://api.evolink.ai/v1/models \
  -H "Authorization: Bearer $EVOLINK_API_KEY" | grep gemini-3.7-flash
gemini-3.6-flash reste disponible au même tarif sur les mêmes endpoints : vous pouvez donc étaler la migration et revenir en arrière instantanément en cas de régression.

Tarifs : la fenêtre de lancement compte

Le tarif phare de $0.75 / $3.75 est un prix de lancement avec une date d'expiration. Le calendrier publié par Google :
Jusqu'au 31 déc. 2026À partir du 1er janv. 2027
Entrée / 1M tokens$0.75$1.50
Sortie (thinking inclus) / 1M$3.75$7.50
Lecture de cache / 1M$0.075$0.15

Pour les charges de travail agentiques, la lecture de cache est le vrai levier : à 0,075 $ par million de tokens, un hit de cache coûte un dixième d'un token d'entrée classique. Les system prompts stables, les instructions de dépôt et les schémas d'outils deviennent donc rentables dès que le préfixe reste identique d'un appel à l'autre.

Le mode Batch est à moitié prix sur les deux grilles. Si vous construisez des modèles de coûts pour vos budgets 2027, utilisez les tarifs standard, pas les chiffres du lancement. Les tarifs EvoLink actuels du modèle sont affichés en direct dans la section tarifs de Gemini 3.7 Flash.

Les signaux à surveiller

  • Les réplications indépendantes des benchmarks — un seul tracker indépendant a publié des mesures pour l'instant.
  • Le suivi du taux d'hallucination — le signal de régression du jour du lancement demande plus de données.
  • Vos propres écarts de tokens par tâche — l'argument d'efficacité dépend de la charge de travail.
  • Le déploiement chez les agrégateurs — voir si une plateforme au-delà d'OpenRouter et kie.ai référence le modèle.
  • Une future version Pro — le modèle le plus récent de la gamme Pro de Google reste gemini-3.1-pro-preview.
  • Le 31 décembre 2026 — l'expiration du tarif de lancement.

FAQ

Quand Gemini 3.7 Flash est-il sorti ?

Le 13 août 2026, en tant que modèle stable en disponibilité générale (GA) — confirmé dans le changelog officiel de l'API Google et la model card.

Quel est l'ID du modèle Gemini 3.7 Flash ?

gemini-3.7-flash, avec des points, aussi bien sur l'API Gemini officielle que sur EvoLink. La forme avec tirets n'apparaît que dans les URL de pages.

Gemini 3.7 Flash est-il un nouveau modèle ou une mise à jour ?

La model card de Google le décrit comme des améliorations algorithmiques sur le socle de raisonnement de Gemini 3.6 Flash, plutôt que comme un nouveau modèle pré-entraîné.

Gemini 3.7 Flash coûte-t-il plus cher que 3.6 Flash ?

Non — les deux partagent la même grille tarifaire, y compris la fenêtre de lancement jusqu'au 31 décembre 2026.

Qu'est-il arrivé au niveau de thinking minimal ?

Il a été supprimé. Les niveaux sont désormais low, medium et high ; envoyer minimal à l'API Gemini provoque une erreur. EvoLink est configuré pour rétrograder automatiquement les anciennes requêtes minimal vers low.

Quels paramètres cassent lors de la migration depuis 3.6 ?

Les valeurs personnalisées de temperature, top_p, top_k et candidate_count sont dépréciées, et le thinking_budget numérique cède la place à la chaîne thinking_level.

Existe-t-il un Gemini 3.7 Pro ?

Non. Aucun Pro 3.5 ou 3.7 n'a été annoncé ; le modèle le plus récent de la gamme Pro reste gemini-3.1-pro-preview.

Où peut-on utiliser l'API Gemini 3.7 Flash aujourd'hui ?

Sur l'API Gemini / AI Studio de Google, Antigravity et l'Enterprise Agent Platform ; chez OpenRouter et kie.ai côté agrégateurs ; et sur EvoLink selon la note de déploiement ci-dessus — vérifiez que l'ID apparaît bien dans la liste /v1/models de votre clé.

Prêt à réduire vos coûts IA de 89 % ?

Commencez avec EvoLink dès aujourd'hui et découvrez la puissance du routage intelligent des API.