GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

Mises à jour API

Restez informé des dernières évolutions et améliorations sur l’ensemble de nos API.

septembre 2026

2026-09-30

Nouveaux modèles | Suno V6, Suno V6 Mini et Suno V6 Wild

models

Suno V6, Suno V6 Mini et Suno V6 Wild sont désormais disponibles sur EvoLink, et Suno V6 devient la version recommandée par défaut sur la page Suno. Les trois coûtent le même prix que les modèles musicaux Suno existants, avec une facturation par génération et 2 morceaux par génération.

Suno V6

  • ID de modèle : suno-v6-beta
  • Points forts : voix plus naturelles, plus de détails et une expression musicale plus riche
  • Prise en charge : Persona et duration personnalisée (60 secondes ou plus recommandées)

Suno V6 Mini

  • ID de modèle : suno-v6-mini-beta
  • Points forts : léger et rapide, équilibre entre qualité et vitesse
  • Prise en charge : Persona ; la duration personnalisée n'est pas encore prise en charge
  • Essayer : choisissez Suno V6 Mini dans le sélecteur de modèle

Suno V6 Wild

  • ID de modèle : suno-v6-wild-beta
  • Points forts : une expression musicale plus audacieuse et plus distinctive
  • Prise en charge : Persona et duration personnalisée
  • Essayer : choisissez Suno V6 Wild dans le sélecteur de modèle

Commun aux trois modèles

  • Tarif : identique aux modèles musicaux Suno existants, facturé par génération quelle que soit la durée des morceaux. Voir les tarifs
  • Limites de longueur : en mode personnalisé (custom_mode=true), paroles jusqu'à 5000 caractères et style jusqu'à 1000 caractères
  • Persona et durée : disponibles uniquement en mode personnalisé
  • Tâches asynchrones : soumettez, puis interrogez le statut ou utilisez callback_url

Toutes les versions de Suno

  • La limite du prompt en mode simple (custom_mode=false) passe de 500 à 3000 caractères
2026-09-29

Nouveau modèle | GPT-6.1 Sol

models

GPT-6.1 Sol est désormais disponible sur EvoLink. OpenAI le présente comme offrant des performances proches d’Astra pour le travail complexe, à moindre coût : code complexe, computer use et travail professionnel.

GPT-6.1 Sol

  • ID du modèle : gpt-6.1-sol — écrit avec un point ; GPT-6 Sol reste disponible sous son propre ID
  • Conçu pour : le code et le débogage complexes, le computer use et le travail professionnel en plusieurs étapes
  • Fenêtre de contexte : 1 050 000 tokens, jusqu’à 128K en sortie max
  • Facturation : entrée non mise en cache, lecture de cache, écriture de cache et sortie sont mesurées séparément ; le prix de lecture de cache d’OpenAI est deux fois plus bas que pour GPT-6 Sol. Les tarifs actuels figurent sur la page du modèle GPT-6.1 Sol
  • Contexte long : au-delà de 272K tokens de prompt, toute la requête est facturée aux tarifs contexte long — 2x pour l’entrée et les deux rôles de cache, 1,5x pour la sortie
  • Protocoles : Chat Completions et Responses compatibles OpenAI, avec la même clé API EvoLink

Changements par rapport à GPT-6 Sol

  • Raisonnement : reasoning_effort (Chat) ou reasoning.effort (Responses) accepte low, medium (par défaut), high et xhigh, plus max sur Responses ; none n’est pas pris en charge, remplacez donc none par low
  • Appels d’outils : Chat Completions n’accepte que les requêtes sans outils ; envoyez l’appel de fonctions et les outils intégrés vers Responses
  • Paramètres : retirez temperature, top_p, logprobs et top_logprobs des requêtes
2026-09-29

Claude Sonnet 5.5 | Le dernier Sonnet d'Anthropic pour le code et les agents

models

Claude Sonnet 5.5 d'Anthropic est désormais disponible sur EvoLink — le successeur de Claude Sonnet 5 au même prix catalogue, pour le codage quotidien, les agents qui utilisent des outils et le trafic de production à fort volume, avec une fenêtre de contexte de 1M tokens et jusqu'à 128K de sortie maximale.

Claude Sonnet 5.5

  • ID du modèle : claude-sonnet-5-5
  • Fenêtre de contexte : 1M tokens
  • Sortie maximale : 128K tokens
  • Capacités : codage agentique dans de vrais dépôts, utilisation fiable des outils, adaptive thinking (activé par défaut), entrée d'images, prompt caching
  • Charges de travail recommandées : codage quotidien, agents qui utilisent des outils et trafic de production à fort volume
  • Facturation : à l'usage (tokens) — Input, Output, Cache Write, Cache Hit ; l'outil de recherche web est facturé à la recherche sur les routes qui le prennent en charge. Tarifs actuels dans la section tarifs
  • API : Chat Completions compatible OpenAI et Anthropic Messages, avec la même clé API EvoLink
2026-09-29

GLM, DeepSeek & Kimi K3 | Tarifs en baisse

pricing

GLM, DeepSeek et Kimi K3 voient leurs tarifs baisser sur EvoLink, à compter du 30 septembre 2026 (UTC+8). La mise à jour concerne GLM-5.3, GLM-5.3 Flash, GLM-5.3 FlashX, GLM-5.2, DeepSeek V4 Pro, DeepSeek V4 Flash, DeepSeek V4.1 Flash et Kimi K3 : l'entrée et la sortie baissent sur chacun de ces modèles, et la lecture du cache baisse ou reste inchangée sur la plupart d'entre eux. Les nouveaux tarifs s'appliquent automatiquement, sans aucun changement dans vos appels API.

  • La lecture du cache de GLM-5.3 et GLM-5.3 FlashX augmente légèrement avec les nouveaux tarifs
  • deepseek-v4-flash-vision-exp est désormais servi par DeepSeek V4.1 Flash et facturé aux tarifs de DeepSeek V4.1 Flash
2026-09-24

Nouveaux modèles | Seedream 5.0 Flash et Seedream 5.0 Flash Layerize

models

Seedream 5.0 Flash et Seedream 5.0 Flash Layerize sont désormais disponibles sur EvoLink. Flash est le modèle Seedream 5.0 le plus rapide pour la génération et l'édition d'images ; Flash Layerize sépare une image en calques modifiables. Les deux facturent un prix fixe par image générée, 10 % sous le tarif officiel.

Seedream 5.0 Flash

  • ID de modèle : doubao-seedream-5.0-flash
  • Génération et édition : texte vers image, image vers image et retouche avec jusqu’à 10 références ; size accepte auto, un format ou des pixels personnalisés ; quality vaut 1K, 1.5K ou 2K. La sortie transparente conserve l’alpha existant d’une seule référence et exige le PNG ; elle ne supprime pas le fond
  • Tarif : un prix fixe par image générée — 1K, 1.5K et 2K coûtent le même prix, et les images de référence ne sont pas facturées. Voir les tarifs

Seedream 5.0 Flash Layerize

  • ID de modèle : doubao-seedream-5.0-flash-layerize
  • Entrée : exactement une image png ou jpeg ; prompt est facultatif
  • Sortie : une image de base plus jusqu'à 16 calques PNG transparents, chacun avec son ordre d'empilement et sa zone de délimitation
  • Tarif : chaque image générée — l'image de base et chaque calque — est facturée au même prix fixe que Flash. Jusqu'à 17 images sont réservées au démarrage et la part non utilisée est remboursée

Commun aux deux modèles

  • Même requête que Seedream 5.0 Pro : quality vaut 1K, 1.5K ou 2K (Layerize accepte aussi auto)
  • Mode de prompt : prompt_priority n'accepte que standard — les requêtes avec fast sont refusées et non facturées
  • Tâches asynchrones : soumettez, puis interrogez le statut ou utilisez callback_url
2026-09-23

Nouveaux modèles | GPT-6 Sol et GPT-6 Luna

models

GPT-6 Sol et GPT-6 Luna rejoignent GPT-6 Astra sur EvoLink. Sol est conçu pour le code complexe et les workflows agentiques ; Luna est le modèle GPT-6 le plus efficace d’OpenAI pour les tâches ciblées à fort volume.

GPT-6 Sol

  • ID du modèle : gpt-6-sol — il n’existe pas d’alias générique gpt-6
  • Conçu pour : le code complexe, les modifications sur plusieurs fichiers et les agents pilotés par des outils
  • Facturation : entrée non mise en cache, lecture de cache, écriture de cache et sortie sont mesurées séparément. Les tarifs actuels figurent sur la page du modèle GPT-6 Sol

GPT-6 Luna

  • ID du modèle : gpt-6-luna
  • Conçu pour : la classification, l’extraction, le routage et les appels de sous-agents à fort volume
  • Facturation : les mêmes quatre postes mesurés séparément. Les tarifs actuels figurent sur la page du modèle GPT-6 Luna

Commun aux deux modèles

  • Fenêtre de contexte : 1 050 000 tokens, jusqu’à 128K en sortie
  • Contexte long : au-delà de 272K tokens de prompt, toute la requête est facturée au tarif contexte long — 2x pour l’entrée et les deux rôles de cache, 1,5x pour la sortie
  • Protocoles : Chat Completions et Responses compatibles OpenAI, avec la même clé API EvoLink
  • Raisonnement : reasoning_effort (Chat) ou reasoning.effort (Responses) accepte none, low, medium (par défaut), high, xhigh et max — none est nouveau par rapport à GPT-6 Astra
  • Appels d’outils : utilisez Responses pour les outils intégrés et le function calling ; sur Chat Completions, le function calling ne fonctionne qu’avec reasoning_effort réglé sur none
2026-09-23

GPT-5.6 Sol | Tarifs en baisse

pricing

GPT-5.6 Sol voit tous ses tarifs baisser sur EvoLink, suite au nouveau prix catalogue d'OpenAI pour ce modèle, à compter du 23 septembre 2026 (UTC+8). L'entrée, la lecture du cache, l'écriture du cache et la sortie baissent, tarifs contexte long compris. Les nouveaux tarifs s'appliquent automatiquement — continuez d'appeler gpt-5.6-sol, sans aucun changement dans vos appels API.

  • Les tarifs de GPT-5.6 Terra et GPT-5.6 Luna restent inchangés
2026-09-22

Nouveau modèle | Claude Opus 5.5

models

Claude Opus 5.5 — le dernier modèle Opus d’Anthropic, successeur de Claude Opus 5 à un prix catalogue plus bas — est disponible sur EvoLink.

Disponibilité

Claude Opus 5.5 peut être appelé via l’API de production EvoLink avec la même clé API EvoLink. La page du modèle Claude Opus 5.5 fait foi pour les tarifs et paramètres en vigueur.

ID du modèle

  • claude-opus-5-5 — fenêtre de contexte de 1 000 000 tokens, jusqu’à 128K de sortie maximale

Dimensions de facturation

Cinq dimensions sont mesurées séparément : entrée, écriture de cache, lecture de cache, sortie et outil de recherche web. La recherche web est facturée à la recherche, et ses résultats comptent en plus comme tokens d’entrée ordinaires. Consultez la section tarifs pour les prix actuels.

Depuis Claude Opus 5

Anthropic affiche Opus 5.5 sous Opus 5 sur chaque tarif par token, et la lecture du cache passe d’un dixième à un vingtième du prix d’entrée. Trois réglages de requête se comportent autrement : la réflexion ne peut pas être désactivée — envoyez thinking: {type: "adaptive"} ou omettez le paramètre et réglez la profondeur avec effort ; la valeur par défaut d’effort est medium au lieu de high ; et le choix d’outil forcé (any ou tool) est refusé, utilisez donc auto.

Protocoles

Chat Completions compatible OpenAI et Anthropic Messages, avec la même clé API EvoLink.

Essayer Claude Opus 5.5 | Voir les tarifs

2026-09-22

Grok 4.7 | Le dernier modèle de raisonnement de xAI, au tarif de Grok 4.6

models

Grok 4.7 est disponible sur EvoLink, avec un contexte de 500 000 tokens, accessible via Chat Completions et Responses.

Tarifs — identiques à Grok 4.6, ligne par ligne

  • Entrée : 2,00 $ par million de tokens (prix affiché)
  • Entrée en cache : 0,50 $ par million de tokens
  • Sortie : 6,00 $ par million de tokens, tokens de raisonnement inclus
  • À partir de 200 000 tokens de prompt, tous les tokens de la requête passent au palier long contexte, facturé ×2
  • La page du modèle affiche le tarif réellement appliqué à votre compte

Ce qui change par rapport à Grok 4.6

  • L’ID de modèle pour les requêtes est grok-4.7. Le slug de page grok-4-7 n’est pas une valeur valide
  • reasoning_effort accepte low, medium, high (par défaut) et xhigh
  • Sur Responses, le raisonnement chiffré est renvoyé à chaque réponse, sans le déclarer dans include
  • La date de connaissance passe à mai 2026
2026-09-22

Recherche X de Grok | Facturation aux posts et profils récupérés

modelspricing

La recherche X de Grok est désormais facturée selon ce qu’une recherche renvoie, et non selon le nombre d’exécutions. xAI a effectué ce changement le 21 septembre 2026 à 12h00 PT ; il s’applique à grok-4.5, grok-4.6 et grok-4.7.

Tarifs — en vigueur le 21 septembre 2026

  • Posts récupérés : 5 $ pour 1 000 posts, au lieu de 5 $ pour 1 000 appels
  • Profils d’utilisateur récupérés : 10 $ pour 1 000 profils, nouvelle ligne de facturation
  • Chaque post renvoyé par une recherche ou un fil compte, y compris les posts parents et cités, sans déduplication
  • Les autres outils côté serveur ne changent pas : recherche web et exécution de code à 5 $ pour 1 000 appels, recherche de pièces jointes à 10 $ pour 1 000, recherche dans les collections à 2,50 $ pour 1 000

Ce que cela change sur votre facture

  • Auparavant, un appel x_search coûtait le même prix qu’il renvoie 1 post ou 30. Le décompte se fait maintenant par élément
  • Les recherches qui tirent de longs fils deviennent nettement plus coûteuses ; limitez le volume avec search_parameters.max_search_results
  • Les coûts en tokens ne changent pas et restent calculés séparément des frais d’outils
2026-09-22

Mise à jour Seedance 2.5 | Mode brouillon et Draft-to-Video

models

Seedance 2.5 prend en charge un flux en deux étapes : un aperçu rapide, puis la vidéo finale une fois validé.

Nouveautés

  • Mode brouillon : passez draft: true sur l'un des cinq modèles de génération Seedance 2.5 (ou activez le mode brouillon dans le Playground) pour un aperçu 480p rapide de la scène, des mouvements de caméra et du sujet. Facturé comme une vidéo 480p normale
  • seedance-2.5-draft-to-video : convertit un brouillon terminé en vidéo finale 1080p avec seulement source_task_id et un output_format optionnel. Prompt, médias, durée, ratio, seed et audio sont repris du brouillon

Notes

  • Le brouillon et la finale sont facturés séparément, la finale au tarif 1080p ; le filtre de contenu est repris du brouillon et ne peut pas être modifié à la conversion
  • Un brouillon terminé renvoie draft_expires_at ; au-delà, la conversion renvoie 410 draft_task_expired
2026-09-21

GLM-5.3 FlashX | Nouveau palier de débit dans la famille 5.3

models

GLM-5.3 FlashX est disponible. Il se place entre GLM-5.3 Flash et le modèle phare GLM-5.3 : le même contexte nativement multimodal de 1 M de tokens et un raisonnement toujours actif, pour environ un quart du prix du modèle phare.

  • Identifiant glm-5.3-flashx, disponible via Chat Completions, Responses et Anthropic Messages
  • Entrées texte, image, vidéo et fichier ; les lectures de cache sont facturées à un tarif réduit dédié
  • La recherche web est facturée à l'appel, séparément de la consommation de tokens
  • Les niveaux de raisonnement acceptés sont low, high et max ; les autres valeurs sont ramenées au niveau le plus proche

La page du modèle affiche le tarif par token en vigueur pour votre compte. Les chiffres actuels figurent sur la page des tarifs.

2026-09-17

Nouveau modèle | MiniMax H3 Max Reference-to-Video

models

MiniMax H3 Max accepte désormais des médias de référence — images, vidéo et audio — via une nouvelle route. La sortie est facturée à la seconde ; la vidéo de référence a son propre tarif, plus élevé.

MiniMax H3 Max Reference-to-Video

  • ID du modèle : minimax-h3-max-reference-to-video
  • Médias de référence : jusqu'à 9 images, 3 vidéos et 3 audios, 12 éléments au total. Au moins une image ou une vidéo de référence est requise — l'audio seul est refusé
  • Sortie : MP4 768p ou 480p, 5–15 secondes, le format suit par défaut le matériel de référence. H3 Max n'a pas de palier 2K
  • Tarification : trois volets — secondes de sortie, secondes de vidéo de référence à un tarif distinct et plus élevé, et images de référence au-delà du quota gratuit. L'audio de référence n'est pas facturé. Voir les tarifs
  • Quota d'images gratuit : les 2 premières images de référence sont offertes. MiniMax H3 en offre 5 : un même brief peut donc coûter plus cher ici — vérifiez l'estimation avant de migrer
  • Non pris en charge : image_start / image_end
  • Tâches asynchrones : soumettez, puis interrogez le statut ou utilisez callback_url
2026-09-17

Nouveau modèle | MiniMax H3 Max Turbo

models

MiniMax H3 Max Turbo — le palier rapide de MiniMax H3 Max — est désormais disponible sur EvoLink : deux routes, sortie 768p / 480p, facturation à la seconde.

MiniMax H3 Max Turbo

  • ID de modèle : minimax-h3-max-turbo-text-to-video, minimax-h3-max-turbo-image-to-video
  • Sortie : MP4 en 768p ou 480p, 5 à 15 secondes. Format 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 — le texte-vers-vidéo exige un format explicite (16:9 par défaut)
  • Tarif : par seconde produite, 5% de moins que le tarif officiel de Turbo à résolution égale ; la facturation minimale correspond à la requête valide la moins chère (480p × 5 s). Voir les tarifs
  • Image vers vidéo : image_start (première image) est obligatoire, image_end (dernière image) est facultatif. Une dernière image seule n'est pas prise en charge. Cette route n'accepte pas de format — la sortie suit les proportions de l'image d'entrée
  • Résolution par défaut : les requêtes sans quality génèrent en 768p. Envoyez "quality": "480p" pour le palier le moins cher
  • Absent de Turbo : sortie 2K, clips de 4 secondes et toute génération pilotée par référence — ni images, ni vidéos, ni audios de référence. Utilisez MiniMax H3 ou MiniMax H3 Max si vous avez besoin de médias de référence
  • Tâches asynchrones : soumettez, puis interrogez le statut ou utilisez callback_url
2026-09-17

Seedance 2.5 | La 1080p revient au tarif normal

pricing

La remise à durée limitée de 28 % sur la sortie 1080p de Seedance 2.5 a pris fin comme prévu le 17 septembre 2026 (UTC+8). La 1080p revient à son tarif normal sur les cinq modèles. Aucune modification de vos appels d'API n'est nécessaire.

  • Les tarifs 480p et 720p restent inchangés
  • Concerne seedance-2.5-text-to-video, seedance-2.5-image-to-video, seedance-2.5-reference-to-video, seedance-2.5-video-edit et seedance-2.5-video-extend

L'estimation du Playground et la page tarifs affichent déjà le tarif normal. Consultez la page tarifs pour le tarif à la seconde en vigueur.

2026-09-16

MiniMax H3 Max | Baisse de 5 % sur les deux résolutions

modelspricing

MiniMax H3 Max bénéficie d’une baisse de prix de 5 % sur les deux résolutions, en génération vidéo à partir de texte comme d’images.

Tarifs — 5 % de réduction à partir du 16 septembre 2026

  • 768p : 0,076 $ par seconde de vidéo générée, contre 0,080 $ auparavant
  • 480p : 0,0475 $ par seconde de vidéo générée, contre 0,050 $ auparavant
  • Facturation minimale : 0,2375 $ par tâche, contre 0,250 $ auparavant (480p × 5 secondes)
  • Les deux routes appliquent les mêmes tarifs : minimax-h3-max-text-to-video et minimax-h3-max-image-to-video

Choisir la résolution de sortie

  • Sans paramètre quality, les requêtes génèrent en 768p. Pour bénéficier du tarif le plus bas, indiquez explicitement "quality": "480p"
  • Les deux résolutions permettent de générer 5 à 15 secondes de vidéo, facturées à la seconde de sortie
2026-09-10

Nouveau modèle | DeepSeek V4.1 Flash

models

DeepSeek V4.1 Flash apporte la compréhension d’image native aux workflows de code, de documents et de captures d’écran. Consultez la page du modèle pour les tarifs actuels avant tout déploiement.

DeepSeek V4.1 Flash

  • ID de modèle : deepseek-v4.1-flash sur EvoLink ; l’URL de la page est /deepseek-v4-1-flash
  • Fenêtre de contexte : 1 000 000 de tokens, avec une sortie maximale de 384 000 tokens ; fixez un budget de sortie adapté à la tâche
  • Facturation : l’entrée, la lecture de cache et la sortie ont chacune leur propre tarif. Vérifiez la section tarifs de la page du modèle et les montants réellement facturés sur votre compte ; les tarifs par token ne suffisent pas à déterminer le coût d’une tâche
  • Entrée image : PNG, JPEG, WebP et GIF. Mesurez la consommation sur des images représentatives avant de monter en charge
  • Protocoles : Chat Completions, Messages et Responses acceptent le même ID de modèle ; les champs image diffèrent : image_url, un bloc image et input_image
  • Réflexion et cache : la réflexion est activée par défaut et le cache de préfixe est automatique ; notez le réglage de réflexion que vous envoyez, vérifiez la documentation du protocole utilisé et lisez les tokens mis en cache dans le champ usage
  • Anciens modèles : sur EvoLink, deepseek-v4-flash et deepseek-v4-pro ne sont pas concernés et continuent de servir V4 Flash et V4 Pro ; deepseek-v4-flash-vision-exp redirige désormais vers V4.1 Flash. Voir le guide de migration
2026-09-09

Nouveau modèle | GPT Image 2.5 Sunburst & Flare

models

GPT Image 2.5 Sunburst et GPT Image 2.5 Flare sont désormais disponibles sur EvoLink : les deux modèles GPT Image 2.5 publiés par OpenAI le 8 septembre 2026, aux mêmes tarifs au token que GPT Image 2.

GPT Image 2.5 Sunburst

  • ID de modèle : gpt-image-2.5-sunburst (pas d'alias ; utilisez l'ID exact)
  • Positionnement : le choix d'OpenAI pour les workflows où la précision d'édition compte le plus, avec un contrôle plus serré sur les éditions multi-tours et des temps de génération plus longs
  • Entrée : prompt texte, jusqu'à 16 images de référence et un masque d'inpainting optionnel ; sortie : image
  • Qualité : cinq niveaux low / medium / high / xhigh / max (par défaut medium) ; taille auto, 15 ratios ou WxH explicite ; résolution 1K / 2K / 4K
  • Facturation : au token — les tokens de sortie image, d'entrée image, d'entrée en cache et d'entrée texte sont réglés sur l'objet usage de l'amont ; tarifs dans la section prix
  • Endpoint : POST /v1/images/generations, tâche asynchrone avec polling ou callback_url

GPT Image 2.5 Flare

  • ID de modèle : gpt-image-2.5-flare (pas d'alias ; utilisez l'ID exact)
  • Positionnement : le choix rapide par défaut d'OpenAI pour la génération quotidienne de haute qualité — meilleure qualité que GPT Image 2 avec jusqu'à 50 % de latence en moins (chiffre d'OpenAI)
  • Entrée : prompt texte, jusqu'à 16 images de référence et un masque d'inpainting optionnel ; sortie : image
  • Qualité : cinq niveaux low / medium / high / xhigh / max (par défaut medium) ; taille auto, 15 ratios ou WxH explicite ; résolution 1K / 2K / 4K
  • Facturation : au token — les tokens de sortie image, d'entrée image, d'entrée en cache et d'entrée texte sont réglés sur l'objet usage de l'amont ; tarifs dans la section prix
  • Endpoint : POST /v1/images/generations, tâche asynchrone avec polling ou callback_url

Mêmes tarifs au token ne veut pas dire même facture : chaque niveau de qualité dépense différemment ses tokens de sortie, et GPT Image 2.5 utilise une base de tuiles plus faible par niveau que GPT Image 2 (son high coûte à peu près ce que coûtait le medium de GPT Image 2). Estimez une requête dans le Playground ou le calculateur de prix avant de standardiser un niveau.

2026-09-07

Remise prolongée | Seedance 2.0 Mini et Fast

pricing

La baisse de prix à durée limitée sur Seedance 2.0 Mini et Seedance 2.0 Fast, qui devait s'achever aujourd'hui, est prolongée jusqu'au 6 octobre 2026 (UTC+8). Les tarifs et le niveau de remise restent inchangés, et la remise s'applique toujours automatiquement, sans modifier vos appels d'API. Seedance 2.0 Standard reste hors du champ de cette offre.

  • Seedance 2.0 Mini : -60 %
  • Seedance 2.0 Fast : -25 %

La baisse continue de s'appliquer à toutes les résolutions et à tous les modes de génération (text-to-video, image-to-video, reference-to-video). Consultez la page tarifs de chaque modèle pour les prix en vigueur.

L'offre se termine désormais le 6 octobre 2026 (UTC+8), après quoi les deux modèles reviennent à leur tarif initial.

2026-09-04

Nouveau modèle | GPT-6 Astra

models

GPT-6 Astra — le modèle le plus performant d’OpenAI, conçu pour les tâches de bout en bout les plus difficiles en raisonnement, codage, computer use et recherche — est désormais disponible sur EvoLink, 10 % sous le prix catalogue OpenAI.

GPT-6 Astra

  • ID de modèle : gpt-6-astra — il n’existe pas d’alias générique gpt-6
  • Fenêtre de contexte : 1 050 000 tokens, jusqu’à 128K de sortie max
  • Facturation : entrée non mise en cache, lecture de cache, écriture de cache et sortie sont mesurées séparément, chacune 10 % sous le prix catalogue OpenAI. Tarifs actuels sur la page du modèle GPT-6 Astra
  • Long contexte : au-delà de 272K tokens de prompt, la requête entière est facturée aux tarifs long contexte — 2x pour l’entrée et les deux rôles de cache, 1,5x pour la sortie
  • Protocoles : Chat Completions et Responses compatibles OpenAI, avec la même clé API EvoLink ; OpenAI impose Responses pour les appels d’outils
  • Raisonnement : définissez reasoning_effort (Chat) ou reasoning.effort (Responses) sur low, medium, high, xhigh ou max — none et minimal sont refusés, et temperature / top_p ne sont pas acceptés
  • Également pris en charge : cache de prompt et sorties structurées sur les deux surfaces
2026-09-03

Nouveau modèle | MiniMax H3 Max

models

MiniMax H3 Max — la variante de génération rapide de la famille Hailuo de MiniMax — est désormais disponible sur EvoLink : deux routes, sortie en 768p / 480p, facturation à la seconde.

MiniMax H3 Max

  • ID de modèle : minimax-h3-max-text-to-video, minimax-h3-max-image-to-video
  • Sortie : MP4 en 768p ou 480p, 5–15 secondes. Rapport d'aspect 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 — le texte-vers-vidéo exige un rapport explicite (16:9 par défaut)
  • Tarifs : 0,080 $ par seconde produite en 768p, 0,050 $ en 480p, même tarif sur les deux routes ; le montant minimum correspond à la requête valide la moins chère (480p × 5 s, 0,25 $ par tâche)
  • Image-vers-vidéo : envoyez une première image, une dernière image, ou les deux. Cette route ne permet pas de choisir le rapport d'aspect — la sortie suit toujours les proportions de l'image d'entrée
  • Résolution par défaut : les requêtes sans quality sont générées en 768p. Envoyez "quality": "480p" pour le palier le moins cher
  • Absent de H3 Max : la sortie 2K, les clips de 4 secondes et la génération par référence. Utilisez MiniMax H3 pour le 2K ou pour des images, vidéos et audios de référence
  • Tâches asynchrones : envoyez, puis interrogez le statut ou utilisez callback_url
2026-09-02

Nouveau modèle | Gemini 3.8 Flash

models

Gemini 3.8 Flash est désormais disponible sur EvoLink, au même tarif que Gemini 3.7 Flash.

C'est le modèle Flash le plus performant de Google à ce jour : il progresse nettement par rapport à 3.7 en ingénierie logicielle, en computer use et sur les tâches agentiques multi-étapes, tout en conservant le débit et le coût de la gamme Flash.

Gemini 3.8 Flash

  • ID de modèle : gemini-3.8-flash
  • Contexte : 1 048 576 tokens ; sortie max : 65 536 tokens
  • Entrée : texte, image, audio, vidéo, PDF ; sortie : texte
  • Capacités : thinking, instructions système, sortie structurée, cache de contexte, function calling, exécution de code, grounding Google Search / Maps
  • Tarifs : entrée $0,675/M tokens, sortie $3,375/M tokens, cache hit $0,0676/M tokens (tarif promotionnel, jusqu'au 31 décembre 2026)
  • Points d'accès : /v1/chat/completions (style OpenAI) et l'API Gemini native

Les niveaux de raisonnement sont identiques à 3.7

Gemini 3.8 Flash ne prend pas en charge le niveau minimal, comme 3.7. Les niveaux disponibles sont low / medium / high, avec medium par défaut.

Lors de la migration depuis 3.7, si votre code définit reasoning_effort: "none" ou "minimal" (thinkingLevel: "MINIMAL" sur l'API native), EvoLink le rétrograde automatiquement en low : vos requêtes n'échoueront pas. Pour un contrôle explicite, indiquez directement low.

Au-delà de l'ID de modèle, rien d'autre ne change : 3.8 correspond à 3.7 champ par champ pour la fenêtre de contexte, la sortie maximale, les modalités et les tarifs officiels. Si vous venez de 3.6 Flash ou d'une version antérieure, la checklist de migration officielle de Google impose toujours de supprimer les valeurs personnalisées de temperature, top_p, top_k et candidate_count, de remplacer le thinking_budget numérique par la chaîne thinking_level et de supprimer les tours model préremplis.

2026-09-02

Nouveau modèle | Claude Fable 5.1

models

Claude Fable 5.1 — le modèle le plus performant d'Anthropic, la gamme Fable au-dessus d'Opus — est désormais disponible sur EvoLink, à 5 % sous le tarif officiel des tokens.

Disponibilité

Claude Fable 5.1 s'appelle sur l'API de production EvoLink avec la même clé API EvoLink. La page du modèle Claude Fable 5.1 fait référence pour les tarifs et paramètres à jour.

ID du modèle

  • claude-fable-5-1 — fenêtre de contexte de 1 000 000 tokens, jusqu'à 128K de sortie maximale

Dimensions de facturation

Cinq dimensions sont mesurées séparément : entrée, écriture du cache, lecture du cache, sortie et outil de recherche web. Les tarifs des tokens sont 5 % sous les prix officiels d'Anthropic ; la recherche web est facturée par recherche au tarif officiel sans remise, et les résultats comptent en plus comme des tokens d'entrée ordinaires. Tarifs actuels dans la section tarifs.

Migration depuis Claude Fable 5

Les tarifs catalogue d'Anthropic pour l'entrée, la sortie et l'écriture du cache sont inchangés. La différence : Anthropic a ramené la lecture du cache au quart du tarif de Fable 5 — les exécutions d'agents à forte mise en cache et les longues sessions de code deviennent nettement moins chères. Sur EvoLink, les trois autres tarifs sont environ 5,6 % au-dessus de Fable 5, car Fable 5 bénéficie de 10 % de remise et 5.1 de 5 %.

Protocoles

Chat Completions compatible OpenAI et Anthropic Messages, avec la même clé API EvoLink. Le raisonnement est toujours actif : envoyez thinking: {type: "adaptive"} ou omettez le paramètre, et réglez la profondeur avec effort plutôt qu'avec des paramètres d'échantillonnage.

Essayer Claude Fable 5.1 | Voir les tarifs

2026-09-01

Mise à jour tarifaire | Claude Sonnet 5

pricing

Anthropic a rendu permanente la baisse de prix de Claude Sonnet 5. EvoLink transforme au même moment son offre de lancement en tarif durable : le montant payé par token ne change pas et n'augmentera plus à la fin de la promotion.

Ce qui change

  • Le prix public officiel baisse définitivement : entrée 3,00 $ → 2,00 $/1M tokens, sortie 15,00 $ → 10,00 $/1M tokens, écriture de cache 3,75 $ → 2,50 $/1M tokens, lecture de cache 0,30 $ → 0,20 $/1M tokens.
  • Votre tarif EvoLink est inchangé. L'offre de lancement qui devait se terminer le 31 août devient le tarif standard : aucune hausse à l'échéance.
  • La remise affichée se lit différemment. Elle était calculée par rapport à l'ancien prix public de 3,00 $ ; le prix officiel étant désormais de 2,00 $ en permanence, le même tarif EvoLink apparaît comme 10 % sous le prix officiel. Le montant facturé est identique.

Ce qui ne change pas

L'ID du modèle reste claude-sonnet-5, avec la même fenêtre de contexte de 1M tokens et 128K de sortie maximale, sur Chat Completions compatible OpenAI et Anthropic Messages. Aucune modification de vos appels API n'est nécessaire. L'outil de recherche web reste facturé par recherche au tarif officiel.

Les tarifs actuels figurent toujours sur la page du modèle Claude Sonnet 5.

Claude Sonnet 5 | Voir les tarifs