GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

GPT-5.6 API

Accédez à GPT-5.6 de OpenAI — aussi recherché sous GPT 5.6 / gpt-5.6-sol / terra / luna — via l'API de chat unifiée d'EvoLink. Testez le raisonnement, l'usage d'outils, la sortie structurée avant d'intégrer.

OpenAIGénération de texteDisponible
à partir de $0.181 / 1M tokens d’entrée$0.200 prix officiel-10%
Documentation API
Chat CompletionsResponses APIEffort de raisonnementCache de promptsAppel d'outils
Route productionLive
Contexte
1.05M de contexte · 128K de sortie max.
Idéal pour
Codage, agents en production, raisonnement complexe
Entrée
Texte
Sortie
Texte · JSON (sortie structurée) · appels d'outils

Choisir GPT-5.6

Les trois variantes utilisent la même intégration compatible OpenAI. Changez de capacité et de coût avec un seul ID de modèle exact.

GPT-5.6 Sol

Niveau phare pour une profondeur de raisonnement et des capacités d’Agent maximales.

Sélectionné
ID du modèle
gpt-5.6-sol
Idéal pour

Raisonnement complexe, Agents de code et workflows à forte valeur

< 272K
Entrée
$3.600 / 1M-10%
244.8 cr / 1M$4.000prix officiel
Lecture cache
$0.361 / 1M-10%
24.5 cr / 1M$0.400prix officiel
Écriture cache
$4.500 / 1M-10%
306 cr / 1M$5.000prix officiel
Sortie
$18.000 / 1M-10%
1224 cr / 1M$20.000prix officiel
≥ 272K
Entrée
$7.200 / 1M-10%
489.6 cr / 1M$8.000prix officiel
Lecture cache
$0.721 / 1M-10%
49 cr / 1M$0.800prix officiel
Écriture cache
$9.000 / 1M-10%
612 cr / 1M$10.000prix officiel
Sortie
$27.000 / 1M-10%
1836 cr / 1M$30.000prix officiel

GPT-5.6 Terra

Niveau équilibré pour un raisonnement et un code fiables en production.

ID du modèle
gpt-5.6-terra
Idéal pour

Fonctionnalités produit, analyse, chat et Agents du quotidien

< 272K
Entrée
$1.800 / 1M-10%
122.4 cr / 1M$2.000prix officiel
Lecture cache
$0.181 / 1M-10%
12.3 cr / 1M$0.200prix officiel
Écriture cache
$2.250 / 1M-10%
153 cr / 1M$2.500prix officiel
Sortie
$10.800 / 1M-10%
734.4 cr / 1M$12.000prix officiel
≥ 272K
Entrée
$3.600 / 1M-10%
244.8 cr / 1M$4.000prix officiel
Lecture cache
$0.362 / 1M-10%
24.6 cr / 1M$0.400prix officiel
Écriture cache
$4.500 / 1M-10%
306 cr / 1M$5.000prix officiel
Sortie
$16.200 / 1M-10%
1101.6 cr / 1M$18.000prix officiel

GPT-5.6 Luna

Niveau rapide et économique pour les applications à fort volume.

ID du modèle
gpt-5.6-luna
Idéal pour

Chat sensible à la latence, extraction et automatisation à grande échelle

< 272K
Entrée
$0.181 / 1M-10%
12.3 cr / 1M$0.200prix officiel
Lecture cache
$0.020 / 1M-4%
1.3 cr / 1M$0.020prix officiel
Écriture cache
$0.225 / 1M-10%
15.3 cr / 1M$0.250prix officiel
Sortie
$1.081 / 1M-10%
73.5 cr / 1M$1.200prix officiel
≥ 272K
Entrée
$0.362 / 1M-10%
24.6 cr / 1M$0.400prix officiel
Lecture cache
$0.039 / 1M-4%
2.6 cr / 1M$0.040prix officiel
Écriture cache
$0.450 / 1M-10%
30.6 cr / 1M$0.500prix officiel
Sortie
$1.622 / 1M-10%
110.25 cr / 1M$1.800prix officiel

Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte. Au-delà de 272K tokens de prompt, le palier long contexte s'applique : ×2 pour l'entrée et les rôles de cache, ×1.5 pour la sortie.

Tarifs GPT-5.6

Estimez le coût d'une requête GPT-5.6 avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.

Calculateur de requête

Saisissez la répartition des tokens d'une requête.

Coût estimé par requête

GPT-5.6 Sol
Tarif contexte court
USD$0.0091
Crédits0.6169

Estimation officielle $0.011 · économie $0.0011 (10%)

Tokens d'entrée0.2448 cr
Tokens lus en cache0.0049 cr
Tokens écrits en cache0 cr
Tokens de sortie0.3672 cr

Facturation minimale : 0.01 crédit par requête. À partir de 272K tokens de prompt, l'entrée et les rôles de cache sont facturés ×2, la sortie ×1.5. Les appels d'outils ne sont pas multipliés.

Guide budgétaire

Nombre approximatif de requêtes avec la répartition actuelle.
Ajouter des crédits
$10
Environ 1053 requêtes

Pour des tests rapides

$50
Environ 5511 requêtes

Pour le développement courant

$100
Environ 11022 requêtes

Pour l'évaluation en production

API GPT-5.6 — Sol, Terra et Luna

Utilisez les trois variantes GPT-5.6 avec une seule clé EvoLink : Sol pour la capacité maximale, Terra pour l'équilibre en production et Luna pour une montée en charge rapide et économique.

GPT-5.6 est servi sur EvoLink sous l'ID de modèle gpt-5.6-sol via Chat Completions · Responses, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 1.05M et jusqu'à 128K tokens de sortie, ainsi que le raisonnement, l'usage d'outils, la sortie structurée.

GPT-5.6

Spécifications et capacités de GPT-5.6

Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.

Fenêtre de contexte
1.05M tokens
Sortie max.
128K tokens
Entrée
Texte
Sortie
Texte · JSON (sortie structurée) · appels d'outils
Usage d'outils
Appels de fonctions avec séquences d'outils multi-étapes
Cache de prompt
Tarifs écriture + lecture de cache
Palier long contexte
×2 entrée / ×1.5 sortie au-delà de 272K tokens de prompt
Protocoles
Chat Completions · Responses
ID du modèle
gpt-5.6-sol

À quoi GPT-5.6 convient le mieux

Choisissez le palier selon la charge : Sol pour la profondeur, Terra pour la production quotidienne, Luna pour le volume.

Codage agentique et grands refactorings avec GPT-5.6 Sol

Modifications multi-fichiers, revue de code et boucles d’agents riches en outils, où la profondeur de raisonnement se rentabilise.

Assistants de production sur GPT-5.6 Terra

Chat client, questions-réponses documentaires et extraction structurée avec un bon rapport prix-qualité.

Classification et routage à fort volume avec GPT-5.6 Luna

Étiquetage, tri et résumés légers, là où le coût par token domine.

Analyse à long contexte jusqu’à 1M de tokens

Chargez des dépôts ou des lots de documents entiers et gardez le contexte répété peu coûteux grâce au cache de prompt.

Deux façons d'utiliser GPT-5.6 : API EvoLink ou Agent

Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez GPT-5.6 depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.

Option 1

Intégrer avec l'API EvoLink

Idéal pour : backends produit, traitements par lots, pipelines automatisés

Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.

  1. 1Créez une clé API EvoLink dans la console
  2. 2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
  3. 3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
  4. 4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Option 2

L'appeler avec un Agent

Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini

Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle GPT-5.6 via EvoLink et renvoie la réponse avec la consommation de tokens.

  1. 1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
  2. 2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
  3. 3Demandez à l'Agent d'appeler GPT-5.6 via EvoLink et d'afficher la requête avant l'envoi
  4. 4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur

Exemple de code API GPT-5.6 et gestion des erreurs

Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.

Voir la documentation API complète
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Swap the model ID for gpt-5.6-terra or gpt-5.6-luna to change the tier.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cached tokens when a prefix is
# reused).

Requête invalide ou paramètre non pris en charge

Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.

Problème d'authentification ou de solde

Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.

Longueur de contexte dépassée

Les tokens du prompt dépassent la fenêtre de contexte de GPT-5.6. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.

Limite de débit (429)

Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.

Contenu ou appel d'outil rejeté

Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.

Avant de passer GPT-5.6 en production

Quatre vérifications qui décident du coût et de la stabilité.

01

Choisir l’ID de modèle GPT-5.6 exact

Utilisez gpt-5.6-sol, gpt-5.6-terra ou gpt-5.6-luna ; il n’existe pas d’alias générique gpt-5.6.

Obligatoire
02

Prévoir le seuil de long contexte de 272K

Au-delà de 272K tokens de prompt, toute la requête passe au tarif long contexte ; restez en dessous quand c’est possible.

Recommandé
03

Structurer les prompts pour les lectures de cache

Placez les instructions stables et les références en premier pour que les lectures de cache remplacent l’entrée au plein tarif.

Recommandé
04

Mesurer avec usage, pas avec le prix catalogue

Rapprochez le coût depuis l’objet usage (entrée non mise en cache, lecture, écriture, sortie) avant de monter en charge.

Obligatoire

Cache de prompt en quatre segments

L’entrée hors cache, les lectures de cache, les écritures de cache et la sortie sont facturées séparément à partir de l’objet usage final. Les écritures de cache ne sont pas refacturées comme entrée ordinaire.

Seuil de contexte long

Au-delà de 272K prompt tokens, l’entrée et les deux rôles de cache passent à des tarifs 2x et la sortie à des tarifs 1.5x pour toute la requête.

GPT-5.6 vs autres modèles de texte

EvoLink

Comparez la variante GPT-5.6 sélectionnée à des modèles de texte frontier comparables avec les prix EvoLink par million de tokens.

GPT-5.6 Sol
Prix EvoLink / 1M (entrée / sortie)$3.6 / $18
Fenêtre de contexte1.05M
Cache de promptLecture + écriture de cache
Idéal pourRaisonnement complexe, Agents de code et workflows à forte valeur
Claude Opus 4.8
Prix EvoLink / 1M (entrée / sortie)$4.5 / $22.5
Fenêtre de contexte1M
Cache de promptLecture + écriture de cache
Idéal pourModèle phare d’Anthropic pour le raisonnement profond, le code et les Agents de longue durée.
Gemini 3.1 Pro
Prix EvoLink / 1M (entrée / sortie)$1.865 / $11.183
Fenêtre de contexte1M
Cache de promptCache de contexte
Idéal pourModèle phare de Google pour le raisonnement multimodal et les charges à grand contexte.

Les prix de contexte de base utilisent le groupe EvoLink actuel. Les utilisateurs connectés voient leur tarif de groupe ; les autres voient le tarif Default. Les multiplicateurs de contexte long restent dans la section Pricing de chaque modèle.

Famille de modèles GPT

Même clé API, même solde : changez de palier sans toucher à l’intégration.

Comparer tous les modèles GPT
GPT-6.1 Sol

GPT-6.1 Sol

Nouveau Sol pour le code multi-fichiers et les agents sur Responses

Voir le modèle
GPT-6 Astra

GPT-6 Astra

Comparez les routes GPT-5.6 appelables aux spécifications publiées de GPT-6 Astra et définissez les portes de coût, d'évaluation et de déploiement avant de migrer

Voir le modèle
GPT-6 Sol

GPT-6 Sol

Modèle GPT-6 conçu pour le codage complexe et les workflows agentiques

Voir le modèle

Autres modèles texte sur EvoLink en plus de GPT-5.6

Claude Opus 4.8

Claude Opus 4.8

Modèle phare d’Anthropic pour le raisonnement profond, le code et les Agents de longue durée.

Voir le modèle
Gemini 3.1 Pro

Gemini 3.1 Pro

Modèle phare de Google pour le raisonnement multimodal et les charges à grand contexte.

Voir le modèle
Grok 4.5

Grok 4.5

La route de raisonnement et d’outils de xAI avec un contexte de 500K et une recherche côté serveur.

Voir le modèle
Kimi K3

Kimi K3

La voie de raisonnement à contexte long de Moonshot pour le code à l’échelle d’un dépôt et le travail multi-documents.

Voir le modèle

API GPT-5.6 - FAQ

Quels ID de modèle sont disponibles ?

Utilisez gpt-5.6-sol, gpt-5.6-terra ou gpt-5.6-luna. Aucun alias générique gpt-5.6 n’est disponible.

Comment l’entrée en cache est-elle facturée ?

Les lectures et les écritures de cache sont des segments de tokens distincts. Aucun des deux n’est refacturé comme entrée ordinaire.

Quand les tarifs contexte long s’appliquent-ils ?

Lorsque le total de prompt tokens dépasse 272 000, toute la requête utilise les multiplicateurs contexte long indiqués dans le tableau des tarifs.

Puis-je utiliser le SDK OpenAI avec GPT-5.6 sur EvoLink ?

Oui. Pointez le SDK vers l’URL de base EvoLink avec votre clé API EvoLink et sélectionnez l’un des trois ID de modèle GPT-5.6.

Par quel palier GPT-5.6 commencer ?

Terra pour l’essentiel de la production, Sol quand la tâche demande un raisonnement plus profond, Luna pour les requêtes volumineuses et sensibles au coût.

GPT-5.6 prend-il en charge l’appel d’outils et la sortie structurée ?

Oui. Les trois paliers prennent en charge l’appel de fonctions et la sortie JSON structurée via les champs standard de Chat Completions.