GPT Image 2 API
Essayez GPT Image 2 avant d'intégrer l'API
Testez la qualité de sortie, estimez le coût en tokens d'une requête et générez un échantillon avant toute intégration formelle.
Create image task
Fixed to gpt-image-2Text-to-image, image-to-image and mask-guided editing. Billed by the tokens the upstream usage object reports.
Upload source or reference images for image-to-image and editing. Each one adds image input tokens.
Pixel budget for the chosen ratio: 1K about 1.05 MP, 2K about 4.19 MP, 4K is 8.29 MP.
Rendering effort. It drives the output token count, so it is the single biggest cost lever.
Transparent keeps an alpha channel in the output. This is a Preview feature — results may be unstable.
Number of images per request (1-10). Cost scales linearly with the count.

Les résultats sont conservés 24 heures — téléchargez ce que vous souhaitez garder.
Connaissez votre coût de test avant de créditer votre compte
Partez du coût d'un seul échantillon, choisissez un budget de test, puis chiffrez votre propre cas dans le calculateur. Les tarifs bruts par token sont en bas.
First Test Cost
Text-to-Image - 1K - 1:1 - mediumOne 1K prompt-only image
About 208 tests with $10 in credits.
Iterate prompts on low quality at 1K to save tokens, then promote the final render to high. Each reference image in image_urls adds input tokens.
Testing Budget Guide
Pick an amount based on how many tests you expect.Good for a first validation.
Good for prompt iteration.
Good before production integration.
Common Cost Examples
Estimated cost for one generated 1:1 image. Final cost is settled against the token counts the upstream usage object reports.
Model Pricing
This page serves two models and they are billed differently. Each block states its own rule, so read the badge before comparing the numbers.
gpt-image-2Token-basedBilled by token, so there is no fixed per-image price. These are the raw rates; what a request actually costs depends on its size, quality, reference images and count. Use the calculator below to price your own case.
| Item | Rule | Rate | Billing |
|---|---|---|---|
| Image output tokens | The generated image itself. Token count grows with the resolution tier and the quality tier. | $0.027/1K tokens-10% 1.836 cr/1K tokens$0.030 prix officiel | Output tokens |
| Image input tokens | Applied to each reference image in image_urls, and to a mask when one is sent. | $0.0072/1K tokens-10% 0.4896 cr/1K tokens$0.0080 prix officiel | Input tokens |
| Image cached input tokens | Charged only when the upstream usage object reports cached image tokens. | $0.0018/1K tokens-10% 0.1224 cr/1K tokens$0.0020 prix officiel | Input tokens |
| Text input tokens | Produced by the prompt itself. Typically under 1% of a request. | $0.0045/1K tokens-10% 0.306 cr/1K tokens$0.0050 prix officiel | Input tokens |
| Text cached input tokens | Charged only when the upstream usage object reports cached text tokens. | $0.0012/1K tokens-10% 0.0765 cr/1K tokens$0.0013 prix officiel | Input tokens |
Figures are estimates. Final charges are based on actual token usage.
gpt-image-2-betaFlat per callOne flat rate per call, whatever the aspect ratio - no token accounting and nothing to estimate. Auto or aspect-ratio sizes at the 1K tier only, one image per call. The OpenAI list price has no equivalent for this route, so no official comparison is shown.
| Item | Rule | Rate | Billing |
|---|---|---|---|
| 1K output | Any aspect ratio or auto, at the 1K tier. One image per call, regardless of prompt length or reference images. | $0.015/image 1.02 cr/image | Per call |
L'API GPT Image 2 en un coup d'œil
GPT Image 2 a été lancé en même temps que ChatGPT Images 2.0 et est disponible via l'API sous l'ID de modèle gpt-image-2. Utilisez-le pour la génération riche en texte et l'édition haute fidélité ; ChatGPT peut y ajouter de l'orchestration et des outils distincts du modèle d'image brut.
Ce que GPT Image 2 sait créer
Générez des images haute fidélité depuis un prompt texte ou des images de référence, avec de solides mises en page d'affiches, des infographies denses, des fiches de personnage, du créatif produit et des workflows d'édition guidés par masque.
Aperçu des résultats

Lisibilité du texte améliorée dans les mises en page denses

Fiches de personnage multi-panneaux

Composition et typographie de niveau affiche
Ce que vous pouvez faire
Affiches et infographies riches en texte
Fiches de personnage et identités visuelles cohérentes
Photos produit e-commerce et publicités style UGC
Visuels de campagne en lot via l'API
Édition par référence, transfert de style et masques
Premières images pour workflows vidéo IA
Choisir le bon modèle d'image selon la tâche
| Critère | GPT Image 2 | Nano Banana | Seedream |
|---|---|---|---|
| Prix de départ | ~$0.048 / image | Options moins chères | Paliers par image |
| Modèle de facturation | Au token | Par image générée | Par image selon le palier |
| Qualité de sortie | Low / Medium / High x 1K / 2K / 4K | 1K / 2K / 4K selon le modèle | 1K / 1.5K / 2K |
| Entrée de référence | Jusqu'à 16 images plus masque | Dépend du modèle | Jusqu'à 10 images |
| Idéal pour | Affiches, infographies, texte dans l'image | Génération d'images haute qualité | Publicité, créatif produit, édition d'images |
Détails clés
Size et resolution fonctionnent ensemble
En mode ratio, le palier de résolution fixe le budget de pixels (1K environ 1,05 MP, 2K environ 4,19 MP, 4K exactement 8,29 MP). En mode auto ou pixels personnalisés, resolution est ignoré.
Quality signifie effort de rendu
Low, medium et high déterminent le nombre de tokens de sortie consommés. Itérez vos prompts en low, puis passez le rendu final en high.
La facturation suit l'objet usage
Les crédits sont débités selon les tokens rapportés par l'objet usage en amont : devis avant exécution, règlement sur les chiffres réels ensuite.
Principaux paramètres de requête
Les champs qui déterminent la sortie et le coût sur POST /v1/images/generations. La génération est asynchrone : interrogez le task ID renvoyé ou utilisez un callback, et sauvegardez vite les résultats, car les liens d'image restent valides 24 heures. Les schémas complets et les exemples de code se trouvent dans l'onglet API.
| Paramètre | Type | Rôle |
|---|---|---|
| model | string · requis | 'gpt-image-2' pour la route officielle facturée au token, ou 'gpt-image-2-beta' pour la route 1K à prix forfaitaire. |
| prompt | string · requis | L'instruction texte. Les tokens du prompt sont comptés comme entrée texte sur la route au token. |
| size | string · auto par défaut | 'auto', l'un des 15 ratios comme 1:1 ou 16:9, ou des pixels WxH explicites en multiples de 16. |
| resolution | string · 1K / 2K / 4K | Budget de pixels en mode ratio ; ignoré quand size est auto ou en pixels explicites. |
| quality | string · low / medium / high | Effort de rendu. Détermine la consommation de tokens de sortie sur la route au token — itérez en low, passez le rendu final en high. |
| background | string · opaque / transparent | Canal alpha de la sortie. Par défaut opaque ; transparent est en Preview et les résultats peuvent être instables. |
| n | integer · 1–10 | Images par requête sur gpt-image-2 ; le coût augmente linéairement. GPT Image 2 Beta renvoie une image par appel. |
| image_urls | array · jusqu'à 16 | Images de référence pour l'image-to-image et l'édition. Chacune ajoute des tokens d'entrée image. |
| mask_url | string · optionnel | PNG à canal alpha dont les dimensions en pixels correspondent à l'image de référence ; les zones transparentes sont régénérées. |
| callback_url | string · optionnel | Webhook HTTPS qui reçoit le résultat de la tâche, en alternative au polling. |
Limites de production à anticiper
Texte et mise en page à vérifier
Le rendu du texte s'est amélioré, mais le placement exact, la netteté et la composition structurée peuvent encore s'écarter du prompt.
Les grandes sorties sont expérimentales
Les tailles personnalisées peuvent atteindre un côté de 3840 px, mais les sorties dépassant 3 686 400 pixels au total — le nombre de pixels de 2560x1440 — sont pour l'instant expérimentales.
Le fond transparent est en Preview
background: "transparent" est disponible, mais encore en Preview — les résultats peuvent être instables.
Les requêtes complexes peuvent être plus longues
OpenAI indique que les prompts complexes peuvent nécessiter jusqu'à deux minutes de traitement.
Pourquoi utiliser GPT Image 2 via EvoLink
Estimez le coût exact avant de générer
La facturation au token est la partie de GPT Image 2 la plus difficile à budgéter : les tokens de sortie image augmentent avec la résolution et le palier de qualité, chaque image de référence ajoute des tokens d'entrée, et le prompt lui-même est comptabilisé. EvoLink en fait un chiffre annoncé avant l'envoi — le calculateur de prix et le Playground tarifent exactement la combinaison de taille, résolution, qualité et références que vous vous apprêtez à envoyer.
Cela change votre façon de tester : itérez vos prompts sur le palier low, observez l'effet de chaque modification sur l'estimation, et ne passez en high que le rendu final — au lieu de découvrir la structure des coûts sur la facture de fin de mois.
Sous le prix catalogue OpenAI, ligne par ligne
La section tarifs de cette page place le tarif EvoLink à côté du prix officiel OpenAI pour chaque type de token — sortie image, entrée image, entrée en cache et texte — et affiche l'économie actuelle ligne par ligne, avec la garantie du prix le plus bas d'EvoLink.
Comme la comparaison est calculée à partir des prix SKU en direct et non d'un argument marketing, vous pouvez la vérifier au moment d'intégrer, puis la recontrôler dès que votre volume rend l'écart significatif.
Deux routes de facturation sur une page
gpt-image-2 et gpt-image-2-beta sont servis côte à côte : la route officielle facturée au token, avec toute la surface 1K/2K/4K, paliers de qualité, masque et multi-références, et une route au forfait où chaque image 1K coûte le même prix, quelle que soit la longueur du prompt ou le nombre de références.
En pratique, les équipes placent brouillons, itération de prompts et lots 1K sur la route au forfait, au coût parfaitement prévisible, et réservent la route au token aux rendus finaux 2K/4K, aux masques et aux éditions riches en références. Basculer, c'est changer de model ID, pas migrer de fournisseur.
Une clé API pour les routes image, vidéo, audio et LLM
La même clé API qui appelle gpt-image-2 appelle aussi Seedance pour la vidéo, Nano Banana 2 et Seedream comme routes image alternatives, et le catalogue LLM — un seul solde, un seul historique de tâches, un seul chemin d'authentification.
C'est décisif pour l'image justement parce que les pipelines s'arrêtent rarement à une image fixe : générez l'image clé avec GPT Image 2, animez-la avec Seedance, et repliez-vous sur un autre modèle image quand une tâche s'y prête mieux — sans maintenir des comptes, clés et relevés de facturation séparés par fournisseur.
Un état des tâches auditable avant de payer
Chaque génération se déclare soumise, en cours, terminée ou en échec, avec le détail des erreurs dans la réponse et la console. Les tâches en échec ne sont pas comptées comme des générations facturables réussies : un lot de tâches raté ne se transforme pas discrètement en facture.
Pour les systèmes en production, c'est la différence entre « requête envoyée » et « image livrée » : interrogez la tâche, vérifiez l'état final, et rapprochez les dépenses des enregistrements par tâche dans la console quand vous devez justifier un chiffre.
Famille de modèles GPT Image

GPT Image 1.5
Route image OpenAI précédente, tailles fixes de classe 1024, facturation au token et comportement de production éprouvé.
VoirAutres modèles d'image sur EvoLink

Nano Banana 2
Modèle d'image Google pour une génération de haute qualité et des workflows créatifs flexibles.
Voir
Nano Banana Pro
Route Nano Banana premium pour une fidélité supérieure et une sortie de qualité production.
Voir
Seedream 5.0 Pro
Route image BytePlus avec paliers 1K/1.5K/2K, édition multi-référence et décomposition en calques.
Voir
Grok Imagine Image 2.0
Route image xAI où le nombre d'images d'entrée choisit le mode, avec sortie 1K/2K et jusqu'à 10 images par requête.
VoirFAQ
Quel est le lien entre GPT Image 2 et ChatGPT Images 2.0 ?
GPT Image 2 est le modèle d'image accessible par API lancé en même temps que ChatGPT Images 2.0, avec l'ID de modèle gpt-image-2. ChatGPT peut combiner la génération d'images avec du raisonnement, de la recherche web ou de l'orchestration multi-images ; le modèle API brut ne doit donc pas être considéré comme identique à chaque workflow produit de ChatGPT.
Quelle est la différence entre GPT Image 2 et GPT Image 2 Beta ?
Ce sont deux variantes de route distinctes chez EvoLink. gpt-image-2 utilise la route officielle facturée au token, avec les qualités low/medium/high, les résolutions 1K/2K/4K, des pixels WxH explicites, n jusqu'à 10 et un masque d'inpainting. gpt-image-2-beta est la route alternative à prix fixe d'EvoLink pour une sortie 1K et une image par appel ; ce n'est pas un ID de modèle officiel OpenAI.
Combien coûte GPT Image 2 ?
La facturation se fait au token. Les tokens de sortie image dominent la facture et augmentent avec les paliers de résolution et de qualité ; les tokens d'entrée image s'ajoutent par image de référence ; les tokens d'entrée texte viennent du prompt. Le Playground estime la combinaison choisie avant l'envoi. Pour un prix fixe par image, GPT Image 2 Beta facture un forfait par appel, et le calculateur de tarifs estime votre coût par image.
Comment les tarifs EvoLink de GPT Image 2 se comparent-ils à ceux d'OpenAI ?
La section tarifs compare le tarif EvoLink actuel au prix catalogue OpenAI et affiche l'économie disponible au moment où vous consultez. Utilisez le calculateur pour votre combinaison exacte de taille, de qualité et d'images de référence plutôt que de vous fier à une affirmation universelle par image.
Faut-il utiliser l'Image API ou la Responses API pour GPT Image 2 ?
Avec l'Image API, choisissez directement gpt-image-2 pour la génération ou l'édition. Avec la Responses API, choisissez un modèle principal qui prend en charge l'outil image_generation ; l'outil gère la sélection du modèle d'image pour les workflows conversationnels ou multi-étapes. EvoLink propose sa propre route unifiée pour l'accès direct au modèle.
Puis-je prévisualiser avant d'intégrer l'API ?
Oui. Utilisez le Playground pour tester la qualité, estimer les crédits et inspecter le JSON de requête avant de l'intégrer à votre produit.
Quelle est la différence entre size et resolution ?
size choisit la forme — auto, l'un des 15 ratios ou des pixels WxH explicites. resolution ne fixe le budget de pixels qu'en mode ratio, et est ignoré en auto ou en pixels explicites.
Les images de référence sont-elles facturées ?
Oui. Chaque image dans image_urls ajoute des tokens d'entrée image. Un masque est réservé comme une image d'entrée supplémentaire au moment du devis, puis régularisé sur l'usage réel en amont.
Quelles sont les limites des tailles en pixels personnalisées ?
La largeur et la hauteur doivent être des multiples de 16, le total de pixels doit être compris entre 655 360 et 8 294 400, aucun côté ne doit dépasser 3840 px, et le ratio doit rester entre 1:3 et 3:1. Les sorties dépassant 3 686 400 pixels au total — le nombre de pixels de 2560x1440 — sont pour l'instant expérimentales.
Puis-je générer plusieurs images en une requête ?
Sur gpt-image-2 oui — n accepte 1 à 10 et le coût évolue linéairement. GPT Image 2 Beta renvoie une seule image par appel.
Comment fonctionne le masque d'inpainting ?
mask_url attend un PNG avec canal alpha dont les dimensions correspondent exactement à l'image de référence. Les pixels transparents marquent la zone à régénérer, les pixels opaques sont préservés. Envoyé sans image de référence, le masque est ignoré.
Que faire si une génération échoue ?
Consultez l'état de la tâche et le détail de l'erreur dans la réponse ou la console. Une tâche en échec ne doit pas être comptée comme une génération facturable réussie.
Quelles sont les principales limites de GPT Image 2 ?
Les prompts complexes peuvent prendre jusqu'à deux minutes. Le placement du texte, la cohérence des personnages récurrents et la composition structurée précise peuvent encore demander des itérations.
Guides GPT Image 2
API Reference
Select endpoint
Authentication
All APIs require Bearer Token authentication.
Authorization:
Bearer YOUR_API_KEY/v1/images/generationsGenerate Image
Create an image generation task using text prompts. Supports text-to-image and reference-image-assisted generation.
Asynchronous processing mode, use the returned task ID to query status.
Generated image links are valid for 24 hours, please save them promptly.
Request Parameters
modelstringRequiredDefault: gpt-image-2Image generation model name.
| Value | Description |
|---|---|
| gpt-image-2 | Official GPT Image 2 — token-based billing |
gpt-image-2promptstringRequiredPrompt describing the image to be generated or how to edit the reference image.
Notes
- Max 32,000 characters (counted by Unicode code points — works for CJK and other languages)
A beautiful colorful sunset over the oceansizestringOptionalDefault: autoAspect ratio or explicit pixel dimensions (WxH).
| Value | Description |
|---|---|
| auto | Default — let the model decide |
| 1:1 / 1:2 / 2:1 / 1:3 / 3:1 / 2:3 / 3:2 / 3:4 / 4:3 / 4:5 / 5:4 / 9:16 / 16:9 / 21:9 / 9:21 | Aspect ratio — pixel size decided together with the resolution tier |
| 1024x1024 (or any WxH) | Explicit pixels — multiples of 16, pixel budget 655K~8.29M, edges ≤3840, aspect ≤3:1 |
Notes
- When size is explicit WxH pixels, the resolution parameter is ignored.
- In auto mode the model decides the final size; resolution has no effect.
- Combinations that exceed the 8.29 MP pixel budget are proportionally scaled down (e.g. 4K 1:1 → 2880×2880).
autoresolutionstringOptionalDefault: 1KResolution tier shortcut. Only effective when size is a ratio; ignored for explicit pixels and auto.
| Value | Description |
|---|---|
| 1K | Pixel budget ≈ 1024² = 1.05MP (1:1 → 1024×1024, 16:9 → 1360×768) |
| 2K | Pixel budget ≈ 2048² = 4.19MP (1:1 → 2048×2048, 16:9 → 2736×1536) |
| 4K | Pixel budget = 8.29MP / MaxPixels (1:1 → 2880×2880, 16:9 → 3840×2160 UHD) |
2KqualitystringOptionalDefault: mediumRendering quality / reasoning depth. Directly drives output token count (tile base 16/48/96 for low/medium/high).
| Value | Description |
|---|---|
| low | Tile base 16 — fastest, ~0.11× cost vs medium |
| medium | Tile base 48 — balanced (default) |
| high | Tile base 96 — highest fidelity, ~4× cost vs medium |
mediumbackgroundstringOptionalDefault: opaqueAlpha channel of the output image. Transparent is a Preview feature and results may be unstable.
| Value | Description |
|---|---|
| opaque | Flat background, no alpha channel (default) |
| transparent | Keeps an alpha channel (Preview, may be unstable) |
opaquenintegerOptionalDefault: 1Number of images to generate (1-10). Each image is billed independently; text input tokens scale linearly with n.
1image_urlsarrayOptionalReference image URL list for image-to-image and image editing features.
Notes
- 1–16 images per request
- Each image ≤ 50 MB
- Supported formats: .jpeg, .jpg, .png, .webp
- URLs must be directly accessible by the server, or URLs that trigger direct download (typically URLs ending with image extensions like .png, .jpg)
- Reference images themselves consume additional image-input tokens in edit / image-to-image mode
https://example.com/image1.pngmask_urlstringOptionalInpainting mask image URL — marks the region of the reference image to regenerate. Only valid in image edit mode (combined with image_urls); ignored in pure text-to-image.
Notes
- Only PNG with an alpha channel is accepted — transparent pixels (alpha < 255) mark areas to regenerate, opaque pixels are preserved
- Mask dimensions must EXACTLY match the reference image dimensions (width × height in pixels)
- Requires at least one image in image_urls — mask alone has no effect
- Single mask per request
https://example.com/mask.pngcallback_urlstringOptionalHTTPS callback address after task completion.
Notes
- Triggered on completion, failure, or cancellation
- Sent after billing confirmation
- HTTPS only, no internal IPs
- Max length: 2048 chars
- Timeout: 10s, Max 3 retries
https://your-domain.com/webhooks/image-task-completed