GPT Image 2 API
Testen Sie GPT Image 2, bevor Sie die API integrieren
Prüfen Sie die Ausgabequalität, schätzen Sie die Token-Kosten einer Anfrage und erzeugen Sie ein Beispielbild, bevor Sie fest integrieren.
Create image task
Fixed to gpt-image-2Text-to-image, image-to-image and mask-guided editing. Billed by the tokens the upstream usage object reports.
Upload source or reference images for image-to-image and editing. Each one adds image input tokens.
Pixel budget for the chosen ratio: 1K about 1.05 MP, 2K about 4.19 MP, 4K is 8.29 MP.
Rendering effort. It drives the output token count, so it is the single biggest cost lever.
Transparent keeps an alpha channel in the output. This is a Preview feature — results may be unstable.
Number of images per request (1-10). Cost scales linearly with the count.

Ergebnisse werden 24 Stunden gespeichert – laden Sie herunter, was Sie behalten möchten.
Kennen Sie Ihre Testkosten, bevor Sie Guthaben aufladen
Starten Sie bei den Kosten eines einzelnen Beispiels, wählen Sie ein Testbudget und rechnen Sie Ihren eigenen Fall im Rechner durch. Die reinen Token-Raten stehen unten.
First Test Cost
Text-to-Image - 1K - 1:1 - mediumOne 1K prompt-only image
About 208 tests with $10 in credits.
Iterate prompts on low quality at 1K to save tokens, then promote the final render to high. Each reference image in image_urls adds input tokens.
Testing Budget Guide
Pick an amount based on how many tests you expect.Good for a first validation.
Good for prompt iteration.
Good before production integration.
Common Cost Examples
Estimated cost for one generated 1:1 image. Final cost is settled against the token counts the upstream usage object reports.
Model Pricing
This page serves two models and they are billed differently. Each block states its own rule, so read the badge before comparing the numbers.
gpt-image-2Token-basedBilled by token, so there is no fixed per-image price. These are the raw rates; what a request actually costs depends on its size, quality, reference images and count. Use the calculator below to price your own case.
| Item | Rule | Rate | Billing |
|---|---|---|---|
| Image output tokens | The generated image itself. Token count grows with the resolution tier and the quality tier. | $0.027/1K tokens-10% 1.836 cr/1K tokens$0.030 Offizieller Preis | Output tokens |
| Image input tokens | Applied to each reference image in image_urls, and to a mask when one is sent. | $0.0072/1K tokens-10% 0.4896 cr/1K tokens$0.0080 Offizieller Preis | Input tokens |
| Image cached input tokens | Charged only when the upstream usage object reports cached image tokens. | $0.0018/1K tokens-10% 0.1224 cr/1K tokens$0.0020 Offizieller Preis | Input tokens |
| Text input tokens | Produced by the prompt itself. Typically under 1% of a request. | $0.0045/1K tokens-10% 0.306 cr/1K tokens$0.0050 Offizieller Preis | Input tokens |
| Text cached input tokens | Charged only when the upstream usage object reports cached text tokens. | $0.0012/1K tokens-10% 0.0765 cr/1K tokens$0.0013 Offizieller Preis | Input tokens |
Figures are estimates. Final charges are based on actual token usage.
gpt-image-2-betaFlat per callOne flat rate per call, whatever the aspect ratio - no token accounting and nothing to estimate. Auto or aspect-ratio sizes at the 1K tier only, one image per call. The OpenAI list price has no equivalent for this route, so no official comparison is shown.
| Item | Rule | Rate | Billing |
|---|---|---|---|
| 1K output | Any aspect ratio or auto, at the 1K tier. One image per call, regardless of prompt length or reference images. | $0.015/image 1.02 cr/image | Per call |
GPT Image 2 API im Überblick
GPT Image 2 wurde zusammen mit ChatGPT Images 2.0 veröffentlicht und ist über die API als Modell gpt-image-2 verfügbar. Nutzen Sie es für textreiche Generierung und High-Fidelity-Bearbeitung; ChatGPT kann Orchestrierung und Tools ergänzen, die vom reinen Bildmodell getrennt sind.
Was GPT Image 2 erzeugen kann
Erzeugen Sie hochwertige Bilder aus Text-Prompts oder Referenzbildern — mit starken Posterlayouts, informationsdichten Infografiken, Charakter-Sheets, Produktkreation und maskengeführten Bearbeitungs-Workflows.
Ergebnisvorschau

Bessere Textlesbarkeit in informationsdichten Layouts

Mehrteilige Charakter-Sheets

Postertaugliche Komposition und Typografie
Was Sie damit tun können
Textlastige Poster & Infografiken
Charakter-Sheets & konsistente IP-Art
E-Commerce-Produktfotos & Ads im UGC-Stil
Kampagnen-Visuals im Batch per API
Referenz-Editing, Style-Transfer & Masken
Erste Frames für KI-Video-Workflows
Das passende Bildmodell für die Aufgabe wählen
| Merkmal | GPT Image 2 | Nano Banana | Seedream |
|---|---|---|---|
| Einstiegspreis | ~$0.048 / Bild | Günstigere Optionen | Stufen pro Bild |
| Abrechnungsmodell | Tokenbasiert | Pro generiertem Bild | Pro Bild nach Ausgabestufe |
| Ausgabequalität | Low / Medium / High x 1K / 2K / 4K | 1K / 2K / 4K je nach Modell | 1K / 1.5K / 2K |
| Referenzeingabe | Bis zu 16 Bilder plus Maske | Modellabhängig | Bis zu 10 Bilder |
| Am besten für | Poster, Infografiken, Text im Bild | Hochwertige Bildgenerierung | Ads, Produktkreation, Bildbearbeitung |
Wichtige Details
Size und Resolution greifen ineinander
Im Ratio-Modus legt die Auflösungsstufe das Pixelbudget fest (1K rund 1,05 MP, 2K rund 4,19 MP, 4K genau 8,29 MP). Im Auto- oder Pixelmodus wird Resolution ignoriert.
Quality bedeutet Rendering-Aufwand
Low, Medium und High bestimmen, wie viele Ausgabe-Tokens das Modell verbraucht. Prompts auf Low iterieren, den finalen Render auf High hochziehen.
Abrechnung folgt dem Usage-Objekt
Abgerechnet wird nach den Token-Zahlen, die das Upstream-Usage-Objekt meldet: vorab geschätzt, danach mit den echten Werten abgerechnet.
Wichtigste Request-Parameter
Die Felder, die Ausgabe und Kosten bei POST /v1/images/generations bestimmen. Die Generierung läuft asynchron — die zurückgegebene task ID pollen oder einen Callback nutzen und Ergebnisse zeitnah speichern, da Bildlinks 24 Stunden gültig bleiben. Vollständige Schemas und Codebeispiele stehen im API-Tab.
| Parameter | Typ | Funktion |
|---|---|---|
| model | string · erforderlich | 'gpt-image-2' für die tokenbasiert abgerechnete offizielle Route, 'gpt-image-2-beta' für die 1K-Route zum Pauschalpreis. |
| prompt | string · erforderlich | Die Textanweisung. Prompt-Tokens werden auf der Token-Route als Texteingabe gezählt. |
| size | string · Standard auto | 'auto', eines von 15 Seitenverhältnissen wie 1:1 oder 16:9, oder explizite WxH-Pixel in Vielfachen von 16. |
| resolution | string · 1K / 2K / 4K | Pixelbudget im Ratio-Modus; wird ignoriert, wenn size auto oder explizite Pixel sind. |
| quality | string · low / medium / high | Rendering-Aufwand. Bestimmt auf der Token-Route den Ausgabe-Token-Verbrauch — auf low iterieren, den finalen Render auf high hochziehen. |
| background | string · opaque / transparent | Alphakanal der Ausgabe. Standard opaque; transparent ist Preview, die Ergebnisse können instabil sein. |
| n | integer · 1–10 | Bilder pro Anfrage bei gpt-image-2; die Kosten skalieren linear. GPT Image 2 Beta liefert ein Bild pro Aufruf. |
| image_urls | array · bis zu 16 | Referenzbilder für Image-to-Image und Editing. Jedes Bild fügt Bild-Eingabe-Tokens hinzu. |
| mask_url | string · optional | Alpha-PNG, dessen Pixelmaße dem Referenzbild entsprechen; transparente Bereiche werden neu generiert. |
| callback_url | string · optional | HTTPS-Webhook, der das Task-Ergebnis erhält — als Alternative zum Polling. |
Produktionsgrenzen, die Sie einplanen sollten
Text und Layout brauchen weiterhin Kontrolle
Das Text-Rendering ist verbessert, doch exakte Platzierung, Klarheit und strukturierte Komposition können den Prompt weiterhin verfehlen.
Große Ausgaben sind experimentell
Eigene Größen können eine Kante von 3840 px erreichen, doch Ausgaben mit mehr als 3.686.400 Gesamtpixeln — der Pixelzahl von 2560x1440 — sind derzeit experimentell.
Transparenter Hintergrund ist Preview
background: "transparent" ist verfügbar, befindet sich aber noch in Preview — die Ergebnisse können instabil sein.
Komplexe Anfragen können länger dauern
OpenAI weist darauf hin, dass komplexe Prompts bis zu zwei Minuten Verarbeitung benötigen können.
Warum GPT Image 2 über EvoLink nutzen
Die exakten Kosten vor der Generierung schätzen
Die tokenbasierte Abrechnung ist der Teil von GPT Image 2, der sich am schwersten budgetieren lässt: Bild-Output-Tokens wachsen mit Auflösung und Qualitätsstufe, jedes Referenzbild fügt Input-Tokens hinzu, und auch der Prompt selbst wird gezählt. EvoLink macht daraus eine bezifferte Zahl vor dem Absenden — Preisrechner und Playground kalkulieren genau die Kombination aus Größe, Auflösung, Qualität und Referenzbildern, die Sie gleich senden.
Das verändert Ihre Testroutine: Iterieren Sie Prompts auf der Low-Stufe, beobachten Sie, was jede Änderung mit der Schätzung macht, und heben Sie nur das finale Rendering auf High — statt das Kostenmuster erst auf der Monatsrechnung zu entdecken.
Unter dem OpenAI-Listenpreis, Zeile für Zeile
Der Preisbereich dieser Seite stellt für jeden Token-Typ — Bild-Output, Bild-Input, gecachten Input und Text — den EvoLink-Tarif neben den offiziellen OpenAI-Preis und zeigt die aktuelle Ersparnis Zeile für Zeile, gestützt auf die EvoLink-Bestpreis-Garantie.
Weil der Vergleich aus den aktuellen SKU-Preisen berechnet wird und keine Marketing-Behauptung ist, können Sie ihn im Moment der Integration verifizieren — und erneut prüfen, sobald Ihr Volumen groß genug ist, dass der Unterschied ins Gewicht fällt.
Zwei Abrechnungsrouten auf einer Seite
gpt-image-2 und gpt-image-2-beta stehen nebeneinander bereit: die offizielle tokenbasierte Route mit dem vollen Umfang aus 1K/2K/4K, Qualitätsstufen, Maske und Mehrfach-Referenzen — und eine Pauschalroute, bei der jedes 1K-Bild gleich viel kostet, unabhängig von Prompt-Länge oder Referenzen.
In der Praxis legen Teams Entwürfe, Prompt-Iteration und 1K-Massenjobs auf die Pauschalroute mit perfekt vorhersehbaren Kosten und reservieren die Token-Route für 2K/4K-Finals, Masken und referenzlastige Bearbeitungen. Der Wechsel ist eine Änderung der Model-ID, keine Anbieter-Migration.
Ein API-Key für Bild-, Video-, Audio- und LLM-Routen
Derselbe API-Key, der gpt-image-2 aufruft, ruft auch Seedance für Video, Nano Banana 2 und Seedream als alternative Bildrouten sowie den LLM-Katalog auf — ein Guthaben, eine Task-Historie, ein Authentifizierungspfad.
Gerade für Bildarbeit zählt das, weil Pipelines selten beim Standbild enden: das Keyframe mit GPT Image 2 generieren, es mit Seedance animieren und auf ein anderes Bildmodell ausweichen, wenn ein Job dort besser passt — ohne separate Anbieterkonten, Keys und Abrechnungsunterlagen zu pflegen.
Aufgabenstatus, den Sie vor dem Bezahlen prüfen können
Jede Generierung meldet eingereicht, in Bearbeitung, abgeschlossen oder fehlgeschlagen — samt Fehlerdetails in der Antwort und in der Konsole. Fehlgeschlagene Aufgaben gelten nicht als erfolgreiche abrechenbare Generierungen, sodass eine missratene Job-Charge nicht stillschweigend zur Rechnung wird.
Für Produktionssysteme ist das der Unterschied zwischen "Request gesendet" und "Bild geliefert": den Task pollen, den Endzustand verifizieren und die Ausgaben anhand der Task-Einträge in der Konsole abgleichen, wenn Sie eine Zahl erklären müssen.
GPT Image Modellfamilie

GPT Image 1.5
Vorherige OpenAI-Bildroute mit festen 1024er-Größen, Token-Abrechnung und eingespieltem Produktionsverhalten.
AnsehenWeitere Bildmodelle auf EvoLink


Nano Banana Pro
Premium-Nano-Banana-Route für höhere Detailtreue und produktionsreife Ausgabe.
Ansehen
Seedream 5.0 Pro
BytePlus-Bildroute mit 1K/1.5K/2K-Stufen, Multi-Referenz-Bearbeitung und Ebenenzerlegung.
Ansehen
Grok Imagine Image 2.0
xAI-Bildroute, bei der die Anzahl der Eingabebilder den Modus bestimmt — mit 1K/2K-Ausgabe und bis zu 10 Bildern pro Anfrage.
AnsehenFAQ
In welchem Verhältnis steht GPT Image 2 zu ChatGPT Images 2.0?
GPT Image 2 ist das per API zugängliche Bildmodell, das zusammen mit ChatGPT Images 2.0 veröffentlicht wurde, mit der Modell-ID gpt-image-2. ChatGPT kann Bildgenerierung mit Reasoning, Websuche oder Multi-Bild-Orchestrierung kombinieren — das rohe API-Modell sollte daher nicht mit jedem ChatGPT-Produkt-Workflow gleichgesetzt werden.
Was ist der Unterschied zwischen GPT Image 2 und GPT Image 2 Beta?
Das sind zwei getrennte EvoLink-Routenvarianten. gpt-image-2 nutzt die tokenbasiert abgerechnete offizielle Route mit low/medium/high-Qualität, 1K/2K/4K-Auflösung, expliziten WxH-Pixeln, n bis 10 und einer Inpainting-Maske. gpt-image-2-beta ist die alternative Festpreis-Route von EvoLink für 1K-Ausgabe und ein Bild pro Aufruf; es ist keine offizielle OpenAI-Modell-ID.
Was kostet GPT Image 2?
Die Abrechnung erfolgt nach Tokens. Bildausgabe-Tokens dominieren die Rechnung und skalieren mit Auflösungs- und Qualitätsstufe; Bildeingabe-Tokens kommen je Referenzbild hinzu; Texteingabe-Tokens stammen aus dem Prompt. Der Playground schätzt die gewählte Kombination vor dem Absenden. Wenn Sie stattdessen einen festen Preis pro Bild möchten: GPT Image 2 Beta rechnet pauschal pro Aufruf ab, und der Preisrechner schätzt Ihre Kosten pro Bild.
Wie schneiden die EvoLink-Preise für GPT Image 2 im Vergleich zu OpenAI ab?
Der Preisbereich vergleicht den aktuellen EvoLink-Tarif mit dem OpenAI-Listenpreis und zeigt die Ersparnis, die zum Zeitpunkt Ihrer Prüfung verfügbar ist. Nutzen Sie den Rechner für Ihre exakte Kombination aus Größe, Qualität und Referenzbildern, statt sich auf eine pauschale Aussage pro Bild zu verlassen.
Sollte ich für GPT Image 2 die Image API oder die Responses API verwenden?
Mit der Image API wählen Sie gpt-image-2 direkt für Generierung oder Bearbeitung. Mit der Responses API wählen Sie ein Hauptmodell, das das image_generation-Tool unterstützt; das Tool übernimmt die Auswahl des Bildmodells für konversationelle oder mehrstufige Workflows. EvoLink stellt eine eigene einheitliche Route für den direkten Modellzugriff bereit.
Kann ich vor der API-Integration eine Vorschau erzeugen?
Ja. Nutzen Sie den Playground, um Ausgabequalität zu testen, Credits zu schätzen und das Request-JSON zu prüfen, bevor Sie es in Ihr Produkt einbauen.
Was ist der Unterschied zwischen Size und Resolution?
Size bestimmt die Form — auto, eines von 15 Seitenverhältnissen oder explizite WxH-Pixel. Resolution bestimmt nur im Ratio-Modus das Pixelbudget und wird bei Auto oder expliziten Pixeln ignoriert.
Werden Referenzbilder abgerechnet?
Ja. Jedes Bild in image_urls erzeugt zusätzliche Bildeingabe-Tokens. Eine Maske wird bei der Schätzung als ein weiteres Eingabebild reserviert und später gegen die echte Upstream-Nutzung abgerechnet.
Welche Grenzen gelten für eigene Pixelgrößen?
Breite und Höhe müssen Vielfache von 16 sein, die Gesamtpixel müssen zwischen 655.360 und 8.294.400 liegen, keine Kante darf 3840 px überschreiten, und das Seitenverhältnis muss zwischen 1:3 und 3:1 bleiben. Ausgaben mit mehr als 3.686.400 Gesamtpixeln — der Pixelzahl von 2560x1440 — sind derzeit experimentell.
Kann ich mehrere Bilder pro Anfrage erzeugen?
Bei gpt-image-2 ja — n akzeptiert 1 bis 10 und die Kosten skalieren linear. GPT Image 2 Beta liefert ein Bild pro Aufruf.
Wie funktioniert die Inpainting-Maske?
mask_url erwartet ein PNG mit Alphakanal, dessen Pixelmaße exakt zum Referenzbild passen. Transparente Pixel markieren den neu zu generierenden Bereich, deckende Pixel bleiben erhalten. Ohne Referenzbild wird die Maske verworfen.
Was passiert, wenn eine Generierung fehlschlägt?
Prüfen Sie Aufgabenstatus und Fehlerdetails in der Antwort oder Konsole. Fehlgeschlagene Aufgaben gelten nicht als erfolgreiche abrechenbare Generierungen.
Was sind die wichtigsten Einschränkungen von GPT Image 2?
Komplexe Prompts können bis zu zwei Minuten dauern. Textplatzierung, Konsistenz wiederkehrender Charaktere und präzise strukturierte Komposition können weiterhin Iteration erfordern.
GPT Image 2 Guides
API Reference
Select endpoint
Authentication
All APIs require Bearer Token authentication.
Authorization:
Bearer YOUR_API_KEY/v1/images/generationsGenerate Image
Create an image generation task using text prompts. Supports text-to-image and reference-image-assisted generation.
Asynchronous processing mode, use the returned task ID to query status.
Generated image links are valid for 24 hours, please save them promptly.
Request Parameters
modelstringRequiredDefault: gpt-image-2Image generation model name.
| Value | Description |
|---|---|
| gpt-image-2 | Official GPT Image 2 — token-based billing |
gpt-image-2promptstringRequiredPrompt describing the image to be generated or how to edit the reference image.
Notes
- Max 32,000 characters (counted by Unicode code points — works for CJK and other languages)
A beautiful colorful sunset over the oceansizestringOptionalDefault: autoAspect ratio or explicit pixel dimensions (WxH).
| Value | Description |
|---|---|
| auto | Default — let the model decide |
| 1:1 / 1:2 / 2:1 / 1:3 / 3:1 / 2:3 / 3:2 / 3:4 / 4:3 / 4:5 / 5:4 / 9:16 / 16:9 / 21:9 / 9:21 | Aspect ratio — pixel size decided together with the resolution tier |
| 1024x1024 (or any WxH) | Explicit pixels — multiples of 16, pixel budget 655K~8.29M, edges ≤3840, aspect ≤3:1 |
Notes
- When size is explicit WxH pixels, the resolution parameter is ignored.
- In auto mode the model decides the final size; resolution has no effect.
- Combinations that exceed the 8.29 MP pixel budget are proportionally scaled down (e.g. 4K 1:1 → 2880×2880).
autoresolutionstringOptionalDefault: 1KResolution tier shortcut. Only effective when size is a ratio; ignored for explicit pixels and auto.
| Value | Description |
|---|---|
| 1K | Pixel budget ≈ 1024² = 1.05MP (1:1 → 1024×1024, 16:9 → 1360×768) |
| 2K | Pixel budget ≈ 2048² = 4.19MP (1:1 → 2048×2048, 16:9 → 2736×1536) |
| 4K | Pixel budget = 8.29MP / MaxPixels (1:1 → 2880×2880, 16:9 → 3840×2160 UHD) |
2KqualitystringOptionalDefault: mediumRendering quality / reasoning depth. Directly drives output token count (tile base 16/48/96 for low/medium/high).
| Value | Description |
|---|---|
| low | Tile base 16 — fastest, ~0.11× cost vs medium |
| medium | Tile base 48 — balanced (default) |
| high | Tile base 96 — highest fidelity, ~4× cost vs medium |
mediumbackgroundstringOptionalDefault: opaqueAlpha channel of the output image. Transparent is a Preview feature and results may be unstable.
| Value | Description |
|---|---|
| opaque | Flat background, no alpha channel (default) |
| transparent | Keeps an alpha channel (Preview, may be unstable) |
opaquenintegerOptionalDefault: 1Number of images to generate (1-10). Each image is billed independently; text input tokens scale linearly with n.
1image_urlsarrayOptionalReference image URL list for image-to-image and image editing features.
Notes
- 1–16 images per request
- Each image ≤ 50 MB
- Supported formats: .jpeg, .jpg, .png, .webp
- URLs must be directly accessible by the server, or URLs that trigger direct download (typically URLs ending with image extensions like .png, .jpg)
- Reference images themselves consume additional image-input tokens in edit / image-to-image mode
https://example.com/image1.pngmask_urlstringOptionalInpainting mask image URL — marks the region of the reference image to regenerate. Only valid in image edit mode (combined with image_urls); ignored in pure text-to-image.
Notes
- Only PNG with an alpha channel is accepted — transparent pixels (alpha < 255) mark areas to regenerate, opaque pixels are preserved
- Mask dimensions must EXACTLY match the reference image dimensions (width × height in pixels)
- Requires at least one image in image_urls — mask alone has no effect
- Single mask per request
https://example.com/mask.pngcallback_urlstringOptionalHTTPS callback address after task completion.
Notes
- Triggered on completion, failure, or cancellation
- Sent after billing confirmation
- HTTPS only, no internal IPs
- Max length: 2048 chars
- Timeout: 10s, Max 3 retries
https://your-domain.com/webhooks/image-task-completed