GPT Image 2 API
API를 붙이기 전에 GPT Image 2를 먼저 써보세요
정식 연동 전에 출력 품질을 확인하고, 요청 한 건의 토큰 비용을 추정하고, 샘플을 한 장 생성해 볼 수 있습니다.
Create image task
Fixed to gpt-image-2Text-to-image, image-to-image and mask-guided editing. Billed by the tokens the upstream usage object reports.
Upload source or reference images for image-to-image and editing. Each one adds image input tokens.
Pixel budget for the chosen ratio: 1K about 1.05 MP, 2K about 4.19 MP, 4K is 8.29 MP.
Rendering effort. It drives the output token count, so it is the single biggest cost lever.
Transparent keeps an alpha channel in the output. This is a Preview feature — results may be unstable.
Number of images per request (1-10). Cost scales linearly with the count.

생성 결과는 24시간 동안 보관됩니다. 필요한 파일은 미리 다운로드하세요.
충전하기 전에 테스트 비용을 확인하세요
샘플 한 장의 비용에서 시작해 테스트 예산을 정하고, 계산기로 직접 자신의 사례를 계산해 보세요. 토큰 요금표는 맨 아래에 있습니다.
First Test Cost
Text-to-Image - 1K - 1:1 - mediumOne 1K prompt-only image
About 208 tests with $10 in credits.
Iterate prompts on low quality at 1K to save tokens, then promote the final render to high. Each reference image in image_urls adds input tokens.
Testing Budget Guide
Pick an amount based on how many tests you expect.Good for a first validation.
Good for prompt iteration.
Good before production integration.
Common Cost Examples
Estimated cost for one generated 1:1 image. Final cost is settled against the token counts the upstream usage object reports.
Model Pricing
This page serves two models and they are billed differently. Each block states its own rule, so read the badge before comparing the numbers.
gpt-image-2Token-basedBilled by token, so there is no fixed per-image price. These are the raw rates; what a request actually costs depends on its size, quality, reference images and count. Use the calculator below to price your own case.
| Item | Rule | Rate | Billing |
|---|---|---|---|
| Image output tokens | The generated image itself. Token count grows with the resolution tier and the quality tier. | $0.027/1K tokens-10% 1.836 cr/1K tokens$0.030 공식 가격 | Output tokens |
| Image input tokens | Applied to each reference image in image_urls, and to a mask when one is sent. | $0.0072/1K tokens-10% 0.4896 cr/1K tokens$0.0080 공식 가격 | Input tokens |
| Image cached input tokens | Charged only when the upstream usage object reports cached image tokens. | $0.0018/1K tokens-10% 0.1224 cr/1K tokens$0.0020 공식 가격 | Input tokens |
| Text input tokens | Produced by the prompt itself. Typically under 1% of a request. | $0.0045/1K tokens-10% 0.306 cr/1K tokens$0.0050 공식 가격 | Input tokens |
| Text cached input tokens | Charged only when the upstream usage object reports cached text tokens. | $0.0012/1K tokens-10% 0.0765 cr/1K tokens$0.0013 공식 가격 | Input tokens |
Figures are estimates. Final charges are based on actual token usage.
gpt-image-2-betaFlat per callOne flat rate per call, whatever the aspect ratio - no token accounting and nothing to estimate. Auto or aspect-ratio sizes at the 1K tier only, one image per call. The OpenAI list price has no equivalent for this route, so no official comparison is shown.
| Item | Rule | Rate | Billing |
|---|---|---|---|
| 1K output | Any aspect ratio or auto, at the 1K tier. One image per call, regardless of prompt length or reference images. | $0.015/image 1.02 cr/image | Per call |
GPT Image 2 API 한눈에 보기
GPT Image 2는 ChatGPT Images 2.0과 함께 출시되었으며 모델 ID gpt-image-2로 API에서 사용할 수 있습니다. 텍스트 비중이 큰 이미지 생성과 고충실도 편집에 적합하며, ChatGPT 쪽에는 오케스트레이션과 도구가 추가될 수 있지만 이는 원본 이미지 모델과는 별개입니다.
GPT Image 2로 만들 수 있는 것
텍스트 프롬프트나 참조 이미지로 고품질 이미지를 생성합니다. 포스터 레이아웃, 정보 밀도가 높은 인포그래픽, 캐릭터 시트, 제품 크리에이티브, 마스크 기반 편집 워크플로에 강합니다.
결과 미리보기

정보 밀도가 높은 레이아웃에서 향상된 텍스트 가독성

멀티 패널 캐릭터 시트

포스터급 구성과 타이포그래피
할 수 있는 일
텍스트 비중이 큰 포스터 & 인포그래픽
캐릭터 시트 & 일관된 IP 아트
이커머스 제품 컷 & UGC 스타일 광고
API로 캠페인 비주얼 일괄 생성
참조 이미지 편집·스타일 트랜스퍼·마스크
AI 영상 워크플로용 첫 프레임
작업에 맞는 이미지 모델 선택
| 항목 | GPT Image 2 | Nano Banana | Seedream |
|---|---|---|---|
| 시작 가격 | 약 $0.048/장 | 더 저렴한 선택지 있음 | 장당 등급제 |
| 과금 방식 | 토큰 기반 | 생성 장수 기준 | 출력 등급별 장수 기준 |
| 출력 품질 | Low / Medium / High × 1K / 2K / 4K | 모델에 따라 1K / 2K / 4K | 1K / 1.5K / 2K |
| 참조 입력 | 최대 16장 + 마스크 | 모델에 따라 다름 | 최대 10장 |
| 적합한 용도 | 포스터, 인포그래픽, 이미지 내 텍스트 | 고품질 이미지 생성 | 광고, 제품 크리에이티브, 이미지 편집 |
핵심 사항
size와 resolution은 함께 작동
비율 모드에서는 해상도 등급이 픽셀 예산을 정합니다(1K 약 1.05 MP, 2K 약 4.19 MP, 4K 8.29 MP). auto나 사용자 지정 픽셀 모드에서는 resolution이 무시됩니다.
quality는 렌더링 강도
low, medium, high는 모델이 쓰는 출력 토큰 수를 결정합니다. 프롬프트는 low로 다듬고 최종 결과만 high로 올리세요.
과금은 usage를 따름
업스트림 usage가 보고한 토큰 수로 크레딧이 차감됩니다. 실행 전에 견적을 내고, 실행 후 실제 수치로 정산합니다.
주요 요청 파라미터
POST /v1/images/generations에서 출력과 비용을 좌우하는 필드입니다. 생성은 비동기로 진행되므로 반환된 task ID를 폴링하거나 콜백을 사용하세요. 이미지 링크는 24시간 동안만 유효하니 결과를 바로 저장해 두세요. 전체 스키마와 코드 예시는 API 탭에 있습니다.
| 파라미터 | 타입 | 역할 |
|---|---|---|
| model | string · 필수 | 'gpt-image-2'는 토큰 과금 공식 라우트, 'gpt-image-2-beta'는 1K 고정 단가 라우트입니다. |
| prompt | string · 필수 | 텍스트 지시문. 토큰 라우트에서는 프롬프트 토큰이 텍스트 입력으로 계산됩니다. |
| size | string · 기본 auto | 'auto', 1:1이나 16:9 같은 15가지 비율 중 하나, 또는 16의 배수로 직접 지정한 WxH 픽셀. |
| resolution | string · 1K / 2K / 4K | 비율 모드의 픽셀 예산. size가 auto이거나 픽셀을 직접 지정하면 무시됩니다. |
| quality | string · low / medium / high | 렌더링 강도. 토큰 라우트에서 출력 토큰 소비를 결정합니다 — low로 다듬고 최종 결과만 high로 올리세요. |
| background | string · opaque / transparent | 출력의 알파 채널. 기본값은 opaque이며, transparent 는 Preview 기능으로 결과가 불안정할 수 있습니다. |
| n | integer · 1–10 | gpt-image-2에서 요청당 생성 장수로, 비용은 선형으로 늘어납니다. GPT Image 2 Beta는 호출당 1장을 반환합니다. |
| image_urls | array · 최대 16장 | image-to-image와 편집용 참조 이미지. 한 장마다 이미지 입력 토큰이 추가됩니다. |
| mask_url | string · 선택 | 알파 채널 PNG로, 픽셀 크기는 참조 이미지와 일치해야 하며 투명 영역이 다시 생성됩니다. |
| callback_url | string · 선택 | 작업 결과를 받는 HTTPS webhook. 폴링 대신 사용할 수 있습니다. |
프로덕션 도입 전에 고려할 제한 사항
텍스트와 레이아웃은 여전히 검토 필요
텍스트 렌더링은 개선되었지만, 정확한 배치와 선명도, 구조적 구도는 여전히 프롬프트와 어긋날 수 있습니다.
대형 출력은 실험적 기능
사용자 지정 크기는 한 변이 3840 px까지 가능하지만, 총 픽셀이 3,686,400(2560x1440의 픽셀 수)을 넘는 출력은 현재 실험적 기능입니다.
투명 배경은 Preview
background: "transparent" 를 사용할 수 있지만 아직 Preview 단계로, 결과가 불안정할 수 있습니다.
복잡한 요청은 더 오래 걸릴 수 있음
OpenAI는 복잡한 프롬프트의 처리에 최대 2분이 걸릴 수 있다고 안내합니다.
EvoLink로 GPT Image 2를 쓰는 이유
생성 전에 정확한 비용을 예상
토큰 과금은 GPT Image 2에서 예산을 잡기 가장 어려운 부분입니다. 이미지 출력 토큰은 해상도와 품질 티어에 따라 늘고, 참조 이미지 한 장마다 입력 토큰이 더해지며, 프롬프트 자체도 계량됩니다. EvoLink는 이를 제출 전에 제시되는 견적으로 바꿉니다 — 가격 계산기와 Playground 모두 지금 보내려는 크기·해상도·품질·참조 이미지 조합 그대로 가격을 매깁니다.
테스트 방식이 달라집니다. low 티어에서 프롬프트를 반복하며 변경마다 예상치가 어떻게 움직이는지 확인하고, 최종 렌더링만 high로 올리면 됩니다 — 월말 청구서에서야 비용 패턴을 발견할 필요가 없습니다.
OpenAI 정가보다 항목별로 저렴
이 페이지의 가격 섹션은 이미지 출력·이미지 입력·캐시된 입력·텍스트 등 토큰 유형별로 EvoLink 요금을 OpenAI 공식 가격 옆에 나란히 표시하고, 항목마다 현재 절감률을 보여줍니다. EvoLink 최저가 보장이 이를 뒷받침합니다.
이 비교는 마케팅 문구가 아니라 실시간 SKU 가격으로 계산되므로, 연동하는 시점에 바로 검증할 수 있고, 물량이 늘어 차이가 의미 있어질 때마다 다시 확인할 수 있습니다.
한 페이지에 두 가지 과금 경로
gpt-image-2와 gpt-image-2-beta를 나란히 제공합니다. 전자는 1K/2K/4K, 품질 티어, 마스크, 다중 참조 이미지를 모두 갖춘 공식 토큰 과금 경로이고, 후자는 프롬프트 길이나 참조 이미지 수와 무관하게 1K 이미지 한 장 가격이 항상 같은 정액 경로입니다.
실무에서는 초안·프롬프트 반복·1K 대량 작업을 비용이 완전히 예측되는 정액 경로에 올리고, 2K/4K 최종본·마스크·참조 이미지가 많은 편집은 토큰 경로에 남겨 둡니다. 전환은 model ID 하나 바꾸는 일이지, 공급업체 이전이 아닙니다.
API 키 하나로 이미지·영상·음성·LLM 경로까지
gpt-image-2를 호출하는 바로 그 API 키로 영상용 Seedance, 대체 이미지 경로인 Nano Banana 2와 Seedream, 그리고 LLM 카탈로그까지 호출할 수 있습니다 — 잔액 하나, 작업 이력 하나, 인증 경로 하나입니다.
이미지 작업에서 이것이 특히 중요한 이유는 파이프라인이 정지 이미지에서 끝나는 일이 드물기 때문입니다. 키 프레임을 GPT Image 2로 생성하고 Seedance로 움직이게 하고, 작업에 더 맞으면 다른 이미지 모델로 대체하세요 — 공급업체별 계정·키·과금 기록을 따로 관리할 필요가 없습니다.
결제 전에 확인할 수 있는 작업 상태
모든 생성은 제출·처리 중·완료·실패 상태를 응답과 콘솔의 오류 상세와 함께 보고합니다. 실패한 작업은 과금 대상 성공 생성으로 처리되지 않으므로, 잘못된 작업 묶음이 조용히 청구서가 되는 일은 없습니다.
프로덕션 시스템에는 이것이 "요청을 보냈다"와 "이미지가 도착했다"의 차이입니다. 작업을 폴링해 최종 상태를 확인하고, 숫자를 설명해야 할 때 콘솔의 작업별 기록과 지출을 대조할 수 있습니다.
GPT Image 모델 패밀리

EvoLink의 다른 이미지 모델




자주 묻는 질문
GPT Image 2와 ChatGPT Images 2.0은 어떤 관계인가요?
GPT Image 2는 ChatGPT Images 2.0과 함께 공개된, API로 사용할 수 있는 이미지 모델이며 모델 ID는 gpt-image-2입니다. ChatGPT는 이미지 생성에 추론, 웹 검색, 다중 이미지 오케스트레이션을 결합할 수 있으므로, 원시 API 모델을 모든 ChatGPT 제품 워크플로와 동일하다고 보아서는 안 됩니다.
GPT Image 2와 GPT Image 2 Beta의 차이는 무엇인가요?
EvoLink의 서로 다른 두 경로 변형입니다. gpt-image-2는 토큰 과금 공식 경로로 low/medium/high 품질, 1K/2K/4K 해상도, 명시적 WxH 픽셀, 최대 10장의 n, 인페인팅 마스크를 지원합니다. gpt-image-2-beta는 1K 출력과 호출당 한 장을 위한 EvoLink의 대안 고정가 경로이며, OpenAI 공식 모델 ID가 아닙니다.
GPT Image 2 가격은 어떻게 되나요?
토큰 기반 과금입니다. 이미지 출력 토큰이 비용의 대부분을 차지하며 해상도와 품질 등급에 따라 증가합니다. 참조 이미지마다 이미지 입력 토큰이 추가되고, 프롬프트에서 텍스트 입력 토큰이 발생합니다. Playground가 제출 전에 선택한 조합으로 견적을 냅니다. 고정된 이미지당 가격이 필요하다면 GPT Image 2 Beta가 호출당 정액 과금이며, 가격 계산기로 이미지당 비용을 예상할 수 있습니다.
EvoLink의 GPT Image 2 가격은 OpenAI와 비교해 어떤가요?
가격 섹션에서 현재 EvoLink 요금과 OpenAI 공식 정가를 비교하고 확인 시점에 적용되는 절감액을 표시합니다. 일률적인 이미지당 가격 주장에 의존하기보다, 계산기로 크기·품질·참조 이미지 조합별 비용을 확인하세요.
GPT Image 2에는 Image API와 Responses API 중 무엇을 써야 하나요?
Image API에서는 생성이나 편집에 gpt-image-2를 직접 선택하면 됩니다. Responses API에서는 image_generation 도구를 지원하는 메인 모델을 선택하며, 대화형이나 다단계 워크플로에서는 이 도구가 이미지 모델 선택을 처리합니다. EvoLink는 모델에 직접 접근할 수 있는 자체 통합 경로를 제공합니다.
API 연동 전에 미리 볼 수 있나요?
가능합니다. Playground에서 출력 품질을 테스트하고 크레딧을 추정하며 요청 JSON을 확인한 뒤 제품에 연결하세요.
size와 resolution의 차이는 무엇인가요?
size는 형태를 정합니다 — auto, 15가지 비율 중 하나, 또는 명시적 WxH 픽셀. resolution은 비율 모드에서만 픽셀 예산을 정하며 auto나 명시 픽셀에서는 무시됩니다.
참조 이미지도 과금되나요?
네. image_urls의 모든 이미지가 이미지 입력 토큰을 추가합니다. 마스크는 견적 시 입력 이미지 한 장으로 예약되고 이후 실제 업스트림 usage로 정산됩니다.
사용자 지정 픽셀 크기의 제한은 무엇인가요?
가로와 세로는 16의 배수여야 하고, 총 픽셀은 655,360에서 8,294,400 사이여야 하며, 어느 변도 3840 px을 넘을 수 없고, 비율은 1:3에서 3:1 사이여야 합니다. 총 픽셀이 3,686,400(2560x1440의 픽셀 수)을 넘는 출력은 현재 실험적 기능입니다.
한 요청으로 여러 장을 생성할 수 있나요?
gpt-image-2에서는 가능합니다. n은 1에서 10까지이며 비용은 선형으로 늘어납니다. GPT Image 2 Beta는 호출당 한 장을 반환합니다.
인페인팅 마스크는 어떻게 동작하나요?
mask_url에는 알파 채널이 있는 PNG를 넣고 픽셀 크기가 참조 이미지와 정확히 같아야 합니다. 투명 픽셀이 재생성 영역이고 불투명 픽셀은 보존됩니다. 참조 이미지 없이 보내면 마스크는 버려집니다.
생성이 실패하면 어떻게 하나요?
응답이나 콘솔에서 작업 상태와 오류 상세를 확인하세요. 실패한 작업은 과금 대상 성공 생성으로 간주되지 않습니다.
GPT Image 2의 주요 제한 사항은 무엇인가요?
복잡한 프롬프트는 처리에 최대 2분이 걸릴 수 있습니다. 텍스트 배치, 반복 등장 캐릭터의 일관성, 정밀한 구조적 구도는 여전히 반복 작업이 필요할 수 있습니다.
GPT Image 2 가이드
API Reference
Select endpoint
Authentication
All APIs require Bearer Token authentication.
Authorization:
Bearer YOUR_API_KEY/v1/images/generationsGenerate Image
Create an image generation task using text prompts. Supports text-to-image and reference-image-assisted generation.
Asynchronous processing mode, use the returned task ID to query status.
Generated image links are valid for 24 hours, please save them promptly.
Request Parameters
modelstringRequiredDefault: gpt-image-2Image generation model name.
| Value | Description |
|---|---|
| gpt-image-2 | Official GPT Image 2 — token-based billing |
gpt-image-2promptstringRequiredPrompt describing the image to be generated or how to edit the reference image.
Notes
- Max 32,000 characters (counted by Unicode code points — works for CJK and other languages)
A beautiful colorful sunset over the oceansizestringOptionalDefault: autoAspect ratio or explicit pixel dimensions (WxH).
| Value | Description |
|---|---|
| auto | Default — let the model decide |
| 1:1 / 1:2 / 2:1 / 1:3 / 3:1 / 2:3 / 3:2 / 3:4 / 4:3 / 4:5 / 5:4 / 9:16 / 16:9 / 21:9 / 9:21 | Aspect ratio — pixel size decided together with the resolution tier |
| 1024x1024 (or any WxH) | Explicit pixels — multiples of 16, pixel budget 655K~8.29M, edges ≤3840, aspect ≤3:1 |
Notes
- When size is explicit WxH pixels, the resolution parameter is ignored.
- In auto mode the model decides the final size; resolution has no effect.
- Combinations that exceed the 8.29 MP pixel budget are proportionally scaled down (e.g. 4K 1:1 → 2880×2880).
autoresolutionstringOptionalDefault: 1KResolution tier shortcut. Only effective when size is a ratio; ignored for explicit pixels and auto.
| Value | Description |
|---|---|
| 1K | Pixel budget ≈ 1024² = 1.05MP (1:1 → 1024×1024, 16:9 → 1360×768) |
| 2K | Pixel budget ≈ 2048² = 4.19MP (1:1 → 2048×2048, 16:9 → 2736×1536) |
| 4K | Pixel budget = 8.29MP / MaxPixels (1:1 → 2880×2880, 16:9 → 3840×2160 UHD) |
2KqualitystringOptionalDefault: mediumRendering quality / reasoning depth. Directly drives output token count (tile base 16/48/96 for low/medium/high).
| Value | Description |
|---|---|
| low | Tile base 16 — fastest, ~0.11× cost vs medium |
| medium | Tile base 48 — balanced (default) |
| high | Tile base 96 — highest fidelity, ~4× cost vs medium |
mediumbackgroundstringOptionalDefault: opaqueAlpha channel of the output image. Transparent is a Preview feature and results may be unstable.
| Value | Description |
|---|---|
| opaque | Flat background, no alpha channel (default) |
| transparent | Keeps an alpha channel (Preview, may be unstable) |
opaquenintegerOptionalDefault: 1Number of images to generate (1-10). Each image is billed independently; text input tokens scale linearly with n.
1image_urlsarrayOptionalReference image URL list for image-to-image and image editing features.
Notes
- 1–16 images per request
- Each image ≤ 50 MB
- Supported formats: .jpeg, .jpg, .png, .webp
- URLs must be directly accessible by the server, or URLs that trigger direct download (typically URLs ending with image extensions like .png, .jpg)
- Reference images themselves consume additional image-input tokens in edit / image-to-image mode
https://example.com/image1.pngmask_urlstringOptionalInpainting mask image URL — marks the region of the reference image to regenerate. Only valid in image edit mode (combined with image_urls); ignored in pure text-to-image.
Notes
- Only PNG with an alpha channel is accepted — transparent pixels (alpha < 255) mark areas to regenerate, opaque pixels are preserved
- Mask dimensions must EXACTLY match the reference image dimensions (width × height in pixels)
- Requires at least one image in image_urls — mask alone has no effect
- Single mask per request
https://example.com/mask.pngcallback_urlstringOptionalHTTPS callback address after task completion.
Notes
- Triggered on completion, failure, or cancellation
- Sent after billing confirmation
- HTTPS only, no internal IPs
- Max length: 2048 chars
- Timeout: 10s, Max 3 retries
https://your-domain.com/webhooks/image-task-completed