Seedance 2.5 ya está disponible en EvoLinkProbar Seedance 2.5

GPT Image 2 API

OpenAI / Azure-Generación de imágenesDisponible
Desde $0.048 / imagen en 1K medium-10%$0.053 precio oficial
Texto a imagenImagen a imagenMáscara de inpaintingTexto dentro de la imagenPóster e infografíaFacturación por tokens
Estado del enrutado
Disponible
Puntos fuertes del modelo
Generación fiel al prompt con texto legible dentro de la imagen
Casos de uso
Anuncios, pósteres, infografías, creatividad de producto, hojas de personaje
Entrada
Prompt de texto con imágenes de referencia y máscara opcionales
Salida
Imagen

Pruebe GPT Image 2 antes de integrar la API

Compruebe la calidad de salida, estime el coste en tokens de una solicitud y genere una muestra antes de integrar formalmente.

Create image task

Fixed to gpt-image-2

Text-to-image, image-to-image and mask-guided editing. Billed by the tokens the upstream usage object reports.

Reference images

Upload source or reference images for image-to-image and editing. Each one adds image input tokens.

0/16 files
Size
Resolution

Pixel budget for the chosen ratio: 1K about 1.05 MP, 2K about 4.19 MP, 4K is 8.29 MP.

Quality

Rendering effort. It drives the output token count, so it is the single biggest cost lever.

Background

Transparent keeps an alpha channel in the output. This is a Preview feature — results may be unstable.

Count1

Number of images per request (1-10). Cost scales linearly with the count.

Estimate $0.0281.8608 cr
medium quality + 16:9 @ 1K + 0 reference images x 1
Ready
History

Los resultados se conservan durante 24 horas: descarga lo que quieras guardar.

Generated GPT Image 2 tasks will appear here.

Sepa cuánto cuesta probar antes de añadir créditos

Empiece por el coste de una sola muestra, elija un presupuesto de prueba y calcule su propio caso en la calculadora. Las tarifas por token están abajo.

First Test Cost

Text-to-Image - 1K - 1:1 - medium
1K prompt-only
Credits3.2241

One 1K prompt-only image

Approx. Cost$0.048

About 208 tests with $10 in credits.

Iterate prompts on low quality at 1K to save tokens, then promote the final render to high. Each reference image in image_urls adds input tokens.

Precio EvoLink$0.048
precio oficial$0.053
Ahorra-10%

Testing Budget Guide

Pick an amount based on how many tests you expect.
Add Credits
$10
About 208 tests

Good for a first validation.

$50
About 1042 tests

Good for prompt iteration.

$100
About 2083 tests

Good before production integration.

Common Cost Examples

Draft iterationLow - 1K - prompt only
$0.0053/image-10%
0.3599 cr/image$0.0059 precio oficial
Reference editMedium - 1K - one reference image
$0.059/image-10%
3.9761 cr/image$0.065 precio oficial
Final quality checkHigh - 2K - prompt only
$0.386/image-10%
26.2034 cr/image$0.429 precio oficial

Estimated cost for one generated 1:1 image. Final cost is settled against the token counts the upstream usage object reports.

Model Pricing

This page serves two models and they are billed differently. Each block states its own rule, so read the badge before comparing the numbers.

GPT Image 2gpt-image-2Token-based

Billed by token, so there is no fixed per-image price. These are the raw rates; what a request actually costs depends on its size, quality, reference images and count. Use the calculator below to price your own case.

Image output tokens
The generated image itself. Token count grows with the resolution tier and the quality tier. - Output tokens
$0.027/1K tokens-10%
1.836 cr/1K tokens$0.030 precio oficial
Image input tokens
Applied to each reference image in image_urls, and to a mask when one is sent. - Input tokens
$0.0072/1K tokens-10%
0.4896 cr/1K tokens$0.0080 precio oficial
Image cached input tokens
Charged only when the upstream usage object reports cached image tokens. - Input tokens
$0.0018/1K tokens-10%
0.1224 cr/1K tokens$0.0020 precio oficial
Text input tokens
Produced by the prompt itself. Typically under 1% of a request. - Input tokens
$0.0045/1K tokens-10%
0.306 cr/1K tokens$0.0050 precio oficial
Text cached input tokens
Charged only when the upstream usage object reports cached text tokens. - Input tokens
$0.0012/1K tokens-10%
0.0765 cr/1K tokens$0.0013 precio oficial
EVOLINK · PRICE EST.gpt-image-2
× 1 · real-time

Figures are estimates. Final charges are based on actual token usage.

Your estimate
~$0.0050.360
Per $10
≈ 1,889 images
low quality · 1K · 1:1
Official· saves ~10%
~$0.0060.400
Tokens per image
image output196
image input0
text input0
Quality
Size
Resolution
Aspect
Count
1
Ref images
0
Prompt
0 chars · ~0 tokens
GPT Image 2 Betagpt-image-2-betaFlat per call

One flat rate per call, whatever the aspect ratio - no token accounting and nothing to estimate. Auto or aspect-ratio sizes at the 1K tier only, one image per call. The OpenAI list price has no equivalent for this route, so no official comparison is shown.

1K output
Any aspect ratio or auto, at the 1K tier. One image per call, regardless of prompt length or reference images. - Per call
$0.015/image
1.02 cr/image
Per $10
≈ 666 images
1K each

La API de GPT Image 2 de un vistazo

GPT Image 2 se lanzó junto con ChatGPT Images 2.0 y está disponible a través de la API con el ID de modelo gpt-image-2. Úselo para generación con mucho texto y edición de alta fidelidad; ChatGPT puede añadir orquestación y herramientas que son independientes del modelo de imagen en bruto.

ID de modelo
gpt-image-2
Ideal para
Generación con mucho texto y edición de imágenes de alta fidelidad
Base de coste
Prompt, tamaño, calidad y entrada de imágenes de referencia
Límite de salida
Tamaños personalizados hasta un lado de 3840 px; las salidas grandes son experimentales

Lo que GPT Image 2 puede crear

Genere imágenes de alta fidelidad a partir de prompts de texto o imágenes de referencia, con buenos diseños de póster, infografías densas, hojas de personaje, creatividad de producto y flujos de edición guiados por máscara.

Más ejemplos de prompts
Entrada
Texto / Imagen
Salida
Imagen
Tamaño
Auto / 15 proporciones / píxeles propios
Calidad
Low / Medium / High

Vista previa de resultados

Mejor legibilidad del texto en diseños densos

Mejor legibilidad del texto en diseños densos

Los gráficos, las etiquetas y el texto a varias columnas pueden salir más legibles directamente en la imagen, lo que reduce el retoque tipográfico posterior.
Salida de ejemplo; los resultados reales varían según el prompt y los ajustes.
Hojas de personaje multipanel

Hojas de personaje multipanel

Las vistas de rotación, las cuadrículas de expresiones y los desgloses de equipo pueden mantener una coherencia más sólida en un solo lienzo.
Salida de ejemplo; los resultados reales varían según el prompt y los ajustes.
Composición y tipografía de nivel póster

Composición y tipografía de nivel póster

El título, el lema y el bloque de créditos siguen con más fidelidad la maquetación pedida en el prompt, con jerarquía propia de imprenta.
Salida de ejemplo; los resultados reales varían según el prompt y los ajustes.

Qué puede hacer

Pósteres e infografías con mucho texto

Pida títulos, lemas, etiquetas de gráficos y texto a varias columnas renderizados dentro de la imagen: la carga de trabajo de la que más se habla con GPT Image 2.

Hojas de personaje y personajes coherentes

Vistas de rotación, cuadrículas de expresiones y desgloses de equipo en un solo lienzo, con imágenes de referencia que mantienen la misma identidad entre generaciones.

Fotos de producto para e-commerce y anuncios estilo UGC

Convierta una foto de producto en imágenes principales, mockups de packaging, escenas lifestyle y creatividades publicitarias donde el producto sigue siendo reconocible.

Visuales de campaña por lotes vía API

Genere hasta 10 variaciones por solicitud y produzca series de campaña completas por script, manteniendo un mismo estilo en todo el lote.

Edición con referencias, transferencia de estilo y máscaras

Controle estilo, coherencia del sujeto o transformación con hasta 16 imágenes en image_urls, o repinte solo la zona enmascarada con un PNG con canal alfa.

Primeros fotogramas para flujos de vídeo con IA

Genere aquí el fotograma clave y anímelo con Seedance con la misma clave API: un flujo tan buscado que tiene su propia guía más abajo.

Elija el modelo de imagen adecuado para cada tarea

Precio inicial
GPT Image 2~$0.048 / imagen
Nano BananaOpciones más económicas
SeedreamNiveles por imagen
Modelo de facturación
GPT Image 2Por tokens
Nano BananaPor imagen generada
SeedreamPor imagen según el nivel
Calidad de salida
GPT Image 2Low / Medium / High x 1K / 2K / 4K
Nano Banana1K / 2K / 4K según el modelo
Seedream1K / 1.5K / 2K
Entrada de referencia
GPT Image 2Hasta 16 imágenes más máscara
Nano BananaDepende del modelo
SeedreamHasta 10 imágenes
Mejor para
GPT Image 2Pósteres, infografías, texto en la imagen
Nano BananaGeneración de imágenes de alta calidad
SeedreamAnuncios, creatividad de producto, edición de imágenes

Detalles clave

size y resolution funcionan juntos

En modo proporción, el nivel de resolución fija el presupuesto de píxeles (1K unos 1,05 MP, 2K unos 4,19 MP, 4K exactamente 8,29 MP). En modo auto o píxeles propios, resolution se ignora.

quality significa esfuerzo de renderizado

Low, medium y high determinan cuántos tokens de salida gasta el modelo. Itere prompts en low y suba el render final a high.

La facturación sigue al objeto usage

Se cobran créditos según los tokens que informa el objeto usage del proveedor: se estima antes de ejecutar y se liquida con las cifras reales.

Parámetros principales de la solicitud

Los campos que determinan la salida y el coste en POST /v1/images/generations. La generación es asíncrona: consulte el task ID devuelto o use un callback, y guarde los resultados pronto, ya que los enlaces de imagen siguen siendo válidos durante 24 horas. Los esquemas completos y los ejemplos de código están en la pestaña API.

ParámetroTipoFunción
modelstring · obligatorio'gpt-image-2' para la ruta oficial facturada por tokens, o 'gpt-image-2-beta' para la ruta 1K de tarifa plana.
promptstring · obligatorioLa instrucción de texto. Los tokens del prompt se miden como entrada de texto en la ruta por tokens.
sizestring · auto por defecto'auto', una de 15 proporciones como 1:1 o 16:9, o píxeles WxH explícitos en múltiplos de 16.
resolutionstring · 1K / 2K / 4KPresupuesto de píxeles en modo proporción; se ignora cuando size es auto o píxeles explícitos.
qualitystring · low / medium / highEsfuerzo de renderizado. Determina el gasto de tokens de salida en la ruta por tokens: itere en low y suba el render final a high.
backgroundstring · opaque / transparentCanal alfa de la salida. Predeterminado opaque; transparent está en Preview y los resultados pueden ser inestables.
ninteger · 1–10Imágenes por solicitud en gpt-image-2; el coste escala linealmente. GPT Image 2 Beta devuelve una imagen por llamada.
image_urlsarray · hasta 16Imágenes de referencia para image-to-image y edición. Cada una añade tokens de entrada de imagen.
mask_urlstring · opcionalPNG con canal alfa cuyas dimensiones en píxeles coinciden con la imagen de referencia; las zonas transparentes se regeneran.
callback_urlstring · opcionalWebhook HTTPS que recibe el resultado de la tarea, como alternativa al polling.

Límites de producción a tener en cuenta

El texto y la maquetación aún requieren revisión

El renderizado de texto ha mejorado, pero la colocación exacta, la nitidez y la composición estructurada aún pueden desviarse del prompt.

La salida grande es experimental

Los tamaños personalizados pueden alcanzar un lado de 3840 px, pero las salidas con más de 3.686.400 píxeles totales —el número de píxeles de 2560x1440— son por ahora experimentales.

El fondo transparente está en Preview

background: "transparent" ya está disponible, pero sigue en Preview: los resultados pueden ser inestables.

Las peticiones complejas pueden tardar más

OpenAI señala que los prompts complejos pueden tardar hasta dos minutos en procesarse.

Verifique los límites actuales en la guía de generación de imágenes de OpenAI

Por qué usar GPT Image 2 a través de EvoLink

Estime el coste exacto antes de generar

La facturación por tokens es la parte de GPT Image 2 más difícil de presupuestar: los tokens de salida de imagen crecen con la resolución y el nivel de calidad, cada imagen de referencia añade tokens de entrada y el propio prompt también se contabiliza. EvoLink lo convierte en una cifra cotizada antes de enviar: la calculadora de precios y el Playground tarifican exactamente la combinación de tamaño, resolución, calidad y referencias que está a punto de enviar.

Eso cambia su forma de probar: itere los prompts en el nivel low, observe el efecto de cada cambio en la estimación y suba a high solo el render final, en lugar de descubrir el patrón de costes en la factura de fin de mes.

Por debajo del precio de lista de OpenAI, línea a línea

La sección de precios de esta página coloca la tarifa de EvoLink junto al precio oficial de OpenAI para cada tipo de token —salida de imagen, entrada de imagen, entrada en caché y texto— y muestra el ahorro actual línea a línea, respaldado por la garantía de precio más bajo de EvoLink.

Como la comparación se calcula a partir de los precios SKU en vivo y no de una afirmación de marketing, puede verificarla en el momento de integrar y volver a comprobarla cuando su volumen crezca lo bastante para que la diferencia importe.

Dos rutas de facturación en una página

gpt-image-2 y gpt-image-2-beta se sirven en paralelo: la ruta oficial facturada por tokens, con toda la superficie de 1K/2K/4K, niveles de calidad, máscara y multirreferencia, y una ruta a tarifa plana donde cada imagen 1K cuesta lo mismo sin importar la longitud del prompt ni las referencias.

En la práctica, los equipos ponen borradores, iteración de prompts y lotes 1K en la ruta plana, de coste perfectamente predecible, y reservan la ruta por tokens para finales en 2K/4K, máscaras y ediciones con muchas referencias. Cambiar es cambiar el model ID, no migrar de proveedor.

Una clave API para rutas de imagen, vídeo, audio y LLM

La misma clave API que llama a gpt-image-2 llama también a Seedance para vídeo, a Nano Banana 2 y Seedream como rutas de imagen alternativas, y al catálogo LLM: un solo saldo, un solo historial de tareas, una sola vía de autenticación.

Esto importa especialmente en imagen porque los pipelines rara vez terminan en una imagen fija: genere el fotograma clave con GPT Image 2, anímelo con Seedance y recurra a otro modelo de imagen cuando un trabajo encaje mejor allí, sin mantener cuentas, claves ni registros de facturación separados por proveedor.

Estado de tareas auditable antes de pagar

Cada generación informa de enviado, en proceso, completado o fallido, con el detalle del error en la respuesta y en la consola. Las tareas fallidas no se tratan como generaciones facturables correctas, así que un lote de trabajos defectuoso no se convierte silenciosamente en una factura.

Para sistemas en producción, esa es la diferencia entre "petición enviada" e "imagen entregada": consulte la tarea, verifique el estado final y concilie el gasto con los registros por tarea de la consola cuando necesite justificar una cifra.

Familia de modelos GPT Image

GPT Image 1.5

GPT Image 1.5

Ruta de imagen anterior de OpenAI, con tamaños fijos de clase 1024, facturación por tokens y comportamiento de producción asentado.

Ver

Otros modelos de imagen en EvoLink

Nano Banana 2

Nano Banana 2

Modelo de imagen de Google para generación de alta calidad y flujos creativos flexibles.

Ver
Nano Banana Pro

Nano Banana Pro

Ruta Nano Banana premium para mayor fidelidad y salida de nivel producción.

Ver
Seedream 5.0 Pro

Seedream 5.0 Pro

Ruta de imagen de BytePlus con niveles 1K/1.5K/2K, edición multirreferencia y descomposición en capas.

Ver
Grok Imagine Image 2.0

Grok Imagine Image 2.0

Ruta de imagen de xAI en la que el número de imágenes de entrada elige el modo, con salida 1K/2K y hasta 10 imágenes por solicitud.

Ver

Preguntas frecuentes

¿Qué relación hay entre GPT Image 2 y ChatGPT Images 2.0?

GPT Image 2 es el modelo de imagen accesible por API lanzado junto con ChatGPT Images 2.0, con el ID de modelo gpt-image-2. ChatGPT puede combinar la generación de imágenes con razonamiento, búsqueda web u orquestación multiimagen, por lo que el modelo API en bruto no debe considerarse idéntico a todos los flujos de trabajo del producto ChatGPT.

¿Cuál es la diferencia entre GPT Image 2 y GPT Image 2 Beta?

Son dos variantes de ruta distintas de EvoLink. gpt-image-2 usa la ruta oficial facturada por tokens, con calidades low/medium/high, resoluciones 1K/2K/4K, píxeles WxH explícitos, n hasta 10 y una máscara de inpainting. gpt-image-2-beta es la ruta alternativa de precio fijo de EvoLink para salida 1K y una imagen por llamada; no es un ID de modelo oficial de OpenAI.

¿Cuánto cuesta GPT Image 2?

Se factura por tokens. Los tokens de salida de imagen dominan la factura y crecen con los niveles de resolución y calidad; los tokens de entrada de imagen se suman por cada imagen de referencia; los tokens de entrada de texto vienen del prompt. El Playground estima la combinación seleccionada antes de enviar. Si prefiere un precio fijo por imagen, GPT Image 2 Beta factura una tarifa fija por llamada, y la calculadora de precios estima su coste por imagen.

¿Cómo se compara el precio de GPT Image 2 en EvoLink con el de OpenAI?

La sección de precios compara la tarifa actual de EvoLink con el precio de lista de OpenAI y muestra el ahorro disponible en el momento de la consulta. Use la calculadora para su combinación exacta de tamaño, calidad e imágenes de referencia en lugar de confiar en una afirmación universal por imagen.

¿Debo usar la Image API o la Responses API para GPT Image 2?

Con la Image API, elija gpt-image-2 directamente para generar o editar. Con la Responses API, elija un modelo principal que admita la herramienta image_generation; la herramienta se encarga de seleccionar el modelo de imagen en flujos conversacionales o de varios pasos. EvoLink ofrece su propia ruta unificada para el acceso directo al modelo.

¿Puedo previsualizar antes de integrar la API?

Sí. Use el Playground para probar la calidad, estimar créditos e inspeccionar el JSON de la petición antes de llevarlo a su producto.

¿Qué diferencia hay entre size y resolution?

size elige la forma: auto, una de las 15 proporciones o píxeles WxH explícitos. resolution solo fija el presupuesto de píxeles en modo proporción, y se ignora con auto o píxeles explícitos.

¿Se facturan las imágenes de referencia?

Sí. Cada imagen en image_urls añade tokens de entrada de imagen. La máscara se reserva como una imagen de entrada adicional al estimar y se liquida con el uso real del proveedor.

¿Qué límites tienen los tamaños de píxel personalizados?

El ancho y el alto deben ser múltiplos de 16, el total de píxeles debe estar entre 655.360 y 8.294.400, ningún lado puede superar 3840 px y la proporción debe quedar entre 1:3 y 3:1. Las salidas con más de 3.686.400 píxeles totales —el número de píxeles de 2560x1440— son por ahora experimentales.

¿Puedo generar varias imágenes en una petición?

En gpt-image-2 sí: n admite de 1 a 10 y el coste escala de forma lineal. GPT Image 2 Beta devuelve una imagen por llamada.

¿Cómo funciona la máscara de inpainting?

mask_url espera un PNG con canal alfa cuyas dimensiones coincidan exactamente con la imagen de referencia. Los píxeles transparentes marcan el área a regenerar y los opacos se conservan. Sin imagen de referencia, la máscara se descarta.

¿Qué pasa si una generación falla?

Consulte el estado de la tarea y el detalle del error en la respuesta o en la consola. Las tareas fallidas no deben contarse como generaciones facturables correctas.

¿Cuáles son las principales limitaciones de GPT Image 2?

Los prompts complejos pueden tardar hasta dos minutos. La colocación del texto, la coherencia de personajes recurrentes y la composición estructurada precisa aún pueden requerir iteración.

Guías de GPT Image 2