GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5

Actualizaciones de API

Mantente informado sobre los últimos cambios y mejoras en todas nuestras APIs.

septiembre de 2026

2026-09-30

Nuevos modelos | Suno V6, Suno V6 Mini y Suno V6 Wild

models

Suno V6, Suno V6 Mini y Suno V6 Wild ya están disponibles en EvoLink, y Suno V6 pasa a ser la versión recomendada por defecto en la página de Suno. Los tres cuestan lo mismo que los modelos musicales de Suno existentes, se cobran por generación y cada generación produce 2 pistas.

Suno V6

  • ID de modelo: suno-v6-beta
  • Destacados: voces más naturales, más detalle y mayor expresividad musical
  • Admite: Persona y duration personalizada (se recomiendan 60 segundos o más)

Suno V6 Mini

  • ID de modelo: suno-v6-mini-beta
  • Destacados: ligero y rápido, con equilibrio entre calidad y velocidad
  • Admite: Persona; la duration personalizada aún no está disponible
  • Probar: cambia a Suno V6 Mini en el selector de modelo

Suno V6 Wild

  • ID de modelo: suno-v6-wild-beta
  • Destacados: una expresión musical más audaz y distintiva
  • Admite: Persona y duration personalizada
  • Probar: cambia a Suno V6 Wild en el selector de modelo

Común a los tres modelos

  • Precio: igual que los modelos musicales de Suno existentes, cobrado por generación sin importar la duración de las pistas. Consulta los precios
  • Límites de longitud: en modo personalizado (custom_mode=true), letra de hasta 5000 caracteres y estilo de hasta 1000 caracteres
  • Persona y duración: solo disponibles en modo personalizado
  • Tareas asíncronas: envía y luego consulta el estado o usa callback_url

Todas las versiones de Suno

  • El límite del prompt en modo simple (custom_mode=false) sube de 500 a 3000 caracteres
2026-09-29

Nuevo modelo | GPT-6.1 Sol

models

GPT-6.1 Sol ya está disponible en EvoLink. OpenAI lo presenta como un rendimiento cercano a Astra para trabajo complejo a menor coste: programación compleja, computer use y trabajo profesional.

GPT-6.1 Sol

  • ID del modelo: gpt-6.1-sol — escrito con punto; GPT-6 Sol sigue disponible con su propio ID
  • Creado para: programación y depuración complejas, computer use y trabajo profesional de varios pasos
  • Ventana de contexto: 1.050.000 tokens, hasta 128K de salida máxima
  • Facturación: entrada sin caché, lectura de caché, escritura de caché y salida se miden por separado; el precio de lectura de caché de OpenAI es la mitad que en GPT-6 Sol. Las tarifas actuales están en la página del modelo GPT-6.1 Sol
  • Contexto largo: las solicitudes de más de 272K tokens de prompt se facturan completas a tarifas de contexto largo — 2x para la entrada y ambos roles de caché, 1,5x para la salida
  • Protocolos: Chat Completions y Responses compatibles con OpenAI, con la misma clave API de EvoLink

Cambios respecto a GPT-6 Sol

  • Razonamiento: reasoning_effort (Chat) o reasoning.effort (Responses) acepta low, medium (predeterminado), high y xhigh, además de max en Responses; none no está disponible, así que cambia none por low
  • Llamadas a herramientas: Chat Completions solo acepta solicitudes sin herramientas; envía las llamadas a funciones y las herramientas integradas a Responses
  • Parámetros: elimina temperature, top_p, logprobs y top_logprobs de las solicitudes
2026-09-29

Claude Sonnet 5.5 | El Sonnet más reciente de Anthropic para código y agentes

models

Claude Sonnet 5.5 de Anthropic ya está disponible en EvoLink — el sucesor de Claude Sonnet 5 con el mismo precio de lista, para programación diaria, agentes que usan herramientas y tráfico de producción de alto volumen, con una ventana de contexto de 1M tokens y hasta 128K de salida máxima.

Claude Sonnet 5.5

  • ID del modelo: claude-sonnet-5-5
  • Ventana de contexto: 1M tokens
  • Salida máxima: 128K tokens
  • Capacidades: programación agéntica en repositorios reales, uso fiable de herramientas, pensamiento adaptativo (activado por defecto), entrada de imágenes, prompt caching
  • Cargas de trabajo recomendadas: programación diaria, agentes que usan herramientas y tráfico de producción de alto volumen
  • Facturación: basada en tokens — Input, Output, Cache Write, Cache Hit; la herramienta de búsqueda web se factura por búsqueda en las rutas que la admiten. Tarifas actuales en la sección de precios
  • API: Chat Completions compatible con OpenAI y Anthropic Messages, con la misma clave de API de EvoLink
2026-09-29

GLM, DeepSeek & Kimi K3 | Precios más bajos

pricing

GLM, DeepSeek y Kimi K3 bajan de precio en EvoLink, con efecto desde el 30 de septiembre de 2026 (UTC+8). La actualización incluye GLM-5.3, GLM-5.3 Flash, GLM-5.3 FlashX, GLM-5.2, DeepSeek V4 Pro, DeepSeek V4 Flash, DeepSeek V4.1 Flash y Kimi K3: la entrada y la salida bajan en todos estos modelos, y la lectura de caché baja o se mantiene en la mayoría de ellos. Las nuevas tarifas se aplican automáticamente, sin cambios en tus llamadas a la API.

  • La lectura de caché de GLM-5.3 y GLM-5.3 FlashX sube ligeramente con las nuevas tarifas
  • deepseek-v4-flash-vision-exp ahora lo sirve DeepSeek V4.1 Flash y se factura con las tarifas de DeepSeek V4.1 Flash
2026-09-24

Nuevos modelos | Seedream 5.0 Flash y Seedream 5.0 Flash Layerize

models

Seedream 5.0 Flash y Seedream 5.0 Flash Layerize ya están disponibles en EvoLink. Flash es el modelo Seedream 5.0 más rápido para generar y editar imágenes; Flash Layerize separa una imagen en capas editables. Ambos cobran una tarifa fija por imagen generada, un 10 % por debajo del precio oficial.

Seedream 5.0 Flash

  • ID de modelo: doubao-seedream-5.0-flash
  • Generación y edición: texto a imagen, imagen a imagen y edición con hasta 10 referencias; size admite auto, una proporción o píxeles personalizados; quality es 1K, 1.5K o 2K. La salida transparente conserva el alfa existente de una única referencia y requiere PNG; no elimina fondos
  • Precio: una tarifa fija por imagen generada: 1K, 1.5K y 2K cuestan lo mismo, y las imágenes de referencia no se cobran. Consulta los precios

Seedream 5.0 Flash Layerize

  • ID de modelo: doubao-seedream-5.0-flash-layerize
  • Entrada: exactamente una imagen png o jpeg; prompt es opcional
  • Salida: una imagen base más hasta 16 capas PNG transparentes, cada una con su orden de apilamiento y su cuadro delimitador
  • Precio: cada imagen generada (la imagen base y cada capa) se cobra a la misma tarifa fija que Flash. Al iniciar la tarea se reservan hasta 17 imágenes y la parte no usada se reembolsa

Común a ambos modelos

  • Misma solicitud que Seedream 5.0 Pro: quality es 1K, 1.5K o 2K (Layerize también admite auto)
  • Modo de prompt: prompt_priority solo acepta standard; las solicitudes con fast se rechazan y no se cobran
  • Tareas asíncronas: envía y luego consulta el estado o usa callback_url
2026-09-23

Nuevos modelos | GPT-6 Sol y GPT-6 Luna

models

GPT-6 Sol y GPT-6 Luna se suman a GPT-6 Astra en EvoLink. Sol está creado para programación compleja y flujos agénticos; Luna es el modelo GPT-6 más eficiente de OpenAI para tareas específicas de gran volumen.

GPT-6 Sol

  • ID del modelo: gpt-6-sol — no existe un alias genérico gpt-6
  • Pensado para: programación compleja, cambios en varios archivos y agentes guiados por herramientas
  • Facturación: entrada sin caché, lectura de caché, escritura de caché y salida se miden por separado. Las tarifas actuales están en la página del modelo GPT-6 Sol

GPT-6 Luna

  • ID del modelo: gpt-6-luna
  • Pensado para: clasificación, extracción, enrutado y llamadas de subagentes a gran volumen
  • Facturación: las mismas cuatro partidas medidas por separado. Las tarifas actuales están en la página del modelo GPT-6 Luna

Común a ambos modelos

  • Ventana de contexto: 1.050.000 tokens, hasta 128K de salida máxima
  • Contexto largo: por encima de 272K tokens de prompt, toda la solicitud se factura con tarifas de contexto largo — 2x para la entrada y ambos roles de caché, 1,5x para la salida
  • Protocolos: Chat Completions y Responses compatibles con OpenAI, con la misma clave de API de EvoLink
  • Razonamiento: reasoning_effort (Chat) o reasoning.effort (Responses) acepta none, low, medium (predeterminado), high, xhigh y max — none es nuevo respecto a GPT-6 Astra
  • Llamadas a herramientas: usa Responses para las herramientas integradas y la llamada a funciones; en Chat Completions, la llamada a funciones solo funciona con reasoning_effort en none
2026-09-23

GPT-5.6 Sol | Precios más bajos

pricing

GPT-5.6 Sol baja todos sus precios en EvoLink, en línea con el nuevo precio de lista de OpenAI para el modelo, con efecto desde el 23 de septiembre de 2026 (UTC+8). Bajan la entrada, la lectura de caché, la escritura de caché y la salida, incluidas las tarifas de contexto largo. Las nuevas tarifas se aplican automáticamente: sigue llamando a gpt-5.6-sol, sin cambios en tus llamadas a la API.

  • Los precios de GPT-5.6 Terra y GPT-5.6 Luna no cambian
2026-09-22

Nuevo modelo | Claude Opus 5.5

models

Claude Opus 5.5 — el modelo Opus más reciente de Anthropic, sucesor de Claude Opus 5 con un precio de lista más bajo — ya está disponible en EvoLink.

Disponibilidad

Claude Opus 5.5 se puede llamar a través de la API de producción de EvoLink con la misma clave de API de EvoLink. La página del modelo Claude Opus 5.5 es la referencia para precios y parámetros vigentes.

ID del modelo

  • claude-opus-5-5 — ventana de contexto de 1.000.000 tokens, hasta 128K de salida máxima

Dimensiones de facturación

Se miden por separado cinco dimensiones: entrada, escritura de caché, lectura de caché, salida y la herramienta de búsqueda web. La búsqueda web se factura por búsqueda, y sus resultados cuentan además como tokens de entrada normales. Consulta la sección de precios para ver las tarifas actuales.

Si vienes de Claude Opus 5

Anthropic fija Opus 5.5 por debajo de Opus 5 en todas las tarifas por token, y la lectura de caché baja de una décima a una vigésima parte del precio de entrada. Tres ajustes de la solicitud se comportan de forma distinta: el pensamiento no se puede desactivar —envía thinking: {type: "adaptive"} u omite el parámetro y controla la profundidad con effort—; el valor predeterminado de effort es medium en lugar de high; y forzar la herramienta (any o tool) se rechaza, así que usa auto.

Protocolos

Chat Completions compatible con OpenAI y Anthropic Messages, con la misma clave de API de EvoLink.

Probar Claude Opus 5.5 | Ver precios

2026-09-22

Grok 4.7 | El modelo de razonamiento más reciente de xAI, al precio de Grok 4.6

models

Grok 4.7 ya está disponible en EvoLink, con un contexto de 500.000 tokens y acceso tanto por Chat Completions como por Responses.

Precios — idénticos a Grok 4.6, línea por línea

  • Entrada: 2,00 $ por millón de tokens (precio de lista)
  • Entrada en caché: 0,50 $ por millón de tokens
  • Salida: 6,00 $ por millón de tokens, tokens de razonamiento incluidos
  • A partir de 200.000 tokens de prompt, todos los tokens de la solicitud pasan al tramo de contexto largo, facturado al doble
  • La página del modelo muestra la tarifa que tu cuenta paga realmente

Qué cambia respecto a Grok 4.6

  • El ID de modelo para las solicitudes es grok-4.7. El slug de la página grok-4-7 no es un valor válido
  • reasoning_effort acepta low, medium, high (predeterminado) y xhigh
  • En Responses, el razonamiento cifrado se devuelve en cada respuesta, sin declararlo en include
  • El corte de conocimiento pasa a mayo de 2026
2026-09-22

Búsqueda en X de Grok | Ahora se factura por publicaciones y perfiles obtenidos

modelspricing

La búsqueda en X de Grok ahora se factura por lo que devuelve una búsqueda, no por cuántas veces se ejecuta. xAI aplicó el cambio el 21 de septiembre de 2026 a las 12:00 PT y afecta a grok-4.5, grok-4.6 y grok-4.7.

Tarifas — vigentes desde el 21 de septiembre de 2026

  • Publicaciones obtenidas: 5 $ por cada 1.000 publicaciones, antes 5 $ por cada 1.000 llamadas
  • Perfiles de usuario obtenidos: 10 $ por cada 1.000 perfiles, un concepto de facturación nuevo
  • Cuenta cada publicación que devuelve una búsqueda o la carga de un hilo, incluidas las publicaciones padre y citadas, sin deduplicación
  • El resto de herramientas del servidor no cambia: búsqueda web y ejecución de código a 5 $ por cada 1.000 llamadas, búsqueda de adjuntos a 10 $ por cada 1.000 y búsqueda en colecciones a 2,50 $ por cada 1.000

Qué cambia en tu factura

  • Antes, una llamada x_search costaba lo mismo devolviera 1 publicación o 30. Ahora se cuenta por elemento
  • Las búsquedas que arrastran hilos largos se encarecen de forma apreciable; limita el volumen con search_parameters.max_search_results
  • Los cargos por tokens no se ven afectados y se siguen calculando aparte de las tarifas de herramientas
2026-09-22

Actualización de Seedance 2.5 | Modo borrador y Draft-to-Video

models

Seedance 2.5 ahora admite un flujo en dos pasos: vista previa rápida y, cuando convenza, el vídeo final.

Novedades

  • Modo borrador: envía draft: true en cualquiera de los cinco modelos de generación de Seedance 2.5 (o activa el modo borrador en el Playground) para obtener una vista previa 480p rápida de la escena, la cámara y el movimiento. Se cobra como un vídeo 480p normal
  • seedance-2.5-draft-to-video: convierte un borrador terminado en un vídeo final 1080p con solo source_task_id y un output_format opcional. Prompt, recursos, duración, proporción, semilla y audio se reutilizan del borrador

Notas

  • El borrador y el final se cobran por separado, y el final se cobra con la tarifa de 1080p; el filtro de contenido se hereda del borrador y no se puede cambiar al convertir
  • Un borrador terminado devuelve draft_expires_at; pasado ese momento la conversión devuelve 410 draft_task_expired
2026-09-21

GLM-5.3 FlashX | Nuevo nivel de rendimiento en la familia 5.3

models

GLM-5.3 FlashX ya está disponible. Se sitúa entre GLM-5.3 Flash y el buque insignia GLM-5.3: el mismo contexto nativamente multimodal de 1 M de tokens y razonamiento siempre activo, a aproximadamente una cuarta parte del precio del buque insignia.

  • ID de modelo glm-5.3-flashx, disponible en Chat Completions, Responses y Anthropic Messages
  • Entrada de texto, imagen, vídeo y archivos; las lecturas de caché se facturan a su propia tarifa reducida
  • La búsqueda web se cobra por llamada, aparte del consumo de tokens
  • Los niveles de razonamiento admitidos son low, high y max; el resto se asigna al nivel más cercano

La página del modelo muestra la tarifa por token vigente para tu cuenta. Las cifras actuales están en la página de precios.

2026-09-17

Nuevo modelo | MiniMax H3 Max Reference-to-Video

models

MiniMax H3 Max ya admite material de referencia — imágenes, vídeo y audio — mediante una nueva ruta. La salida se cobra por segundo; el vídeo de referencia tiene su propia tarifa, más alta.

MiniMax H3 Max Reference-to-Video

  • ID del modelo: minimax-h3-max-reference-to-video
  • Material de referencia: hasta 9 imágenes, 3 vídeos y 3 audios, 12 elementos en total. Se exige al menos una imagen o un vídeo de referencia: el audio por sí solo se rechaza
  • Salida: MP4 768p o 480p, 5–15 segundos; la proporción sigue por defecto al material de referencia. H3 Max no tiene nivel 2K
  • Precio: tres tramos — segundos de salida, segundos de vídeo de referencia con una tarifa propia y más alta, e imágenes de referencia por encima del cupo gratuito. El audio de referencia no se cobra. Consulta los precios
  • Cupo gratuito de imágenes: las 2 primeras imágenes de referencia son gratis. MiniMax H3 da 5, así que el mismo encargo puede salir más caro aquí; revisa la estimación antes de migrar
  • No admitido: image_start / image_end
  • Tareas asíncronas: envía y luego consulta el estado o usa callback_url
2026-09-17

Nuevo modelo | MiniMax H3 Max Turbo

models

MiniMax H3 Max Turbo — el nivel rápido de MiniMax H3 Max — ya está disponible en EvoLink: dos rutas, salida 768p / 480p y facturación por segundo.

MiniMax H3 Max Turbo

  • ID de modelo: minimax-h3-max-turbo-text-to-video, minimax-h3-max-turbo-image-to-video
  • Salida: MP4 en 768p o 480p, de 5 a 15 segundos. Relación de aspecto 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16; texto a vídeo exige una relación explícita (16:9 por defecto)
  • Precio: por segundo generado, un 5% menos que la tarifa oficial de Turbo a igual resolución; el cargo mínimo equivale a la petición válida más barata (480p × 5 s). Consulta los precios
  • Imagen a vídeo: image_start (primer fotograma) es obligatorio y image_end (último fotograma) es opcional. No se admite enviar solo un último fotograma. Esta ruta no admite relación de aspecto: la salida sigue las proporciones de la imagen de entrada
  • Resolución por defecto: las peticiones sin quality generan en 768p. Envía "quality": "480p" para el nivel más barato
  • No disponible en Turbo: salida 2K, clips de 4 segundos y cualquier generación guiada por referencias: ni imágenes, ni vídeos, ni audios de referencia. Usa MiniMax H3 o MiniMax H3 Max cuando necesites material de referencia
  • Tareas asíncronas: envía y luego consulta el estado o usa callback_url
2026-09-17

Seedance 2.5 | La 1080p vuelve a su precio habitual

pricing

El descuento por tiempo limitado del 28 % en la salida 1080p de Seedance 2.5 terminó según lo previsto el 17 de septiembre de 2026 (UTC+8). La 1080p vuelve a su precio habitual en los cinco modelos. No hace falta cambiar tus llamadas a la API.

  • Las tarifas de 480p y 720p no cambian
  • Se aplica a seedance-2.5-text-to-video, seedance-2.5-image-to-video, seedance-2.5-reference-to-video, seedance-2.5-video-edit y seedance-2.5-video-extend

La estimación del Playground y la página de precios ya muestran el precio habitual. Consulta la página de precios para ver la tarifa por segundo vigente.

2026-09-16

MiniMax H3 Max | Bajada del 5% en ambas resoluciones

modelspricing

MiniMax H3 Max reduce sus precios un 5% en ambas resoluciones, tanto en generación de vídeo desde texto como desde imágenes.

Precios — 5% de descuento desde el 16 de septiembre de 2026

  • 768p: $0,076 por segundo de vídeo generado, antes $0,080
  • 480p: $0,0475 por segundo de vídeo generado, antes $0,050
  • Cargo mínimo: $0,2375 por tarea, antes $0,250 (480p × 5 segundos)
  • Ambas rutas tienen las mismas tarifas: minimax-h3-max-text-to-video y minimax-h3-max-image-to-video

Elige la resolución de salida

  • Las solicitudes sin quality generan en 768p. Para usar la tarifa más baja, envía "quality": "480p" explícitamente
  • Ambas resoluciones admiten vídeos de 5–15 segundos, facturados por segundo de salida
2026-09-10

Nuevo modelo | DeepSeek V4.1 Flash

models

DeepSeek V4.1 Flash incorpora comprensión de imágenes nativa para flujos de programación, documentos y capturas de pantalla. Consulta los precios actuales en la página del modelo antes de desplegarlo.

DeepSeek V4.1 Flash

  • ID de modelo: deepseek-v4.1-flash en EvoLink; la URL de la página es /deepseek-v4-1-flash
  • Ventana de contexto: 1.000.000 de tokens, con una salida máxima de 384.000 tokens; define un presupuesto de salida adecuado para cada tarea
  • Facturación: la entrada, el acierto de caché y la salida tienen tarifas separadas. Revisa la sección de precios del modelo y los cargos finales de tu cuenta; las tarifas por token no bastan para determinar el costo de una tarea
  • Entrada de imagen: PNG, JPEG, WebP y GIF. Mide el consumo con imágenes representativas antes de escalar
  • Protocolos: Chat Completions, Messages y Responses aceptan el mismo ID de modelo; los campos de imagen cambian: image_url, un bloque image e input_image
  • Razonamiento y caché: el razonamiento está activado por defecto y la caché de prefijo es automática; registra la configuración de razonamiento que envías, revisa la documentación del protocolo y lee los tokens en caché en el campo usage
  • Modelos anteriores: en EvoLink, deepseek-v4-flash y deepseek-v4-pro no se ven afectados y siguen sirviendo V4 Flash y V4 Pro; deepseek-v4-flash-vision-exp ahora redirige a V4.1 Flash. Consulta la guía de migración
2026-09-09

Nuevo modelo | GPT Image 2.5 Sunburst y Flare

models

GPT Image 2.5 Sunburst y GPT Image 2.5 Flare ya están disponibles en EvoLink: los dos modelos GPT Image 2.5 que OpenAI publicó el 8 de septiembre de 2026, con las mismas tarifas por token que GPT Image 2.

GPT Image 2.5 Sunburst

  • ID de modelo: gpt-image-2.5-sunburst (sin alias; usa el ID exacto)
  • Posicionamiento: la elección de OpenAI para flujos donde la precisión de edición importa más, con un control más estricto en ediciones de varias rondas y tiempos de generación más largos
  • Entrada: prompt de texto, hasta 16 imágenes de referencia y una máscara de inpainting opcional; salida: imagen
  • Calidad: cinco niveles low / medium / high / xhigh / max (por defecto medium); tamaño auto, 15 relaciones de aspecto o WxH explícito; resolución 1K / 2K / 4K
  • Facturación: por token — los tokens de salida de imagen, entrada de imagen, entrada en caché y entrada de texto se liquidan con el objeto usage del proveedor; tarifas en la sección de precios
  • Endpoint: POST /v1/images/generations, tarea asíncrona con polling o callback_url

GPT Image 2.5 Flare

  • ID de modelo: gpt-image-2.5-flare (sin alias; usa el ID exacto)
  • Posicionamiento: la opción rápida por defecto de OpenAI para generación cotidiana de alta calidad: mayor calidad que GPT Image 2 con hasta un 50 % menos de latencia (cifra de OpenAI)
  • Entrada: prompt de texto, hasta 16 imágenes de referencia y una máscara de inpainting opcional; salida: imagen
  • Calidad: cinco niveles low / medium / high / xhigh / max (por defecto medium); tamaño auto, 15 relaciones de aspecto o WxH explícito; resolución 1K / 2K / 4K
  • Facturación: por token — los tokens de salida de imagen, entrada de imagen, entrada en caché y entrada de texto se liquidan con el objeto usage del proveedor; tarifas en la sección de precios
  • Endpoint: POST /v1/images/generations, tarea asíncrona con polling o callback_url

Las mismas tarifas por token no significan la misma factura: cada nivel de calidad gasta los tokens de salida de forma distinta, y GPT Image 2.5 usa una base de teselas más baja por nivel que GPT Image 2 (su high cuesta aproximadamente lo que costaba el medium de GPT Image 2). Estima una petición en el Playground o en la calculadora de precios antes de estandarizar un nivel.

2026-09-07

Descuento ampliado | Seedance 2.0 Mini y Fast

pricing

La bajada de precio por tiempo limitado de Seedance 2.0 Mini y Seedance 2.0 Fast, que terminaba hoy, se amplía hasta el 6 de octubre de 2026 (UTC+8). Las tarifas y el nivel de descuento no cambian, y el descuento se sigue aplicando automáticamente, sin cambios en tus llamadas a la API. Seedance 2.0 Standard sigue fuera de esta promoción.

  • Seedance 2.0 Mini: 60 % de descuento
  • Seedance 2.0 Fast: 25 % de descuento

La rebaja se sigue aplicando a todas las resoluciones y a todos los modos de generación (text-to-video, image-to-video, reference-to-video). Consulta la página de precios de cada modelo para ver las tarifas vigentes.

La promoción termina ahora el 6 de octubre de 2026 (UTC+8), cuando ambos modelos volverán a su precio original.

2026-09-04

Nuevo modelo | GPT-6 Astra

models

GPT-6 Astra, el modelo más capaz de OpenAI, creado para el trabajo de extremo a extremo más exigente en razonamiento, programación, computer use e investigación, ya está disponible en EvoLink un 10 % por debajo del precio de lista de OpenAI.

GPT-6 Astra

  • ID de modelo: gpt-6-astra; no existe un alias genérico gpt-6
  • Ventana de contexto: 1 050 000 tokens y hasta 128K de salida máxima
  • Facturación: entrada sin caché, lectura de caché, escritura de caché y salida se miden por separado, cada una un 10 % por debajo del precio de lista de OpenAI. Consulta las tarifas actuales en la página del modelo GPT-6 Astra
  • Contexto largo: por encima de 272K tokens de prompt, la solicitud completa se factura a tarifas de contexto largo: 2x en entrada y en ambos roles de caché, 1,5x en salida
  • Protocolos: Chat Completions y Responses compatibles con OpenAI, con la misma clave API de EvoLink; OpenAI exige Responses para tool calling
  • Razonamiento: configura reasoning_effort (Chat) o reasoning.effort (Responses) en low, medium, high, xhigh o max; none y minimal se rechazan, y temperature / top_p no se aceptan
  • También compatible: caché de prompts y salidas estructuradas en ambas superficies
2026-09-03

Nuevo modelo | MiniMax H3 Max

models

MiniMax H3 Max —la variante de generación rápida de la familia Hailuo de MiniMax— ya está disponible en EvoLink: dos rutas, salida en 768p / 480p y facturación por segundo.

MiniMax H3 Max

  • ID de modelo: minimax-h3-max-text-to-video, minimax-h3-max-image-to-video
  • Salida: MP4 en 768p o 480p, 5–15 segundos. Relación de aspecto 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 — el texto a vídeo exige una relación explícita (16:9 por defecto)
  • Precios: $0,080 por segundo de salida en 768p y $0,050 en 480p, mismo precio en ambas rutas; el cargo mínimo equivale a la petición válida más barata (480p × 5 s, $0,25 por tarea)
  • Imagen a vídeo: envía un primer fotograma, un último fotograma o ambos. Esta ruta no permite elegir la relación de aspecto: la salida sigue siempre las proporciones de la imagen de entrada
  • Resolución por defecto: las peticiones sin quality se generan en 768p. Envía "quality": "480p" para el nivel más barato
  • No disponible en H3 Max: salida 2K, clips de 4 segundos y generación por referencia. Usa MiniMax H3 si necesitas 2K o imágenes, vídeos y audios de referencia
  • Tareas asíncronas: envía y luego consulta el estado o usa callback_url
2026-09-02

Nuevo modelo | Gemini 3.8 Flash

models

Gemini 3.8 Flash ya está disponible en EvoLink, al mismo precio que Gemini 3.7 Flash.

Es el modelo Flash más capaz de Google hasta la fecha: mejora claramente sobre 3.7 en ingeniería de software, computer use y trabajo agéntico de varios pasos, manteniendo el rendimiento y el coste de la gama Flash.

Gemini 3.8 Flash

  • ID de modelo: gemini-3.8-flash
  • Contexto: 1.048.576 tokens; salida máx.: 65.536 tokens
  • Entrada: texto, imagen, audio, vídeo, PDF; salida: texto
  • Capacidades: thinking, instrucciones de sistema, salida estructurada, caché de contexto, function calling, ejecución de código, grounding con Google Search / Maps
  • Precios: entrada $0,675/M tokens, salida $3,375/M tokens, cache hit $0,0676/M tokens (precio promocional, hasta el 31 de diciembre de 2026)
  • Endpoints: tanto /v1/chat/completions (estilo OpenAI) como la API nativa de Gemini

Los niveles de razonamiento son iguales que en 3.7

Gemini 3.8 Flash no admite el nivel minimal, igual que 3.7. Los niveles disponibles son low / medium / high, con medium por defecto.

Al migrar desde 3.7, si tu código establece reasoning_effort: "none" o "minimal" (thinkingLevel: "MINIMAL" en la API nativa), EvoLink lo baja automáticamente a low: tus solicitudes no fallarán. Para un control explícito, indica low directamente.

Además del ID del modelo, no hay que cambiar nada más: 3.8 coincide con 3.7 campo por campo en ventana de contexto, salida máxima, modalidades y precios oficiales. Si vienes de 3.6 Flash o anterior, la checklist oficial de migración de Google sigue exigiendo eliminar los valores propios de temperature, top_p, top_k y candidate_count, sustituir el thinking_budget numérico por el string thinking_level y eliminar los turnos model prellenados.

2026-09-02

Nuevo modelo | Claude Fable 5.1

models

Claude Fable 5.1 —el modelo más capaz de Anthropic, la gama Fable por encima de Opus— ya está disponible en EvoLink, un 5 % por debajo del precio oficial de tokens.

Disponibilidad

Claude Fable 5.1 se puede llamar en la API de producción de EvoLink con la misma clave de API. La página del modelo Claude Fable 5.1 es la fuente de verdad para precios y parámetros actuales.

ID del modelo

  • claude-fable-5-1 — ventana de contexto de 1.000.000 de tokens, hasta 128K de salida máxima

Dimensiones de facturación

Cinco dimensiones se miden por separado: entrada, escritura de caché, lectura de caché, salida y la herramienta de búsqueda web. Las tarifas de tokens están un 5 % por debajo del precio oficial de Anthropic; la búsqueda web se cobra por consulta a tarifa oficial sin descuento, y sus resultados cuentan además como tokens de entrada normales. Tarifas actuales en la sección de precios.

Si vienes de Claude Fable 5

Las tarifas de catálogo de Anthropic para entrada, salida y escritura de caché no cambian. La diferencia: Anthropic ha reducido la lectura de caché a una cuarta parte de la tarifa de Fable 5, así que los agentes con mucha caché y las sesiones largas de programación salen bastante más baratos. En EvoLink las otras tres tarifas quedan un 5,6 % por encima de Fable 5, porque Fable 5 va con un 10 % de descuento sobre catálogo y 5.1 con un 5 %.

Protocolos

Chat Completions compatible con OpenAI y Anthropic Messages, con la misma clave de API de EvoLink. El razonamiento está siempre activo: envía thinking: {type: "adaptive"} u omite el parámetro, y controla la profundidad con effort en lugar de parámetros de muestreo.

Probar Claude Fable 5.1 | Ver precios

2026-09-01

Actualización de precios | Claude Sonnet 5

pricing

Anthropic ha hecho permanente la bajada de precio de Claude Sonnet 5. EvoLink convierte al mismo tiempo su oferta de lanzamiento en tarifa a largo plazo: lo que pagas por token no cambia y ya no subirá cuando termine la promoción.

Qué cambia

  • El precio oficial baja de forma permanente: entrada 3,00 $ → 2,00 $/1M tokens, salida 15,00 $ → 10,00 $/1M tokens, escritura de caché 3,75 $ → 2,50 $/1M tokens, lectura de caché 0,30 $ → 0,20 $/1M tokens.
  • Tu tarifa en EvoLink no cambia. La oferta de lanzamiento que iba a terminar el 31 de agosto pasa a ser la tarifa estándar, así que no habrá subida por vencimiento.
  • El descuento mostrado se lee distinto. Se calculaba sobre el precio anterior de 3,00 $; ahora que el oficial es 2,00 $ de forma permanente, la misma tarifa de EvoLink aparece como un 10 % por debajo del oficial. El importe facturado es idéntico.

Qué no cambia

El ID del modelo sigue siendo claude-sonnet-5, con la misma ventana de contexto de 1M tokens y 128K de salida máxima, en Chat Completions compatible con OpenAI y Anthropic Messages. No hace falta modificar tus llamadas a la API. La herramienta de búsqueda web se sigue cobrando por consulta a tarifa oficial.

Las tarifas actuales están siempre en la página del modelo Claude Sonnet 5.

Claude Sonnet 5 | Ver precios