Seedance 2.5 ya está disponible en EvoLinkProbar Seedance 2.5
Entorno abstracto para evaluar la versión oficial de Qwen3.8 Max en programación, visión y agentes
model-release

Qwen3.8 Max ya está disponible: funciones, contexto 1M y estado API

Jacey
Jacey
Founder
21 de julio de 2026
Actualizado el 3 de agosto de 2026
9 min de lectura
Respuesta rápida: QwenCloud lanzó qwen3.8-max como modelo insignia oficial el 3 de agosto de 2026. Están confirmados el contexto 1M, Thinking, Function Calling, herramientas integradas y Structured Output. EvoLink ofrece la ruta de producción qwen3.8-max; la URL de documentación conserva el slug Preview histórico.

Estado a 3 de agosto de 2026

CapaEstadoConsecuencia
QwenCloudqwen3.8-max oficialLos hechos upstream ya están confirmados
Previewqwen3.8-max-preview queda como canal históricoNo asumir que sea el ID final de EvoLink
Open Weights/licenciaanunciados; artefactos y licencia sin verificarNo afirmar todavía que se puede autoalojar
EvoLinkruta de producción qwen3.8-max disponibleVerificar página del producto, precio live y smoke test de la cuenta antes de producción

Las secciones de Preview que siguen se conservan como historial de migración; prevalece este estado.

Token Plan no es la API estándar de Qwen

Token Plan es una suscripción con clave, Credits y cuotas propias para herramientas interactivas de programación y agentes. La página oficial muestra promociones actuales de 6, 18 y 68 dólares al mes. No son precios API por token y la clave no debe usarse en backends automatizados.

Características confirmadas

Razonamiento con control explícito

Qwen clasifica la Preview como modelo de razonamiento. La referencia de Chat API documenta low, medium y xhigh, con xhigh como valor predeterminado, además del tratamiento del historial de razonamiento multiturno.

Una buena respuesta aislada no demuestra que un agente mantenga decisiones, resultados de herramientas y restricciones a lo largo de muchos turnos.

Generación de texto para trabajo complejo

Qwen destaca razonamiento difícil, programación, análisis de datos y productividad. Son categorías de prueba, no resultados medidos. Separe exactitud, cumplimiento de formato, finalización sin bucles y coste del resultado aceptado tras reintentos y revisión.

Comprensión visual

La lista Token Plan marca comprensión visual. Capturas, documentos, gráficos y entradas mixtas son objetivos válidos, pero no confirman todos los formatos, tamaños, duraciones o capacidades de una futura ruta EvoLink.

Herramientas integradas

Qwen documenta búsqueda web, intérprete de código, extracción web, búsqueda inversa de imágenes y búsqueda de imágenes mediante texto. Un resultado puede depender del modelo, retrieval, intérprete o entorno completo. Evalúe razonamiento y workflow asistido por separado.

Workflow de evaluación de Qwen3.8 Max que separa razonamiento, herramientas, comportamiento de ruta y aceptación
Workflow de evaluación de Qwen3.8 Max que separa razonamiento, herramientas, comportamiento de ruta y aceptación

Anunciado pero no documentado por completo

Qwen describe Qwen3.8 como un modelo de 2,4 billones de parámetros, planea Open Weights y lo sitúa cerca de la frontera. Son señales importantes, no una ficha técnica completa.

AnuncioQué indicaQué falta
2,4 billones de parámetrosGran aumento de escalaParámetros activos, expertos, entrenamiento, eficiencia
Plan Open WeightsPodría llegar una vía autoalojadaRepositorio, archivos, licencia, fecha, hardware, variantes
Posicionamiento frontierQwen espera un salto de capacidadTablas, metodología, replicación, latencia y coste

El total de parámetros no determina por sí solo calidad, coste de serving, longitud de salida, recuperación de herramientas o estabilidad.

Límites relevantes para producción

El ID puede cambiar

qwen3.8-max-preview fue el ID de Token Plan; el ID upstream de producción es qwen3.8-max. Mantenga configurable el ID final de EvoLink.

Los Credits no son precios por token

Miden consumo de suscripción y pueden incluir multiplicadores temporales. Espere el precio de cada ruta y calcule coste por tarea aceptada.

El contexto depende del canal

El catálogo de producción de Qwen documenta 1M tokens para qwen3.8-max. No demuestra recuperación fiable en cualquier posición ni garantiza límites idénticos en la futura ruta EvoLink.

El plan personal no es una ruta backend

Está limitado a herramientas interactivas de programación y agentes. Separe acceso de evaluación y API de producción aprobada.

El comportamiento se verifica por ruta

Límites, regiones, salida estructurada, streaming, caché, batch, herramientas y facturación de fallos pueden variar. No copie valores de Qwen3.7.

Qwen3.8 ofrece tres modos de caché

CachéCreaciónAciertoMínimoUso
Explícita125 %10 %1.024 tokenscache_control manual
Implícita100 %20 %256 tokensPrefijo detectado automáticamente
Sesión125 %10 %1.024 tokensConversación en Responses API

Son reglas del canal Qwen, no todavía de la ruta EvoLink.

¿Quién debería preparar Qwen3.8 ahora?

Empiece si su equipo ejecuta programación a escala de repositorio o agentes largos, puede comparar con una base estable, dispone de tests o rúbrica clara y tolera cambios con fallback.

Espere para producción si necesita un ID versionado, presupuesto predecible, garantías regionales o de límites, no puede detectar fallos silenciosos o carece de rollback.

Preparación antes de una API de producción

Congele prompts, criterios de aceptación y baselines. No ejecute una evaluación grande de pago hasta que exista una ruta de producción con precios y derechos de uso claros.

CargaEjemploMedida
Código de repositorioBugfix multifichero con testsAceptación, cambios innecesarios, reintentos, revisión
AgenteHerramientas con un fallo inyectadoExactitud, recuperación, bucles, intervención
VisiónCaptura UI o documentoGrounding, detalles omitidos, extracción
Contexto largoRepositorio o documentos extensosRecuerdo, instrucciones, contradicciones
DatosTabla a informeExactitud numérica, evidencia, artefacto
RutinaPequeña ediciónValor frente a una ruta más barata
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repair
  1. Confirme la ruta, el ID qwen3.8-max y el precio en vivo en la página del producto.
  2. Decida si el contexto largo, los repositorios grandes o los agentes con herramientas justifican una ruta frontier.
  3. Cree un conjunto fijo con una ruta existente como Kimi K3 y conserve los criterios de aceptación.
  4. Ejecute un smoke test mínimo con la guía de API y repita las mismas tareas.
  5. Compare aceptación, latencia, reintentos, corrección humana y coste por tarea aceptada, manteniendo un fallback.

Los términos Preview y las preguntas técnicas siguen siendo útiles

El lanzamiento de producción no elimina configuraciones, evaluaciones y búsquedas antiguas.

Separar producción, Preview y checkpoints anteriores

TérminoSignificado actualLo que no demuestra
qwen3.8-maxID de producción QwenCloudQue EvoLink deba usar el mismo ID
qwen3.8-max-previewID histórico de Token Plan y borrador EvoLinkQue upstream siga siendo solo Preview
Qwen3.8 Token PlanSuscripción para herramientas interactivas compatiblesClave backend general o contrato de precio EvoLink
Qwen3-8BCheckpoint anterior de 8BOtra escritura de Qwen3.8
Open WeightsArtefacto futuro anunciadoLicencia, checkpoint o hardware ya verificados

El caché también afecta el coste. Verifique estabilidad del prefijo, duración, coste de creación frente a hits e input añadido por el historial de Thinking. Pruebe 32K, 128K, 256K y el máximo real: 1M no garantiza recuperación ni economía.

PruebaEvidencia requerida
Caché implícito/explicitoUsage y factura en repeticiones controladas
SesiónEstado, herramientas y latencia multivuelta
Structured OutputSchema estricto, errores y reparaciones
VisionFormatos, grounding y detalles inventados
Ruta EvoLinkEndpoint, campos, límites, errores y precio tras activación

La preparación para producción pertenece a la ruta concreta. Las funciones upstream no sustituyen formatos multimedia, Rate Limits, regiones, facturación, errores, latencia y lifecycle verificados.

Tu siguiente decisión

Del anuncio a una prueba de API justificada

No te registres solo por el anuncio. Resuelve primero estas preguntas y crea una clave API únicamente si la ruta encaja con tu carga.

  1. 01

    ¿Se lanzó?

    Sí. Qwen3.8 Max es el modelo de producción; Preview queda como contexto histórico.

  2. 02

    ¿Está disponible?

    Sí, en EvoLink. Confirma la ruta activa y el ID en la página del producto.

  3. 03

    ¿Me conviene?

    Para razonamiento de contexto largo, repositorios grandes y agentes con herramientas; las tareas simples deben usar una ruta menor.

  4. 04

    ¿Cuánto cuesta?

    Consulta el módulo de precios en vivo del producto; no reutilices precios upstream o del plan Preview.

  5. 05

    ¿Cómo se llama?

    Elige Chat Completions, Responses o Messages y sigue la guía de integración y la referencia de parámetros.

¿Completaste las cinco comprobaciones? Crear una clave API.

Preguntas frecuentes

¿Qwen3.8 se ha lanzado oficialmente?

Sí. QwenCloud añadió qwen3.8-max a su registro y catálogo de producción el 3 de agosto de 2026. EvoLink gestiona la ruta de producción por separado de la documentación Preview histórica.

¿Cuál es el ID de la Preview?

QwenCloud y EvoLink usan qwen3.8-max para la ruta de producción; qwen3.8-max-preview es el ID histórico de Token Plan y documentación.

¿Qwen3.8 es lo mismo que Qwen3-8B?

No. Qwen3.8 es la versión de familia de 2026; Qwen3-8B es un modelo anterior de ocho mil millones de parámetros.

¿Qué diferencia hay entre Token Plan y el acceso API?

Token Plan es una suscripción con Credits para herramientas interactivas. Una API estándar sirve aplicaciones automatizadas y factura tokens.

Sí. La ruta de producción de EvoLink usa qwen3.8-max. Revise la página del producto y el precio en vivo y ejecute un smoke test en su cuenta antes del tráfico de producción.

¿Qwen3.8 admite imágenes?

Qwen describe el modelo de producción como vision-language nativo. Formatos, tamaños, límites multimedia y conducta de EvoLink deben verificarse por ruta.

¿Qwen3.8 es Open Source u Open Weight?

Qwen anunció Open Weights, pero repositorio, checkpoints, licencia y guía de despliegue no estaban verificados el 3 de agosto.

¿Cuánto cuesta Qwen3.8?

Separe el precio upstream de QwenCloud del precio de ruta EvoLink. Presupueste con el precio live del canal usado y el coste por tarea aceptada, no con Credits de Token Plan.

¿Es mejor que Qwen3.7 Max?

Qwen lo presenta como avance, pero los equipos deben esperar evidencia completa y probar sus cargas. Qwen3.7 sigue siendo la base mejor documentada.

¿Hay que esperar a Qwen3.8 para lanzar?

No. Use un modelo compatible, conserve fallback y prepare pruebas reproducibles. Migre solo tras validar ruta, precio, límites y resultados.

Fuentes

Siguiente paso: implementar la ruta

Convierte el plan de funciones en solicitudes ejecutables con la guía de integración Qwen3.8 Max para Chat, Responses y Messages.

¿Listo para reducir tus costos de IA en un 89%?

Comienza a usar EvoLink hoy y experimenta el poder del enrutamiento inteligente de API.