
Qwen3.8 Max Preview: funciones, Token Plan y lanzamiento
qwen3.8-max-preview, 1M tokens de contexto, razonamiento, visión, Function Calling, herramientas integradas y tres cachés. Aún no existe una API backend GA con precio estándar ni una ruta EvoLink.Comprobación del nombre: Qwen3.8 no es Qwen3-8B. Los precios, descargas y guías locales del antiguo modelo de ocho mil millones de parámetros no corresponden aqwen3.8-max-preview.
Estado de Qwen3.8 a 21 de julio de 2026
| Pregunta | Respuesta actual | Interpretación segura |
|---|---|---|
| ¿Existe una Preview oficial? | Sí | Qwen lista qwen3.8-max-preview en Token Plan. |
| ¿Es GA? | No | Puede cambiar, retirarse o sustituirse. |
| ¿Hay un ID público? | Sí | Es válido para el canal documentado, no necesariamente para EvoLink. |
| ¿Puede una clave personal alimentar un backend? | No | Se prohíben scripts automatizados, backends propios y lotes no interactivos. |
| ¿Hay precio estándar por token? | No | Los Credits son unidades de suscripción, no una tarifa API general. |
| ¿Están disponibles los Open Weights? | Todavía no | Faltan repositorio, licencia, arquitectura y fecha. |
| ¿Está Qwen3.8 en EvoLink? | Todavía no | EvoLink verifica los datos requeridos para una ruta compatible. |
“Disponible en un canal Preview” y “listo para un backend de producción” son afirmaciones distintas. ID estable, facturación, regiones, límites y ciclo de vida pueden seguir sin resolver.
Token Plan no es la API estándar de Qwen
Características confirmadas
Razonamiento con control explícito
low, medium y xhigh, con xhigh como valor predeterminado, además del tratamiento del historial de razonamiento multiturno.Una buena respuesta aislada no demuestra que un agente mantenga decisiones, resultados de herramientas y restricciones a lo largo de muchos turnos.
Generación de texto para trabajo complejo
Qwen destaca razonamiento difícil, programación, análisis de datos y productividad. Son categorías de prueba, no resultados medidos. Separe exactitud, cumplimiento de formato, finalización sin bucles y coste del resultado aceptado tras reintentos y revisión.
Comprensión visual
La lista Token Plan marca comprensión visual. Capturas, documentos, gráficos y entradas mixtas son objetivos válidos, pero no confirman todos los formatos, tamaños, duraciones o capacidades de una futura ruta EvoLink.
Herramientas integradas
Qwen documenta búsqueda web, intérprete de código, extracción web, búsqueda inversa de imágenes y búsqueda de imágenes mediante texto. Un resultado puede depender del modelo, retrieval, intérprete o entorno completo. Evalúe razonamiento y workflow asistido por separado.

Anunciado pero no documentado por completo
Qwen describe Qwen3.8 como un modelo de 2,4 billones de parámetros, planea Open Weights y lo sitúa cerca de la frontera. Son señales importantes, no una ficha técnica completa.
| Anuncio | Qué indica | Qué falta |
|---|---|---|
| 2,4 billones de parámetros | Gran aumento de escala | Parámetros activos, expertos, entrenamiento, eficiencia |
| Plan Open Weights | Podría llegar una vía autoalojada | Repositorio, archivos, licencia, fecha, hardware, variantes |
| Posicionamiento frontier | Qwen espera un salto de capacidad | Tablas, metodología, replicación, latencia y coste |
El total de parámetros no determina por sí solo calidad, coste de serving, longitud de salida, recuperación de herramientas o estabilidad.
Límites relevantes para producción
El ID puede cambiar
qwen3.8-max-preview es un ID oficial de Token Plan. Una versión final puede usar otro alias. Mantenga la selección del modelo en configuración.Los Credits no son precios por token
Miden consumo de suscripción y pueden incluir multiplicadores temporales. Espere el precio de cada ruta y calcule coste por tarea aceptada.
El contexto depende del canal
La lista actual de Qwen documenta 1M tokens para la Preview de Token Plan. Es un límite confirmado del canal, no una prueba de recuperación fiable en cualquier posición ni una garantía para una futura ruta EvoLink.
El plan personal no es una ruta backend
El comportamiento se verifica por ruta
Límites, regiones, salida estructurada, streaming, caché, batch, herramientas y facturación de fallos pueden variar. No copie valores de Qwen3.7.
Qwen3.8 ofrece tres modos de caché
| Caché | Creación | Acierto | Mínimo | Uso |
|---|---|---|---|---|
| Explícita | 125 % | 10 % | 1.024 tokens | cache_control manual |
| Implícita | 100 % | 20 % | 256 tokens | Prefijo detectado automáticamente |
| Sesión | 125 % | 10 % | 1.024 tokens | Conversación en Responses API |
Son reglas del canal Qwen, no todavía de la ruta EvoLink.
¿Quién debería preparar Qwen3.8 ahora?
Empiece si su equipo ejecuta programación a escala de repositorio o agentes largos, puede comparar con una base estable, dispone de tests o rúbrica clara y tolera cambios con fallback.
Espere para producción si necesita un ID versionado, presupuesto predecible, garantías regionales o de límites, no puede detectar fallos silenciosos o carece de rollback.
Preparación antes de una API de producción
Congele prompts, criterios de aceptación y baselines. No ejecute una evaluación grande de pago hasta que exista una ruta de producción con precios y derechos de uso claros.
| Carga | Ejemplo | Medida |
|---|---|---|
| Código de repositorio | Bugfix multifichero con tests | Aceptación, cambios innecesarios, reintentos, revisión |
| Agente | Herramientas con un fallo inyectado | Exactitud, recuperación, bucles, intervención |
| Visión | Captura UI o documento | Grounding, detalles omitidos, extracción |
| Contexto largo | Repositorio o documentos extensos | Recuerdo, instrucciones, contradicciones |
| Datos | Tabla a informe | Exactitud numérica, evidencia, artefacto |
| Rutina | Pequeña edición | Valor frente a una ruta más barata |
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repairPreparación en EvoLink
- Únase a la página de acceso anticipado.
- Cree un conjunto fijo con una ruta disponible como Kimi K3.
- Guarde prompts, esquemas, criterios y artefactos independientemente del proveedor.
- Mantenga la selección del modelo configurable por tarea.
- Repita las mismas tareas tras la activación y compare aceptación, latencia, fiabilidad y coste.
Preguntas frecuentes
¿Qwen3.8 se ha lanzado oficialmente?
Qwen3.8 Max Preview figura oficialmente desde el 21 de julio de 2026, pero sigue siendo una Preview cambiante, no un GA final.
¿Cuál es el ID de la Preview?
qwen3.8-max-preview. Es específico del canal y no garantiza el ID final ni el de EvoLink.¿Qwen3.8 es lo mismo que Qwen3-8B?
No. Qwen3.8 es la versión de familia de 2026; Qwen3-8B es un modelo anterior de ocho mil millones de parámetros.
¿Qué diferencia hay entre Token Plan y el acceso API?
Token Plan es una suscripción con Credits para herramientas interactivas. Una API estándar sirve aplicaciones automatizadas y factura tokens.
¿Qué caché de Qwen3.8 debería usar?
La implícita es el inicio más sencillo, la explícita sirve para prefijos controlados y la de sesión para conversaciones en Responses API. Verifica siempre la ruta real.
¿Está Qwen3.8 en EvoLink?
Todavía no. EvoLink no ha publicado ruta, precio ni ID compatible.
¿Qwen3.8 admite imágenes?
La lista Token Plan indica comprensión visual. Formatos, tamaños y comportamiento deben confirmarse por endpoint.
¿Qwen3.8 es Open Source u Open Weight?
Qwen planea Open Weights; repositorio, archivos, licencia, arquitectura y fecha seguían sin confirmar el 21 de julio de 2026.
¿Cuánto cuesta Qwen3.8?
La suscripción y los Credits son públicos, pero no el precio estándar por token ni el de EvoLink. No convierta Credits en una tarifa supuesta.
¿Es mejor que Qwen3.7 Max?
Qwen lo presenta como avance, pero los equipos deben esperar evidencia completa y probar sus cargas. Qwen3.7 sigue siendo la base mejor documentada.
¿Hay que esperar a Qwen3.8 para lanzar?
No. Use un modelo compatible, conserve fallback y prepare pruebas reproducibles. Migre solo tras validar ruta, precio, límites y resultados.


