
Qwen3.8 vs Kimi K3: programación, agentes, contexto y madurez de API
Comprobación del nombre: Qwen3.8 Max Preview no es Qwen3-8B. Los precios, benchmarks y guías de despliegue del antiguo modelo de ocho mil millones de parámetros no describen Qwen3.8.
Resumen de decisión
| Situación | Mejor opción actual | Motivo |
|---|---|---|
| Lanzar mediante EvoLink ahora | Kimi K3 | Hay ruta, ID, precio y documentación. |
| Probar la nueva Preview de Qwen | Qwen3.8 Max Preview | Listada para razonamiento, visión y texto. |
| Prever el coste API | Kimi K3 | No hay tarifa estándar de Qwen3.8. |
| Necesitar ID estable | Kimi K3 | El ID Qwen es provisional. |
| Planear Open Weights | Esperar evidencia | Falta el paquete Qwen; verifique aparte el estado de pesos de Kimi. |
| Elegir el mejor agente de código | Pruebas equivalentes | Las demos no sustituyen repositorio, herramientas y criterios. |
Hechos confirmados a 21 de julio de 2026
| Área | Qwen3.8 Max Preview | Kimi K3 | Implicación |
|---|---|---|---|
| Etapa | Preview de Token Plan | Modelo API publicado | Kimi tiene una vía de producción más madura. |
| ID | qwen3.8-max-preview | kimi-k3 | No suponga que el ID Qwen sobreviva a GA. |
| EvoLink | No disponible | Disponible | Kimi para tráfico real; Qwen para evaluación. |
| Backend | El plan personal prohíbe backends y automatización | API de producción documentada | Preview no equivale a API desplegable. |
| Modalidades | Razonamiento, visión, texto | Texto, imagen y vídeo | Los contratos de canal difieren. |
| Contexto | 1M en la lista actual de Qwen | 1.048.576 en documentación Moonshot | Ambos rondan 1M; hay que probar la calidad real de recuperación. |
| Razonamiento | low, medium, xhigh | siempre activo; low, high, max | Compare ajustes que realmente pueda lanzar. |
| Precio | Credits sin tarifa estándar | Entrada con/sin caché y salida publicadas | Comparar tokens numéricamente es prematuro. |
| Riesgo de ciclo de vida | La Preview puede cambiar o ser reemplazada | Existe una ruta de producción, pero hay que vigilar el comportamiento nuevo | Mantenga fallback y la elección de modelo en configuración. |
Programación: potencial frente a ruta comprobable
Qwen posiciona Qwen3.8 como avance en programación y trabajo complejo. Kimi K3 ya tiene API y ruta EvoLink. Su ventaja práctica es que hoy puede medir la tarea exacta, consumo, latencia y aceptación.
| Prueba | Criterio | Qué separa |
|---|---|---|
| Bugfix en repositorio | Causa resuelta, tests verdes, sin cambios ajenos | Diagnóstico y disciplina |
| Función transversal | Interfaces coherentes, migración y rollback completos | Planificación de dependencias |
| Revisión sutil | Defecto sembrado detectado y corregido | Juicio, no volumen |
| Frontend | Calidad, responsive, accesibilidad, mantenimiento | Demo frente a producción |
| Tarea larga con herramientas | Llamadas correctas, recuperación, sin bucles | Fiabilidad del agente |
No compare un cliente Qwen con herramientas integradas frente a una llamada Kimi desnuda. Registre cliente, herramientas, preparación de contexto, esfuerzo de razonamiento y reintentos.
Agentes: el entorno cambia el resultado
Qwen documenta búsqueda web, intérprete de código y extracción. Kimi documenta tool calling y exige conservar bien el estado en bucles largos. Mantenga iguales objetivo, permisos, estado, tiempo, presupuesto y rúbrica.
| Capa del agente | Qué mantener constante | Señal de fallo |
|---|---|---|
| Objetivo y prompt | Misma tarea, restricciones, archivos y definición de finalización | Un modelo recibe instrucciones más claras. |
| Permisos de herramientas | Mismas herramientas y límites para acciones destructivas | Un modelo parece mejor porque dispone de mejores herramientas. |
| Estado | Conservar el historial necesario de assistant, razonamiento y herramientas | El modelo entra en bucle o pierde decisiones previas. |
| Tiempo y presupuesto | Mismo timeout y presupuesto por tarea aceptada | Una ruta consume recursos sin límite para terminar. |
| Rúbrica del revisor | Mismas definiciones de aprobado, fallo y gravedad | La preferencia sustituye a la evaluación. |
Mida finalización sin ayuda, llamadas inválidas, recuperación, bucles, intervenciones, tiempo aceptado y defectos.

Contexto: el tamaño solo permite entrar
Kimi documenta 1.048.576 tokens. Qwen muestra casi un millón en una configuración oficial, pero no es aún una especificación general. Pruebe localización de evidencia, retención de instrucciones, contradicciones y eficiencia de caché a 64K, 256K, 512K y el tamaño real.
Trabajo multimodal
Qwen indica comprensión visual; Moonshot documenta texto, imagen y vídeo para Kimi K3. Use los mismos activos, separe OCR y razonamiento, exija evidencia visual y cuente omisiones e invenciones. No atribuya formatos o límites no documentados.
Madurez API: Kimi lidera por evidencia
| Gate | Qwen3.8 | Kimi K3 |
|---|---|---|
| Ruta EvoLink estable | Pendiente | Confirmada |
| ID de modelo EvoLink | Pendiente | Confirmado en la página y documentación |
| Precio de EvoLink | Pendiente | Publicado en la página del modelo |
| Ejemplos de producción | Pendientes | Disponibles |
| Límites y regiones | Verificar futura ruta | Verificar cuenta actual |
| Prueba de fallback | Aún imposible en EvoLink | Posible ahora |
Esto no demuestra que Kimi sea intrínsecamente mejor. Demuestra que un equipo puede presupuestarlo, integrarlo, observarlo y revertirlo hoy.
Coste por tarea exitosa
accepted_task_cost = input + cached_input + output + tools + retries + fallback + reviewer_timePolítica de ruteo recomendada
| Rol | Candidato | Condición |
|---|---|---|
| Producción de contexto largo/multimodal | Kimi K3 | Aceptación, fiabilidad y coste cumplen objetivos |
| Evaluación nueva generación Qwen | Qwen3.8 fuera de EvoLink | Sin dependencia de clientes; registrar límites |
| Futuro challenger | Qwen3.8 en EvoLink | Pruebas equivalentes y ruta verificada |
| Fallback | Ruta Claude o GPT compatible | Fallo y rollback probados antes del lanzamiento |
| Rutina sensible al coste | Modelo menor | Frontier solo donde aporta valor medible |
Espere a Qwen3.8 si Qwen, Open Weights o su ecosistema son estratégicos y el calendario tolera incertidumbre. No espere si ya puede lanzar con un modelo compatible o necesita ID, facturación y rollback estables.
Cuándo conviene esperar a Qwen3.8
Espera si estandarizar en Qwen es estratégico y puedes mantener una migración reversible. No pruebes la API de Qwen3.8 hasta que exista una ruta apta para producción; mientras tanto Kimi K3 puede ser la baseline real.
Preguntas frecuentes
¿Es Qwen3.8 mejor que Kimi K3?
Falta evidencia de producción comparable. Pruebe las mismas tareas en el entorno que vaya a lanzar.
¿Cuál usar hoy para programación?
Kimi K3 para una ruta EvoLink disponible; Qwen3.8 aparte para evaluación Preview.
¿Cuál tiene más contexto?
Moonshot documenta 1.048.576 tokens. Qwen muestra casi un millón en una integración oficial, valor específico del canal por ahora.
¿Cuál es más barato?
Kimi tiene precios publicados. Qwen3.8 usa Credits y promociones; no hay comparación justa por token.
¿Ambos son multimodales?
Kimi documenta texto, imagen y vídeo; Qwen, comprensión visual. Formatos y límites se verifican por ruta.
¿Está Qwen3.8 en EvoLink?
¿Debo migrar desde Kimi cuando salga?
No automáticamente. Repita la carga, compare aceptación, fiabilidad, latencia y coste, y conserve fallback.
¿Cómo comparar agentes?
Mida finalización sin ayuda, validez de herramientas, recuperación, bucles, intervenciones, tiempo y defectos con iguales permisos y presupuesto.


