
Cómo usar Kimi K3 en EvoLink: guía de integración y migración

Veredicto rápido: Kimi K3 ya es un modelo oficial. Moonshot ha publicado el ID de su API directa, los precios, la compatibilidad multimodal y una ventana de contexto de 1.048.576 tokens. Está diseñado para ingeniería de software de largo recorrido, agentes complejos y trabajo intensivo con conocimiento, no para sustituir automáticamente a modelos económicos de uso diario.
El precio refleja esa posición: ¥20 por millón de tokens de entrada sin caché y ¥100 por millón de tokens de salida en la API directa de Moonshot. Para cargas habituales, K3 cuesta aproximadamente entre tres y cuatro veces más que Kimi K2.6.
kimi-k3. Consulta los precios y el posicionamiento en la página de Kimi K3, y usa la documentación API de EvoLink para el contrato de solicitud actual.Datos oficiales de Kimi K3
| Campo | Información confirmada | Implicación |
|---|---|---|
| ID directo | kimi-k3 | Pertenece a Moonshot, no confirma el ID de EvoLink |
| Tamaño | 2,8 billones totales, 104.000 millones activos | La activación dispersa mejora el cálculo, pero el conjunto completo de expertos sigue siendo muy grande |
| Arquitectura | Kimi Delta Attention + Attention Residuals | Orientada a eficiencia y tareas largas |
| Contexto | 1.048.576 tokens | Repositorios y colecciones documentales grandes |
| Modalidades | Texto, imagen y vídeo | Permite revisión multimodal |
| Razonamiento | Siempre activo | Puede elevar coste y latencia en tareas simples |
| Control | reasoning_effort: low, high, max; max por defecto | Permite evaluar calidad, latencia y coste de salida |
| Herramientas | Tool Calling, tool_choice y carga dinámica | Adecuado para catálogos amplios de herramientas |
| Pesos abiertos | Repositorio de unos 1,56 TB bajo la licencia Kimi K3 | El autoalojamiento está permitido sujeto a la licencia, pero exige infraestructura a escala |
IDs de modelo y canales de acceso
| Canal | ID de modelo | Contexto y acceso |
|---|---|---|
| Moonshot Open Platform | kimi-k3 | API directa de hasta 1.048.576 tokens |
| Kimi Code | k3 | Moderato: 256K; Allegretto o superior: hasta 1M |
| Kimi Code estándar | kimi-for-coding | K2.7 Code, no K3 |
| Kimi Code de alta velocidad | kimi-for-coding-highspeed | K2.7 Code rápido, requiere Allegretto o superior |
| EvoLink | kimi-k3 | Ruta de producción verificada con comportamiento documentado |
kimi-k3 corresponde a la API directa y k3 a Kimi Code. Un límite de 256K o un error 401 en Kimi Code puede depender del plan. Al cambiar de modelo conviene iniciar una sesión nueva porque la caché de contexto anterior no se conserva.
Precios y ejemplos de coste
| Categoría | Precio directo de Moonshot por 1M tokens |
|---|---|
| Entrada con caché | ¥2 |
| Entrada sin caché | ¥20 |
| Salida | ¥100 |
| Ejemplo | Sin caché de entrada | Con caché |
|---|---|---|
| 20K entrada + 5K salida | ¥0,90 | ¥0,54 |
| 100K entrada + 20K salida | ¥4,00 | ¥2,20 |
| 500K entrada + 50K salida | ¥15,00 | ¥6,00 |
| 1M entrada + 100K salida | ¥30,00 | ¥12,00 |
Quién debería probarlo
| Caso de uso | Prioridad | Motivo |
|---|---|---|
| Agentes de código sobre repositorios grandes | Alta | El contexto de 1M encaja con trabajo a escala de repositorio |
| Investigación con muchos documentos | Alta | Reduce parte de la segmentación manual |
| Agentes con numerosas herramientas | Alta | La carga dinámica mejora coste y selección |
| Revisión multimodal | Media-alta | Admite texto, imágenes y vídeo |
| Chat de soporte y clasificación | Baja | El razonamiento permanente puede ser excesivo |
| Autohospedaje | Evaluar de forma selectiva | Los pesos y la licencia son públicos; Moonshot recomienda 64 o más aceleradores para inferencia eficiente |
Cambios técnicos importantes
reasoning_effort, no el parámetro thinking de K2.x. En conversaciones y bucles de herramientas se debe conservar el mensaje completo del assistant, incluido reasoning_content. Cambiar únicamente el nombre del modelo puede romper el flujo.Para agentes con muchas herramientas, el patrón recomendado es:
- Exponer una herramienta de búsqueda y unas pocas herramientas básicas.
- Buscar la herramienta adecuada.
- Cargar dinámicamente solo su definición.
- Devolver el resultado con el
tool_call_idcorrecto. - Mantener el mensaje completo del assistant en el historial.
Cómo evaluarlo en producción
Prepara entre 20 y 50 tareas reales: análisis de repositorios, cambios en varios archivos, síntesis documental, salidas estructuradas, visión y Tool Calling. Compara éxito, latencia, tokens, reintentos y esfuerzo de revisión con tu ruta actual.
Lo que aún no está confirmado
- benchmarks independientes con arneses comparables;
- impacto de la licencia Kimi K3 en el producto;
- rendimiento real de la topología de expertos elegida;
- calidad real utilizando todo el contexto de 1M;
- facturación de solicitudes fallidas;
- coste de producción por carga en la ruta de EvoLink.
Continuar la evaluación de Kimi K3
| Siguiente decisión | Guía |
|---|---|
| Empezar con tareas reutilizables y documentadas | Prompts y casos de uso de Kimi K3 |
| Comparar K3 con la ruta de código insignia de OpenAI | Kimi K3 vs GPT-5.6 Sol |
| Comparar K3 con la ruta premium de Anthropic para tareas largas | Kimi K3 vs Claude Opus 4.8 |
| Medir latencia, salida, caché y coste por tarea completada | Eficiencia de tokens de Kimi K3 |
Preguntas frecuentes
¿Kimi K3 ya se ha lanzado?
Sí. Moonshot lo incluyó en su documentación oficial el 16 de julio de 2026.
¿Cuál es su ventana de contexto?
1.048.576 tokens según Moonshot.
¿Se puede desactivar el razonamiento?
reasoning_effort admite low, high y max, con max como valor predeterminado.¿Cuánto cuesta Kimi K3?
Moonshot cobra ¥2/MTok de entrada con caché, ¥20/MTok sin caché y ¥100/MTok de salida.
¿Kimi K3 es open source?
Moonshot publica los pesos completos bajo la licencia personalizada Kimi K3. «Pesos abiertos bajo la licencia Kimi K3» es más preciso que asumir una licencia open source estándar.
¿Está disponible Kimi K3 en EvoLink?
kimi-k3 el 17 de julio de 2026; consulta la página del modelo para los precios actuales. Para evaluar la próxima generación de xAI, la comparativa Grok 4.6 vs Kimi K3 mantiene K3 como base de producción invocable.¿kimi-for-coding es Kimi K3?
k3 en clientes y planes compatibles.

