Qwen3.8-Max-Preview - API compatible con Anthropic
🚧 Este modelo aun no esta disponible, mantente atento
- Llama a Qwen3.8-Max-Preview mediante el protocolo Anthropic Messages
- Prompt de sistema: se define mediante el campo
systemde nivel superior (no se coloca dentro de messages) - Entrada multimodal:
contentacepta un array de bloques de contenido, admitetext/image - Caché de contexto: añade
cache_controlen un bloque de contenido para declarar caché explícita; consulta aciertos / creaciones enusage.cache_read_input_tokens/usage.cache_creation_input_tokensde la respuesta - Modo de pensamiento: se activa mediante
thinking, el pensamiento se devuelve en streaming como bloques de contenidothinking - Salida en streaming: cuando
stream=true, se devuelve según los eventos SSE de Anthropic (message_start/content_block_delta/message_delta, etc.)
https://direct.evolink.ai, que ofrece mejor soporte para modelos de texto y admite conexiones persistentes; https://api.evolink.ai es la dirección principal multimodal, úsala cuando incluyas entrada de imagen.Autorizaciones
##Todas las API requieren autenticación con Bearer Token##
Obtener la API Key:
Visita la página de gestión de API Keys para obtener tu API Key
Añadir al encabezado de la solicitud:
Cuerpo
Nombre del modelo de chat
qwen3.8-max-preview "qwen3.8-max-preview"
Número máximo de tokens del contenido generado.
Obligatorio (lo exige el protocolo Anthropic). Si el modelo genera más que este valor, se truncará.
1024
Lista de mensajes de la conversación (sin system). Cada mensaje incluye role (user / assistant) y content (una cadena o un array de bloques de contenido).
Prompt de sistema. Usa una cadena para texto plano; usa un array de bloques de contenido cuando necesites declarar caché explícita (añade cache_control en el bloque).
Temperatura de muestreo, rango [0, 2].
0 <= x <= 2Parámetro de muestreo de núcleo, rango (0, 1].
0 <= x <= 1Muestrea de los K tokens de mayor probabilidad.
Secuencias de parada personalizadas; la generación se detiene al encontrar una.
Indica si se devuelve en streaming como eventos SSE de Anthropic.
Configuración del pensamiento profundo. Al activarlo, el modelo devuelve el proceso de pensamiento como bloques de contenido thinking.
Lista de definiciones de herramientas (formato de tools de Anthropic), para Function Calling.
Respuesta
Generado correctamente
"msg_xxxxxxxx"
"message"
"assistant"
"qwen3.8-max-preview"
Array de bloques de contenido de la respuesta
Motivo de parada: end_turn (finalización normal), max_tokens (se alcanzó el límite), stop_sequence (se encontró una secuencia de parada), tool_use (se requiere llamar a una herramienta)
"end_turn"
Estadísticas de uso de tokens (semántica de Anthropic: input_tokens no incluye la caché y se suma de forma excluyente con los campos de cache).