curl --request POST \
--url https://direct.evolink.ai/v1/messages \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "qwen3.8-max",
"max_tokens": 1024,
"system": "You are a helpful assistant.",
"messages": [
{
"role": "user",
"content": "Hola, preséntate"
}
]
}
'{
"id": "msg_xxxxxxxx",
"type": "message",
"role": "assistant",
"model": "qwen3.8-max",
"content": [
{
"type": "text",
"text": "¡Hola! Soy Tongyi Qianwen Qwen3.8-Max."
}
],
"stop_reason": "end_turn",
"usage": {
"input_tokens": 12,
"output_tokens": 104,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}{
"type": "error",
"error": {
"type": "invalid_request_error",
"message": "max_tokens is required"
}
}{
"type": "error",
"error": {
"type": "authentication_error",
"message": "Invalid or expired token"
}
}{
"type": "error",
"error": {
"type": "insufficient_quota",
"message": "Insufficient credits"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}Qwen3.8-Max - API compatible con Anthropic
- Llama a Qwen3.8-Max mediante el protocolo Anthropic Messages
- Prompt de sistema: se define mediante el campo
systemde nivel superior (no se coloca dentro de messages) - Entrada multimodal:
contentacepta un array de bloques de contenido, admitetext/image - Caché de contexto: añade
cache_controlen un bloque de contenido para declarar caché explícita; consulta aciertos / creaciones enusage.cache_read_input_tokens/usage.cache_creation_input_tokensde la respuesta - Modo de pensamiento: se activa mediante
thinking, el pensamiento se devuelve en streaming como bloques de contenidothinking - Salida en streaming: cuando
stream=true, se devuelve según los eventos SSE de Anthropic (message_start/content_block_delta/message_delta, etc.)
curl --request POST \
--url https://direct.evolink.ai/v1/messages \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "qwen3.8-max",
"max_tokens": 1024,
"system": "You are a helpful assistant.",
"messages": [
{
"role": "user",
"content": "Hola, preséntate"
}
]
}
'{
"id": "msg_xxxxxxxx",
"type": "message",
"role": "assistant",
"model": "qwen3.8-max",
"content": [
{
"type": "text",
"text": "¡Hola! Soy Tongyi Qianwen Qwen3.8-Max."
}
],
"stop_reason": "end_turn",
"usage": {
"input_tokens": 12,
"output_tokens": 104,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}{
"type": "error",
"error": {
"type": "invalid_request_error",
"message": "max_tokens is required"
}
}{
"type": "error",
"error": {
"type": "authentication_error",
"message": "Invalid or expired token"
}
}{
"type": "error",
"error": {
"type": "insufficient_quota",
"message": "Insufficient credits"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}https://direct.evolink.ai, que ofrece mejor soporte para modelos de texto y admite conexiones persistentes; https://api.evolink.ai es la dirección principal multimodal, úsala cuando incluyas entrada de imagen.Autorizaciones
##Todas las API requieren autenticación con Bearer Token##
Obtener la API Key:
Visita la página de gestión de API Keys para obtener tu API Key
Añadir al encabezado de la solicitud:
Authorization: Bearer YOUR_API_KEY
Cuerpo
Nombre del modelo de chat
qwen3.8-max "qwen3.8-max"
Número máximo de tokens del contenido generado.
Obligatorio (lo exige el protocolo Anthropic). Si el modelo genera más que este valor, se truncará.
1024
Lista de mensajes de la conversación (sin system). Cada mensaje incluye role (user / assistant) y content (una cadena o un array de bloques de contenido).
Show child attributes
Show child attributes
Prompt de sistema. Usa una cadena para texto plano; usa un array de bloques de contenido cuando necesites declarar caché explícita (añade cache_control en el bloque).
Temperatura de muestreo, rango [0, 2].
0 <= x <= 2Parámetro de muestreo de núcleo, rango (0, 1].
0 <= x <= 1Muestrea de los K tokens de mayor probabilidad.
Secuencias de parada personalizadas; la generación se detiene al encontrar una.
Indica si se devuelve en streaming como eventos SSE de Anthropic.
Configuración del pensamiento profundo. Al activarlo, el modelo devuelve el proceso de pensamiento como bloques de contenido thinking.
Show child attributes
Show child attributes
Lista de definiciones de herramientas (formato de tools de Anthropic), para Function Calling.
Show child attributes
Show child attributes
Respuesta
Generado correctamente
"msg_xxxxxxxx"
"message"
"assistant"
"qwen3.8-max"
Array de bloques de contenido de la respuesta
Show child attributes
Show child attributes
Motivo de parada: end_turn (finalización normal), max_tokens (se alcanzó el límite), stop_sequence (se encontró una secuencia de parada), tool_use (se requiere llamar a una herramienta)
"end_turn"
Estadísticas de uso de tokens (semántica de Anthropic: input_tokens no incluye la caché y se suma de forma excluyente con los campos de cache).
Show child attributes
Show child attributes