Qwen3.8-Max-Preview - API Responses
🚧 Este modelo aun no esta disponible, mantente atento
- Llama a Qwen3.8-Max-Preview mediante el protocolo OpenAI Responses
- Entrada flexible:
inputacepta una cadena o un array de mensajes en formato Chat (admite multimodalinput_text/input_image) - Conversación de varios turnos: pasa
previous_response_idpara relacionar la respuesta del turno anterior; el servidor compone automáticamente el contexto (elidde la respuesta es válido durante 7 días) - Caché de sesión: se activa añadiendo el encabezado
x-dashscope-session-cache: enable(disable por defecto); consulta los aciertos enusage.input_tokens_details.cached_tokens - Intensidad de pensamiento: se controla mediante
reasoning.effort - Salida en streaming: cuando
stream=true, se devuelve según los eventos de Responses (response.output_text.delta/response.completed, etc.)
https://direct.evolink.ai, que ofrece mejor soporte para modelos de texto y admite conexiones persistentes; https://api.evolink.ai es la dirección principal multimodal, úsala cuando incluyas entrada de imagen.Caché de sesión: la interfaz Responses activa la caché de sesión del servidor mediante el encabezado x-dashscope-session-cache: enable para reducir la latencia y el coste de varios turnos.Autorizaciones
##Todas las API requieren autenticación con Bearer Token##
Obtener la API Key:
Visita la página de gestión de API Keys para obtener tu API Key
Añadir al encabezado de la solicitud:
Encabezados
Interruptor de caché de sesión. Cuando se establece en enable, el servidor almacena automáticamente en caché el contexto de la conversación para reducir la latencia y el coste de la inferencia de varios turnos.
enable, disable Cuerpo
Nombre del modelo de chat
qwen3.8-max-preview "qwen3.8-max-preview"
Entrada del modelo. Acepta una cadena (texto plano) o un array de mensajes en formato Chat (admite multimodal input_text / input_image).
Se inserta como instrucción de sistema al inicio del contexto. Cuando se usa previous_response_id, las instructions del turno anterior no se transfieren al turno actual.
ID único de la respuesta del turno anterior (el id de la respuesta, válido durante 7 días). Sirve para relacionar conversaciones de varios turnos; el servidor recupera y combina automáticamente la entrada y la salida de ese turno como contexto.
Número máximo de tokens del contenido de salida de esta generación (incluye pensamiento).
Control del pensamiento.
Indica si se almacena esta respuesta.
true(predeterminado): puede referenciarse medianteprevious_response_idfalse: no se almacena y no podrá referenciarse después
Indica si se devuelve en streaming como eventos de Responses.
Temperatura de muestreo, rango [0, 2].
0 <= x <= 2Parámetro de muestreo de núcleo, rango (0, 1].
0 <= x <= 1Lista de herramientas. Admite herramientas integradas (web_search búsqueda web, web_extractor extracción de páginas web, code_interpreter intérprete de código) y function personalizadas.
Respuesta
Generado correctamente
ID único de esta respuesta (válido durante 7 días, puede usarse como previous_response_id)
"resp_xxxxxxxx"
"response"
Estado de la respuesta
"completed"
"qwen3.8-max-preview"
Array de elementos de salida (incluye message / reasoning / llamadas a herramientas integradas, etc.)
Estadísticas de uso de tokens.