Interfaz de todos los modelos GLM - Inicio rápido de Messages
- Llama a los modelos de la serie GLM mediante el protocolo Anthropic Messages, eligiendo el modelo concreto con el parámetro
model - Bastan los tres parámetros
model,max_tokensymessages(max_tokenses obligatorio en el protocolo Anthropic) - Ventana de contexto de 1M tokens en toda la serie, con hasta 131.072 tokens de salida
- El pensamiento viene activado por defecto en toda la serie: el
contentde la respuesta incluye un bloquetype="thinking", que cuenta como tokens de salida - Para streaming, llamadas a herramientas, entrada de imagen y demás capacidades, consulta la página «Referencia completa»
https://direct.evolink.ai, que ofrece mejor compatibilidad con los modelos de texto y las conexiones de larga duración. https://api.evolink.ai es el endpoint principal para los servicios multimodales y sirve como dirección de respaldo para los modelos de texto.content de la respuesta incluye un bloque type="thinking", que cuenta como tokens de salida. Por eso max_tokens no debe ser demasiado bajo; se recomienda 1024 o más, ya que en caso contrario la respuesta puede truncarse antes de terminar de pensar y no obtendrás el texto de la respuesta.Autorizaciones
##Todas las API requieren autenticación con Bearer Token##
Obtener la API Key:
Visita la Página de gestión de API Keys para obtener tu API Key
Añadir al encabezado de la solicitud al usarla:
Nota: EvoLink usa de forma unificada la autenticación con Bearer Token para /v1/messages.
Cuerpo
Modelo a invocar:
glm-5.3, glm-5.3-flash, glm-5.2 "glm-5.3"
Número máximo de tokens generados en esta solicitud; obligatorio en el protocolo Anthropic.
Nota: la serie GLM tiene el pensamiento activado de forma predeterminada y su contenido también consume tokens de salida, por lo que este valor no debe ser demasiado pequeño — se recomienda no bajar de 1024.
1 <= x <= 1310721024
Lista de mensajes de la conversación, en orden cronológico. Se requiere al menos un mensaje.
1Respuesta
Objeto de mensaje
Respuesta de mensaje al estilo de Anthropic
ID único del mensaje (formato: msg_<uuid>)
Tipo de objeto de respuesta
message assistant Modelo realmente utilizado
"glm-5.3"
Lista de bloques de contenido de la respuesta
Posibles block type:
thinking: proceso de razonamiento (cuando el pensamiento está activado, activado de forma predeterminada)text: texto de la respuesta finaltool_use: llamada a herramienta iniciada por el modelo
Motivo de la parada
end_turn: finalización natural (también devuelve este valor al encontrar stop_sequences)max_tokens: se alcanzó el límite de max_tokenstool_use: el modelo activó una llamada a herramienta
end_turn, max_tokens, tool_use Estadísticas de uso de tokens (especificación de Anthropic)