Skip to main content
POST
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con los modelos de texto y las conexiones de larga duración. https://api.evolink.ai es el endpoint principal para los servicios multimodales y sirve como dirección de respaldo para los modelos de texto.
La serie GLM tiene el pensamiento activado por defecto: la matriz content de la respuesta incluye un bloque type="thinking", que cuenta como tokens de salida. Por eso max_tokens no debe ser demasiado bajo; se recomienda 1024 o más, ya que en caso contrario la respuesta puede truncarse antes de terminar de pensar y no obtendrás el texto de la respuesta.

Autorizaciones

Authorization
string
header
requerido

##Todas las API requieren autenticación con Bearer Token##

Obtener la API Key:

Visita la Página de gestión de API Keys para obtener tu API Key

Añadir al encabezado de la solicitud al usarla:

Nota: EvoLink usa de forma unificada la autenticación con Bearer Token para /v1/messages.

Cuerpo

application/json
model
enum<string>
predeterminado:glm-5.3
requerido

Modelo a invocar:

Opciones disponibles:
glm-5.3,
glm-5.3-flash,
glm-5.2
Ejemplo:

"glm-5.3"

max_tokens
integer
predeterminado:1024
requerido

Número máximo de tokens generados en esta solicitud; obligatorio en el protocolo Anthropic.

Nota: la serie GLM tiene el pensamiento activado de forma predeterminada y su contenido también consume tokens de salida, por lo que este valor no debe ser demasiado pequeño — se recomienda no bajar de 1024.

Rango requerido: 1 <= x <= 131072
Ejemplo:

1024

messages
Message · object[]
requerido

Lista de mensajes de la conversación, en orden cronológico. Se requiere al menos un mensaje.

Minimum array length: 1

Respuesta

Objeto de mensaje

Respuesta de mensaje al estilo de Anthropic

id
string

ID único del mensaje (formato: msg_<uuid>)

type
enum<string>

Tipo de objeto de respuesta

Opciones disponibles:
message
role
enum<string>
Opciones disponibles:
assistant
model
string

Modelo realmente utilizado

Ejemplo:

"glm-5.3"

content
object[]

Lista de bloques de contenido de la respuesta

Posibles block type:

  • thinking: proceso de razonamiento (cuando el pensamiento está activado, activado de forma predeterminada)
  • text: texto de la respuesta final
  • tool_use: llamada a herramienta iniciada por el modelo
stop_reason
enum<string>

Motivo de la parada

  • end_turn: finalización natural (también devuelve este valor al encontrar stop_sequences)
  • max_tokens: se alcanzó el límite de max_tokens
  • tool_use: el modelo activó una llamada a herramienta
Opciones disponibles:
end_turn,
max_tokens,
tool_use
usage
object

Estadísticas de uso de tokens (especificación de Anthropic)