Skip to main content
POST
BaseURL : la BaseURL par défaut est https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles textuels et des connexions de longue durée. https://api.evolink.ai est le point de terminaison principal pour les services multimodaux et sert d’adresse de repli pour les modèles textuels.
La série GLM active la réflexion par défaut : le tableau content de la réponse contient un bloc type="thinking", comptabilisé dans les tokens de sortie. max_tokens ne doit donc pas être trop faible ; 1024 au minimum est recommandé, faute de quoi la réponse peut être tronquée avant la fin de la réflexion et vous n’obtenez pas le texte de réponse.

Autorisations

Authorization
string
header
requis

##Toutes les API nécessitent une authentification par Bearer Token##

Obtenir une clé API :

Visitez la page de gestion des clés API pour obtenir votre clé API

Ajouter à l'en-tête de requête :

Remarque : EvoLink applique une authentification unifiée par Bearer Token pour /v1/messages.

Corps

application/json
model
enum<string>
défaut:glm-5.3
requis

Modèle à appeler :

Options disponibles:
glm-5.3,
glm-5.3-flash,
glm-5.2
Exemple:

"glm-5.3"

max_tokens
integer
défaut:1024
requis

Nombre maximal de tokens générés pour cette requête ; obligatoire dans le protocole Anthropic.

Remarque : la série GLM active la réflexion par défaut, et le contenu de réflexion consomme aussi des tokens de sortie. Cette valeur ne doit donc pas être trop faible — 1024 au minimum est recommandé.

Plage requise: 1 <= x <= 131072
Exemple:

1024

messages
Message · object[]
requis

Liste des messages de la conversation, dans l'ordre chronologique. Au moins un message est requis.

Minimum array length: 1

Réponse

Objet message

Réponse de message au style Anthropic

id
string

ID unique du message (format : msg_<uuid>)

type
enum<string>

Type d'objet de réponse

Options disponibles:
message
role
enum<string>
Options disponibles:
assistant
model
string

Modèle réellement utilisé

Exemple:

"glm-5.3"

content
object[]

Liste des blocs de contenu de la réponse

Types de blocs possibles :

  • thinking : processus de raisonnement (lorsque la réflexion est activée, par défaut)
  • text : texte de la réponse finale
  • tool_use : appel d'outil initié par le modèle
stop_reason
enum<string>

Raison de l'arrêt

  • end_turn : fin naturelle (renvoyé également lorsqu'une séquence stop_sequences est rencontrée)
  • max_tokens : limite max_tokens atteinte
  • tool_use : le modèle a déclenché un appel d'outil
Options disponibles:
end_turn,
max_tokens,
tool_use
usage
object

Statistiques d'utilisation des tokens (spécification Anthropic)