curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "glm-5.3",
"messages": [
{
"role": "user",
"content": "Bonjour, présentez-vous en une phrase"
}
]
}
'{
"id": "chatcmpl-a6613b56-c61c-94ba-9a9f-43d4cdc7d77a",
"object": "chat.completion",
"request_id": "req-7f3a2c1e8b9d4f0a",
"created": 1777021417,
"model": "glm-5.3",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Bonjour ! Je suis GLM-5.3, et je peux vous aider à réaliser diverses tâches comme la conversation, le raisonnement, la rédaction, le code, etc.",
"reasoning_content": "Laissez-moi d'abord analyser ce problème...",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 24,
"completion_tokens": 346,
"total_tokens": 370,
"prompt_tokens_details": {
"cached_tokens": 0
},
"completion_tokens_details": {
"reasoning_tokens": 321
}
},
"content_filter": [
{
"role": "assistant",
"level": 1
}
]
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model",
"fallback_suggestion": "glm-5.3"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try different model"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}API tous modèles GLM - Démarrage rapide Chat Completions
- Appelez les modèles de la série GLM via le protocole OpenAI Chat Completions, le modèle précis étant choisi avec le paramètre
model - Les deux paramètres
modeletmessagessuffisent - Fenêtre de contexte de 1M tokens sur toute la série, jusqu’à 131 072 tokens en sortie
- La réflexion approfondie est active par défaut sur toute la série et le raisonnement est renvoyé dans
reasoning_content - Pour le streaming, les appels d’outils, le réglage de l’intensité de réflexion, l’entrée image et les autres capacités, consultez la page « Référence complète »
curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "glm-5.3",
"messages": [
{
"role": "user",
"content": "Bonjour, présentez-vous en une phrase"
}
]
}
'{
"id": "chatcmpl-a6613b56-c61c-94ba-9a9f-43d4cdc7d77a",
"object": "chat.completion",
"request_id": "req-7f3a2c1e8b9d4f0a",
"created": 1777021417,
"model": "glm-5.3",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Bonjour ! Je suis GLM-5.3, et je peux vous aider à réaliser diverses tâches comme la conversation, le raisonnement, la rédaction, le code, etc.",
"reasoning_content": "Laissez-moi d'abord analyser ce problème...",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 24,
"completion_tokens": 346,
"total_tokens": 370,
"prompt_tokens_details": {
"cached_tokens": 0
},
"completion_tokens_details": {
"reasoning_tokens": 321
}
},
"content_filter": [
{
"role": "assistant",
"level": 1
}
]
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model",
"fallback_suggestion": "glm-5.3"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try different model"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles textuels et des connexions de longue durée. https://api.evolink.ai est le point de terminaison principal pour les services multimodaux et sert d’adresse de repli pour les modèles textuels.Autorisations
##Toutes les API nécessitent une authentification par Bearer Token##
Obtenir une clé API :
Visitez la page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Authorization: Bearer YOUR_API_KEY
Corps
Modèle à appeler :
| ID du modèle | Positionnement |
|---|---|
glm-5.3 | Modèle phare, progression générale sur l'ingénierie logicielle complexe et les tâches d'agent ; contexte de 1M |
glm-5.3-flash | Modèle multimodal léger, coût très faible, entrée image native ; contexte de 1M |
glm-5.2 | Modèle phare de la génération précédente, raisonnement complexe et contexte très long ; contexte de 1M |
glm-5.3, glm-5.3-flash, glm-5.2 "glm-5.3"
Liste des messages de la conversation, dans l'ordre chronologique. Au moins un message est requis.
1Show child attributes
Show child attributes
Réponse
Génération de conversation réussie
ID de la tâche
"chatcmpl-a6613b56-c61c-94ba-9a9f-43d4cdc7d77a"
Type de réponse
chat.completion "chat.completion"
ID de la requête (retransmis lorsque request_id est fourni dans la requête)
"req-7f3a2c1e8b9d4f0a"
Heure de création de la requête, horodatage Unix (secondes)
1777021417
Nom du modèle
"glm-5.3"
Liste des réponses du modèle
Show child attributes
Show child attributes
Statistiques d'utilisation des tokens renvoyées à la fin de l'appel
Show child attributes
Show child attributes
Informations relatives à la sécurité du contenu
Show child attributes
Show child attributes