Skip to main content
POST
Complétion de conversation GPT (tous modèles, paramètres complets)
BaseURL : La BaseURL par défaut est https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.
Les outils côté serveur (recherche web, exécution de code, recherche documentaire, MCP) ne sont proposés que sur l’API Responses. Le point de terminaison Chat Completions ne prend en charge que les appels d’outils function ordinaires.
GPT-6 : Les appels de fonctions avec Sol / Luna exigent reasoning_effort: "none" sur cet endpoint. Utilisez Responses pour les appels de fonctions avec Astra et 6.1 Sol, ou pour le niveau max de GPT-6.

Autorisations

Authorization
string
header
requis

##Toutes les API nécessitent une authentification Bearer Token##

Obtenir une clé API :

Visitez la Page de gestion des clés API pour obtenir votre clé API

Ajouter à l'en-tête de requête :

Corps

application/json
model
enum<string>
requis

Modèle à appeler :

Options disponibles:
gpt-6.1-sol,
gpt-6-astra,
gpt-6-sol,
gpt-6-luna,
gpt-5.6-sol,
gpt-5.6-terra,
gpt-5.6-luna,
gpt-5.5,
gpt-5.4,
gpt-5.2,
gpt-5.1
Exemple:

"gpt-6.1-sol"

messages
object[]
requis

Liste des messages de chat, prenant en charge le contexte multi-tours et l'entrée multimodale.

role peut valoir system / developer / user / assistant / tool.

content peut être une chaîne de caractères ou un tableau de blocs de contenu. Deux types de blocs sont pris en charge : text (texte) et image_url (image) :

Image

  • Transmettez dans image_url.url l'URL publique de l'image
  • image_url peut aussi s'écrire directement sous forme de chaîne, équivalent à { "url": "..." }
  • detail contrôle la précision d'analyse de l'image : auto (par défaut) / low / high / original
  • L'image doit pouvoir être téléchargée, sinon 400 est retourné

Remarque Les types de blocs de cette API diffèrent de ceux de l'API Responses (qui utilise input_text / input_image). Ils ne peuvent pas être mélangés ; une erreur de type retourne 400.

Point de cache explicite pour GPT-6 / GPT-5.6 dans un bloc de contenu. Quatre écritures maximum par requête ; un point implicite occupe un emplacement. prompt_cache_breakpoint: {"mode": "explicit"}.

Exemple:
stream
boolean
défaut:false

Indique si la réponse est retournée en flux (flux d'événements SSE se terminant par data: [DONE]). Valeur par défaut false.

Exemple:

false

max_completion_tokens
integer

Nombre maximal de tokens générés, raisonnement compris. Privilégiez max_completion_tokens. GPT-6 convertit l’ancien champ max_tokens ; si les deux sont fournis, max_completion_tokens est conservé et max_tokens supprimé. GPT-6 Astra / Sol / Luna et GPT-6.1 Sol acceptent jusqu’à 128 000 tokens de sortie.

Exemple:

2048

reasoning_effort
enum<string>

Contrôle de la profondeur de raisonnement. Les valeurs possibles varient selon le modèle :

Les tokens de raisonnement sont facturés comme des tokens de sortie et comptabilisés dans usage.completion_tokens_details.reasoning_tokens.

GPT-6 utilise medium par défaut. gpt-6-astra et gpt-6.1-sol ne prennent pas en charge none ; gpt-6-sol / gpt-6-luna le permettent. Le niveau max de GPT-6 est réservé à Responses.

Options disponibles:
none,
low,
medium,
high,
xhigh
Exemple:

"medium"

verbosity
enum<string>

Niveau de détail de la réponse : low / medium / high.

GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.

Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :

Remarque Pris en charge par gpt-6-astra, gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna et gpt-5.5 ; les autres modèles ne prennent pas en charge ce paramètre.

Options disponibles:
low,
medium,
high
Exemple:

"low"

temperature
number

Température d'échantillonnage, valeurs de 0 à 2. Plus la valeur est basse, plus la sortie est déterministe.

GPT-6 : omettez ce paramètre avec gpt-6-astra et gpt-6.1-sol. Avec gpt-6-sol / gpt-6-luna, il est réglable uniquement avec un effort none ; omettez-le aux autres niveaux. Sans effort explicite, la valeur est medium, pas none.

Modèles existants : gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 permettent un réglage ; la famille gpt-5.6 accepte uniquement la valeur par défaut 1.

Plage requise: 0 <= x <= 2
Exemple:

1

top_p
number

Paramètre d'échantillonnage nucléus, valeurs de 0 à 1. Il est déconseillé de l'ajuster en même temps que temperature.

GPT-6 : omettez ce paramètre avec gpt-6-astra et gpt-6.1-sol. Avec gpt-6-sol / gpt-6-luna, il est réglable uniquement avec un effort none ; omettez-le aux autres niveaux. Sans effort explicite, la valeur est medium, pas none.

Modèles existants : gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 permettent un réglage ; la famille gpt-5.6 accepte uniquement la valeur par défaut 1.

Plage requise: 0 <= x <= 1
Exemple:

1

frequency_penalty
number

Pénalité de fréquence, valeurs de -2 à 2. Les valeurs positives pénalisent les tokens selon leur fréquence d'apparition et réduisent les contenus répétitifs.

GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.

Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :

Remarque Réglable uniquement sur gpt-5.4 / gpt-5.2 / gpt-5.1 ; la famille gpt-5.6 et gpt-5.5 ne permettent aucun réglage. GPT-6 Astra n'accepte que la valeur par défaut 0 ; toute autre valeur retourne 400.

Plage requise: -2 <= x <= 2
Exemple:

0

presence_penalty
number

Pénalité de présence, valeurs de -2 à 2. Les valeurs positives encouragent le modèle à aborder de nouveaux sujets.

GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.

Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :

Remarque Réglable uniquement sur gpt-5.4 / gpt-5.2 / gpt-5.1 ; la famille gpt-5.6 et gpt-5.5 ne permettent aucun réglage. GPT-6 Astra n'accepte que la valeur par défaut 0 ; toute autre valeur retourne 400.

Plage requise: -2 <= x <= 2
Exemple:

0

logprobs
boolean
défaut:false

Indique s'il faut retourner les probabilités logarithmiques de chaque token de sortie.

GPT-6 : Astra et 6.1 Sol ne prennent pas en charge les logprobs de sortie. Sol / Luna les permettent uniquement avec un effort none. Aux autres niveaux, retirez logprobs, top_logprobs et message.output_text.logprobs de include dans Responses.

Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :

Remarque Pris en charge uniquement par gpt-5.4 / gpt-5.2 / gpt-5.1 ; la famille gpt-5.6 et gpt-5.5 ne prennent pas en charge ce paramètre.

GPT-6 Astra et GPT-6.1 Sol ne prennent pas en charge ce paramètre.

Exemple:

true

top_logprobs
integer

Nombre de tokens candidats retournés à chaque position, valeurs de 0 à 20 ; doit être utilisé avec logprobs: true.

Remarque Même périmètre de prise en charge que logprobs.

GPT-6 : Astra et 6.1 Sol ne prennent pas en charge les logprobs de sortie. Sol / Luna les permettent uniquement avec un effort none. Aux autres niveaux, retirez logprobs, top_logprobs et message.output_text.logprobs de include dans Responses.

Plage requise: 0 <= x <= 20
Exemple:

2

n
integer
défaut:1

Nombre de réponses candidates à générer, retournées sous forme de plusieurs entrées dans le tableau choices. Tous les tokens (y compris la sortie de chaque candidate) sont facturés.

GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.

Exemple:

1

seed
integer

Graine aléatoire. Avec la même graine et la même combinaison de paramètres, le modèle s'efforce de retourner des résultats cohérents (au mieux ; une reproductibilité totale n'est pas garantie).

GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.

Exemple:

42

response_format
object

Contrôle du format de sortie :

  • {"type": "text"} : texte libre, la valeur par défaut
  • {"type": "json_object"} : retourne un JSON valide et exige que le mot json figure dans messages, sinon 400 est retourné
  • {"type": "json_schema", "json_schema": {...}} : retourne des résultats structurés conformes au JSON Schema fourni ; associez-le à "strict": true pour imposer la conformité au schéma
tools
object[]

Liste d'outils, utilisée pour le Function Calling (appels de fonctions côté client, sans frais à l'appel).

Les outils côté serveur (recherche web, exécution de code, etc.) ne sont pas proposés sur cette API ; utilisez plutôt l'API Responses.

GPT-6 : gpt-6-sol / gpt-6-luna utilisent medium par défaut. Les appels de fonctions dans Chat Completions exigent explicitement reasoning_effort: "none". gpt-6-astra et gpt-6.1-sol ne prennent pas en charge none ; utilisez Responses pour les fonctions. Le niveau max de GPT-6 est disponible uniquement dans Responses.

tool_choice

Contrôle du choix des outils : "auto" (par défaut) / "none" / "required", ou un objet désignant une fonction précise, comme {"type": "function", "function": {"name": "get_weather"}}.

Options disponibles:
none,
auto,
required
parallel_tool_calls
boolean
défaut:true

Indique si le modèle peut appeler plusieurs outils en parallèle au cours d'un même tour. Valeur par défaut true ; avec false, les appels sont forcés un par un.

GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.

Exemple:

true

prompt_cache_key
string

Clé de regroupement du cache. GPT-6 / GPT-5.6 gèrent automatiquement le routage ; ce champ n’est pas nécessaire pour l’optimiser. Des clés distinctes séparent la réutilisation et la comptabilisation par client ou utilisateur. Gardez une clé stable pour les requêtes partageant un préfixe réutilisable. Pour les modèles antérieurs, elle peut faciliter le routage du cache.

Exemple:

"app-chat-v1"

user
string

Identifiant de l'utilisateur final, utilisé pour distinguer l'origine des appels.

Exemple:

"user-1024"

prompt_cache_options
object

Options de cache pour GPT-6 et GPT-5.6. Les points implicites sont utilisés par défaut. mode: "explicit" utilise uniquement les points explicites ; sans point, aucune mise en cache.

Exemple:

Réponse

Génération de la conversation réussie (objet JSON ; avec stream=true, un flux d'événements SSE se terminant par data: [DONE])

id
string

Identifiant unique de cette conversation

Exemple:

"chatcmpl-CvJ2p8mQxK7nR4wS"

object
enum<string>

Type de réponse

Options disponibles:
chat.completion
Exemple:

"chat.completion"

created
integer

Horodatage de création

Exemple:

1786705221

model
string

Nom du modèle réellement utilisé

Exemple:

"gpt-6.1-sol"

choices
object[]

Liste des résultats générés (sa longueur est égale à n dans la requête)

usage
object

Statistiques d'utilisation des tokens. Le cache de prompts s'applique automatiquement ; les tokens d'entrée servis depuis le cache sont facturés au tarif de cache, plus bas.

GPT-6 facture séparément les entrées hors cache, les lectures et écritures du cache et les sorties. Au-delà de 272 000 tokens en entrée, toute la requête est facturée à 2× les tarifs des entrées et du cache et à 1,5× le tarif des sorties. La génération d’images intégrée est facturée séparément. Voir les tarifs actuels.