Passer au contenu principal
POST
BaseURL : La BaseURL par défaut est https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.

Autorisations

Authorization
string
header
requis

##Toutes les API nécessitent une authentification Bearer Token##

Obtenir une clé API :

Visitez la Page de gestion des clés API pour obtenir votre clé API

Ajouter à l'en-tête de requête :

Corps

application/json
model
enum<string>
requis

Sélectionnez le modèle de texte Gemini à appeler :

Options disponibles:
gemini-3.6-flash,
gemini-3.5-flash,
gemini-3.5-flash-lite,
gemini-3.1-pro-preview,
gemini-3.1-pro-preview-customtools,
gemini-3.1-flash-lite-preview,
gemini-3-pro-preview,
gemini-3-flash-preview,
gemini-2.5-pro,
gemini-2.5-flash,
gemini-2.5-flash-lite
Exemple:

"gemini-3.6-flash"

messages
object[]
requis

Liste des messages de chat, prend en charge le dialogue multi-tours et l'entrée multimodale

Minimum array length: 1
stream
boolean
défaut:false

Indique si la réponse doit être retournée en mode streaming

  • true : Retour en streaming, reçoit le contenu en fragments en temps réel
  • false : Retourne la réponse complète en une seule fois
Exemple:

false

max_completion_tokens
integer | null

Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.

gemini-3.6-flash / gemini-3.5-flash-lite limite de 65,536 tokens ; les autres modèles selon leurs propres spécifications.

Plage requise: 1 <= x <= 65536
Exemple:

2000

max_tokens
integer

Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.

Plage requise: 1 <= x <= 65536
Exemple:

2000

temperature
number
défaut:1

Température d'échantillonnage, contrôle le caractère aléatoire de la sortie

Description :

  • Valeurs basses (ex. 0.2) : Sortie plus déterministe et ciblée
  • Valeurs élevées (ex. 1.5) : Sortie plus aléatoire et créative

⚠️ Identique pour toute la série Gemini 3.x (ne varie pas selon le modèle) : les valeurs personnalisées dans la plage autorisée n'affectent pas la sortie ; toute valeur hors de la plage autorisée de ce paramètre renvoie une erreur 400, au lieu d'être ignorée silencieusement.

Plage requise: 0 <= x <= 2
Exemple:

0.7

top_p
number
défaut:0.95

Paramètre de Nucleus Sampling

Description :

  • Contrôle l'échantillonnage à partir des tokens dont la probabilité cumulative est parmi les plus élevées
  • Par exemple, 0.9 signifie sélectionner parmi les tokens dont la probabilité cumulative atteint 90%
  • Valeur par défaut : 0.95

Recommandation : ne pas ajuster temperature et top_p simultanément

⚠️ Identique pour toute la série Gemini 3.x (ne varie pas selon le modèle) : les valeurs personnalisées dans la plage autorisée n'affectent pas la sortie ; toute valeur hors de la plage autorisée de ce paramètre renvoie une erreur 400, au lieu d'être ignorée silencieusement.

Plage requise: 0 <= x <= 1
Exemple:

0.9

frequency_penalty
number | null
défaut:0

Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.

⚠️ Identique pour toute la série Gemini 3.x : les valeurs transmises sont filtrées par la passerelle et sans effet (sans générer d'erreur).

Plage requise: -2 <= x <= 2
Exemple:

0

presence_penalty
number | null
défaut:0

Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.

⚠️ Identique pour toute la série Gemini 3.x : les valeurs transmises sont filtrées par la passerelle et sans effet (sans générer d'erreur).

Plage requise: -2 <= x <= 2
Exemple:

0

stop

Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.

n
integer | null
défaut:1

Nombre de candidats à générer

⚠️ Gemini 3.x ne prend en charge que 1 ; transmettre une valeur >1 renvoie une erreur 400 (équivalent au candidateCount déjà supprimé du format natif).

Plage requise: 1 <= x <= 1
Exemple:

1

reasoning_effort
enum<string> | null

Limite l'effort de raisonnement, correspond au niveau de raisonnement de Gemini :

  • minimal : raisonnement quasi nul, haut débit / faible latence
  • low : raisonnement réduit, tâches simples
  • medium : équilibre entre qualité et vitesse
  • high : raisonnement approfondi multi-étapes

Effectif uniquement pour la série Gemini 3.x, les niveaux pris en charge et la valeur par défaut diffèrent selon les modèles (identique au format natif) :

Options disponibles:
minimal,
low,
medium,
high
Exemple:

"minimal"

seed
integer | null

Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.

Exemple:

12345

response_format
object

Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.

stream_options
object | null

Streaming response options. Can be set when stream is true.

tools
object[] | null

List of tool definitions for Function Calling.

tool_choice

Controls tool-calling behavior.

Options disponibles:
none,
auto,
required
extra_body
object | null

Gemini extension parameters.

Réponse

Complétion de chat générée avec succès

id
string

Identifiant unique pour la complétion de chat

Exemple:

"chatcmpl-20251010015944503180122WJNB8Eid"

model
string

Nom du modèle réellement utilisé

Exemple:

"gemini-3.6-flash"

object
enum<string>

Type de réponse

Options disponibles:
chat.completion
Exemple:

"chat.completion"

created
integer

Horodatage de création

Exemple:

1760032810

choices
object[]

Liste des choix de complétion de chat

usage
object

Statistiques d'utilisation des jetons