API tous modèles Gemini - format compatible OpenAI
Sélectionnez le modèle de texte Gemini à appeler via model dans le corps de la requête (voir le tableau de correspondance du paramètre model pour toutes les valeurs possibles).
- Utilise le format OpenAI SDK / Chat Completions, retourne le contenu de la conversation de manière synchrone
- Entrée texte brut / multimodale : entrée mixte texte + image (
messages[].content) - Streaming : définissez
stream: truepour un retour bloc par bloc
Spécifications et différences des modèles
- Paramètres d’échantillonnage / de pénalité
temperature/top_p/frequency_penalty/presence_penalty: identiques pour toute la série Gemini 3.x, les valeurs personnalisées n’affectent pas la sortie ;temperature/top_prenvoient une erreur 400 si elles sont hors plage, etfrequency_penalty/presence_penaltysont filtrées par la passerelle (sans générer d’erreur). - Contrôle du raisonnement
reasoning_effort:minimal/low/medium/high(voir le paramètrereasoning_effortpour les niveaux pris en charge et la valeur par défaut de chaque modèle) ; effectif uniquement pour la série Gemini 3.x. - Rôle du dernier tour : le
roledu dernier message ne peut pas êtreassistant(Gemini 3.5+ génère une erreur). - Limite de tokens :
gemini-3.6-flash/gemini-3.5-flash-litecontexte 1,048,576, sortie maximale 65,536 ; les autres modèles selon leurs propres spécifications.
https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Corps
Sélectionnez le modèle de texte Gemini à appeler :
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
Liste des messages de chat, prend en charge le dialogue multi-tours et l'entrée multimodale
1Indique si la réponse doit être retournée en mode streaming
true: Retour en streaming, reçoit le contenu en fragments en temps réelfalse: Retourne la réponse complète en une seule fois
false
Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.
gemini-3.6-flash / gemini-3.5-flash-lite limite de 65,536 tokens ; les autres modèles selon leurs propres spécifications.
1 <= x <= 655362000
Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.
1 <= x <= 655362000
Température d'échantillonnage, contrôle le caractère aléatoire de la sortie
Description :
- Valeurs basses (ex. 0.2) : Sortie plus déterministe et ciblée
- Valeurs élevées (ex. 1.5) : Sortie plus aléatoire et créative
⚠️ Identique pour toute la série Gemini 3.x (ne varie pas selon le modèle) : les valeurs personnalisées dans la plage autorisée n'affectent pas la sortie ; toute valeur hors de la plage autorisée de ce paramètre renvoie une erreur 400, au lieu d'être ignorée silencieusement.
0 <= x <= 20.7
Paramètre de Nucleus Sampling
Description :
- Contrôle l'échantillonnage à partir des tokens dont la probabilité cumulative est parmi les plus élevées
- Par exemple, 0.9 signifie sélectionner parmi les tokens dont la probabilité cumulative atteint 90%
- Valeur par défaut : 0.95
Recommandation : ne pas ajuster temperature et top_p simultanément
⚠️ Identique pour toute la série Gemini 3.x (ne varie pas selon le modèle) : les valeurs personnalisées dans la plage autorisée n'affectent pas la sortie ; toute valeur hors de la plage autorisée de ce paramètre renvoie une erreur 400, au lieu d'être ignorée silencieusement.
0 <= x <= 10.9
Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.
⚠️ Identique pour toute la série Gemini 3.x : les valeurs transmises sont filtrées par la passerelle et sans effet (sans générer d'erreur).
-2 <= x <= 20
Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.
⚠️ Identique pour toute la série Gemini 3.x : les valeurs transmises sont filtrées par la passerelle et sans effet (sans générer d'erreur).
-2 <= x <= 20
Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.
Nombre de candidats à générer
⚠️ Gemini 3.x ne prend en charge que 1 ; transmettre une valeur >1 renvoie une erreur 400 (équivalent au candidateCount déjà supprimé du format natif).
1 <= x <= 11
Limite l'effort de raisonnement, correspond au niveau de raisonnement de Gemini :
minimal: raisonnement quasi nul, haut débit / faible latencelow: raisonnement réduit, tâches simplesmedium: équilibre entre qualité et vitessehigh: raisonnement approfondi multi-étapes
Effectif uniquement pour la série Gemini 3.x, les niveaux pris en charge et la valeur par défaut diffèrent selon les modèles (identique au format natif) :
minimal, low, medium, high "minimal"
Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.
12345
Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.
- Option 1
- Option 2
Streaming response options. Can be set when stream is true.
List of tool definitions for Function Calling.
Controls tool-calling behavior.
none, auto, required Gemini extension parameters.
Réponse
Complétion de chat générée avec succès
Identifiant unique pour la complétion de chat
"chatcmpl-20251010015944503180122WJNB8Eid"
Nom du modèle réellement utilisé
"gemini-3.6-flash"
Type de réponse
chat.completion "chat.completion"
Horodatage de création
1760032810
Liste des choix de complétion de chat
Statistiques d'utilisation des jetons