curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "gemini-3.6-flash",
"messages": [
{
"role": "user",
"content": "Please introduce yourself"
}
]
}
'{
"id": "chatcmpl-20251010015944503180122WJNB8Eid",
"model": "gemini-3.6-flash",
"object": "chat.completion",
"created": 1760032810,
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello! I'm pleased to introduce myself.\n\nI'm a Large Language Model, trained and developed by Google.\n\nSimply put, you can think of me as a \"smart brain\" that has been trained on massive amounts of text data and is able to understand and generate human language. My core capability is processing and generating text. Specifically, I can do the following:\n\n**1. Information Query & Knowledge Answering**\nI can act like a \"talking encyclopedia,\" answering various questions, whether they're about scientific knowledge, historical events, or everyday facts.\n\n**2. Creative Writing & Text Generation**\nI can create various types of text based on your requirements, such as:\n* **Writing**: Poetry, stories, scripts, emails, speeches, advertising copy, etc.\n* **Planning**: Travel plans, study outlines, event proposals, etc.\n* **Brainstorming**: Working with you to generate new ideas and spark creativity.\n\n**3. Translation & Language Processing**\nI'm proficient in multiple languages and can provide fast, fluent translation services. I can also help you polish, proofread, summarize, or rewrite text to make your expression clearer and more professional.\n\n**4. Programming & Code Assistance**\nI can write code snippets, explain code logic, debug errors, or \"translate\" code from one programming language to another, making me a helpful companion for programmers.\n\n**5. Logical Analysis & Reasoning**\nI can help you analyze complex problems, organize logical chains, and make inferences and summaries based on the information you provide.\n\n---\n\n**In summary**, my goal is to be a powerful and useful tool that helps you obtain information more efficiently, complete tasks, and spark creativity through natural language communication.\n\n**Remember:** I'm an artificial intelligence, my knowledge comes from the data I've learned, and it may not be the most up-to-date. Sometimes I may also make mistakes, so for very important information, I recommend you verify it again.",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"logprobs": {
"content": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
],
"top_logprobs": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
]
}
]
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 13,
"completion_tokens": 1891,
"total_tokens": 1904,
"prompt_tokens_details": {
"cached_tokens": 0,
"text_tokens": 13,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 0,
"audio_tokens": 0,
"reasoning_tokens": 1480
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null
}
}{
"error": {
"code": 400,
"message": "Paramètres de requête invalides",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Quota insuffisant",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model",
"fallback_suggestion": "gemini-3.6-flash"
}
}{
"error": {
"code": 413,
"message": "Image file too large",
"type": "request_too_large_error",
"param": "content",
"fallback_suggestion": "compress image to under 10MB"
}
}{
"error": {
"code": 429,
"message": "Limite de débit dépassée",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Erreur interne du serveur",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try different model"
}
}{
"error": {
"code": 503,
"message": "Service temporairement indisponible",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}API tous modèles Gemini - format compatible OpenAI
Sélectionnez le modèle de texte Gemini à appeler via model dans le corps de la requête (voir le tableau de correspondance du paramètre model pour toutes les valeurs possibles).
- Utilise le format OpenAI SDK / Chat Completions, retourne le contenu de la conversation de manière synchrone
- Entrée texte brut / multimodale : entrée mixte texte + image (
messages[].content) - Streaming : définissez
stream: truepour un retour bloc par bloc
Spécifications et différences des modèles
- Comportement de 3.8 : par rapport à 3.7, le modèle améliore l’ingénierie logicielle, les agents, le raisonnement multi-étapes et la précision multimodale ; il peut consommer davantage de tokens de raisonnement / sortie, surtout avec
high. Utilisezlowsi la latence est critique, la valeur par défautmediumpour un usage général ethighpour le code complexe, les longues vidéos ou le raisonnement multi-étapes. - Paramètres d’échantillonnage / de pénalité
temperature/top_p/frequency_penalty/presence_penalty: identiques pour toute la série Gemini 3.x, les valeurs personnalisées n’affectent pas la sortie ;temperature/top_prenvoient une erreur 400 si elles sont hors plage, etfrequency_penalty/presence_penaltysont ignorées et sans effet (sans générer d’erreur). - Contrôle du raisonnement
reasoning_effort:minimal/low/medium/high(voir le paramètrereasoning_effortpour les niveaux pris en charge et la valeur par défaut de chaque modèle) ; effectif uniquement pour la série Gemini 3.x.gemini-3.8-flash/gemini-3.7-flashet la série Pro ne prennent pas en chargeminimal; la valeur transmise est automatiquement rétrogradée enlow. - Rôle du dernier tour : le
roledu dernier message ne peut pas êtreassistant(Gemini 3.5+ génère une erreur). - Limite de tokens :
gemini-3.8-flash/gemini-3.7-flash/gemini-3.6-flash/gemini-3.5-flash-litecontexte 1,048,576, sortie maximale 65,536 ; les autres modèles selon leurs propres spécifications.
curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "gemini-3.6-flash",
"messages": [
{
"role": "user",
"content": "Please introduce yourself"
}
]
}
'{
"id": "chatcmpl-20251010015944503180122WJNB8Eid",
"model": "gemini-3.6-flash",
"object": "chat.completion",
"created": 1760032810,
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello! I'm pleased to introduce myself.\n\nI'm a Large Language Model, trained and developed by Google.\n\nSimply put, you can think of me as a \"smart brain\" that has been trained on massive amounts of text data and is able to understand and generate human language. My core capability is processing and generating text. Specifically, I can do the following:\n\n**1. Information Query & Knowledge Answering**\nI can act like a \"talking encyclopedia,\" answering various questions, whether they're about scientific knowledge, historical events, or everyday facts.\n\n**2. Creative Writing & Text Generation**\nI can create various types of text based on your requirements, such as:\n* **Writing**: Poetry, stories, scripts, emails, speeches, advertising copy, etc.\n* **Planning**: Travel plans, study outlines, event proposals, etc.\n* **Brainstorming**: Working with you to generate new ideas and spark creativity.\n\n**3. Translation & Language Processing**\nI'm proficient in multiple languages and can provide fast, fluent translation services. I can also help you polish, proofread, summarize, or rewrite text to make your expression clearer and more professional.\n\n**4. Programming & Code Assistance**\nI can write code snippets, explain code logic, debug errors, or \"translate\" code from one programming language to another, making me a helpful companion for programmers.\n\n**5. Logical Analysis & Reasoning**\nI can help you analyze complex problems, organize logical chains, and make inferences and summaries based on the information you provide.\n\n---\n\n**In summary**, my goal is to be a powerful and useful tool that helps you obtain information more efficiently, complete tasks, and spark creativity through natural language communication.\n\n**Remember:** I'm an artificial intelligence, my knowledge comes from the data I've learned, and it may not be the most up-to-date. Sometimes I may also make mistakes, so for very important information, I recommend you verify it again.",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"logprobs": {
"content": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
],
"top_logprobs": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
]
}
]
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 13,
"completion_tokens": 1891,
"total_tokens": 1904,
"prompt_tokens_details": {
"cached_tokens": 0,
"text_tokens": 13,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 0,
"audio_tokens": 0,
"reasoning_tokens": 1480
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null
}
}{
"error": {
"code": 400,
"message": "Paramètres de requête invalides",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Quota insuffisant",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model",
"fallback_suggestion": "gemini-3.6-flash"
}
}{
"error": {
"code": 413,
"message": "Image file too large",
"type": "request_too_large_error",
"param": "content",
"fallback_suggestion": "compress image to under 10MB"
}
}{
"error": {
"code": 429,
"message": "Limite de débit dépassée",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Erreur interne du serveur",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try different model"
}
}{
"error": {
"code": 503,
"message": "Service temporairement indisponible",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Authorization: Bearer YOUR_API_KEY
Corps
Sélectionnez le modèle de texte Gemini à appeler :
| Modèle ID | Série | Positionnement |
|---|---|---|
gemini-3.8-flash | 3.8 Flash | Ingénierie logicielle / agents / raisonnement multi-étapes / précision multimodale améliorés |
gemini-3.7-flash | 3.7 Flash | Agentique de niveau Pro / Génération de code / Exécution en terminal |
gemini-3.6-flash | 3.6 Flash | Orchestration multi-étapes / Refactorisation de code / Raisonnement général |
gemini-3.5-flash | 3.5 Flash | Flash générique |
gemini-3.5-flash-lite | 3.5 Flash-Lite | Faible coût / Haut débit / Agent léger |
gemini-3.1-pro-preview | 3.1 Pro (Preview) | Raisonnement avancé |
gemini-3.1-pro-preview-customtools | 3.1 Pro · CustomTools | Raisonnement avancé + Outils personnalisés |
gemini-3.1-flash-lite-preview | 3.1 Flash-Lite (Preview) | Faible coût |
gemini-3-pro-preview | 3.0 Pro (Preview) | Raisonnement avancé |
gemini-3-flash-preview | 3.0 Flash (Preview) | Flash générique |
gemini-2.5-pro | 2.5 Pro | Raisonnement avancé |
gemini-2.5-flash | 2.5 Flash | Flash générique |
gemini-2.5-flash-lite | 2.5 Flash-Lite | Faible coût |
gemini-3.8-flash, gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
Liste des messages de chat, prend en charge le dialogue multi-tours et l'entrée multimodale
1Show child attributes
Show child attributes
Indique si la réponse doit être retournée en mode streaming
true: Retour en streaming, reçoit le contenu en fragments en temps réelfalse: Retourne la réponse complète en une seule fois
false
Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.
gemini-3.8-flash / gemini-3.7-flash / gemini-3.6-flash / gemini-3.5-flash-lite limite de 65,536 tokens ; les autres modèles selon leurs propres spécifications.
1 <= x <= 655362000
Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.
1 <= x <= 655362000
Température d'échantillonnage, contrôle le caractère aléatoire de la sortie
Description :
- Valeurs basses (ex. 0.2) : Sortie plus déterministe et ciblée
- Valeurs élevées (ex. 1.5) : Sortie plus aléatoire et créative
Identique pour toute la série Gemini 3.x (ne varie pas selon le modèle) : les valeurs personnalisées dans la plage autorisée n'affectent pas la sortie ; toute valeur hors de la plage autorisée de ce paramètre renvoie une erreur 400, au lieu d'être ignorée silencieusement.
0 <= x <= 20.7
Paramètre de Nucleus Sampling
Description :
- Contrôle l'échantillonnage à partir des tokens dont la probabilité cumulative est parmi les plus élevées
- Par exemple, 0.9 signifie sélectionner parmi les tokens dont la probabilité cumulative atteint 90%
- Valeur par défaut : 0.95
Recommandation : ne pas ajuster temperature et top_p simultanément
Identique pour toute la série Gemini 3.x (ne varie pas selon le modèle) : les valeurs personnalisées dans la plage autorisée n'affectent pas la sortie ; toute valeur hors de la plage autorisée de ce paramètre renvoie une erreur 400, au lieu d'être ignorée silencieusement.
0 <= x <= 10.9
Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.
Identique pour toute la série Gemini 3.x : les valeurs transmises sont ignorées et sans effet (sans générer d'erreur).
-2 <= x <= 20
Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.
Identique pour toute la série Gemini 3.x : les valeurs transmises sont ignorées et sans effet (sans générer d'erreur).
-2 <= x <= 20
Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.
Nombre de candidats à générer
Gemini 3.x ne prend en charge que 1 ; transmettre une valeur >1 renvoie une erreur 400 (équivalent au candidateCount déjà supprimé du format natif).
1 <= x <= 11
Limite l'effort de raisonnement, correspond au niveau de raisonnement de Gemini :
minimal: raisonnement quasi nul, haut débit / faible latencelow: raisonnement réduit, tâches simplesmedium: équilibre entre qualité et vitessehigh: raisonnement approfondi multi-étapes
Effectif uniquement pour la série Gemini 3.x, les niveaux pris en charge et la valeur par défaut diffèrent selon les modèles (identique au format natif) :
| Modèle | Niveaux pris en charge | Par défaut |
|---|---|---|
gemini-3.8-flash | low / medium / high | medium |
gemini-3.7-flash | low / medium / high | medium |
gemini-3.6-flash | minimal / low / medium / high | medium |
gemini-3.5-flash | minimal / low / medium / high | medium |
gemini-3.5-flash-lite | minimal / low / medium / high | minimal |
gemini-3.1-flash-lite-preview | minimal / low / medium / high | minimal |
gemini-3-flash-preview | minimal / low / medium / high | medium |
gemini-3.1-pro-preview | low / medium / high | high |
gemini-3.1-pro-preview-customtools | low / medium / high | high |
gemini-3-pro-preview | low / medium / high | high |
Transmettre un niveau non pris en charge par le modèle (par ex., transmettre minimal à la série Pro ou à gemini-3.8-flash / gemini-3.7-flash) est automatiquement rétrogradé en low et ne génère pas d'erreur.
minimal, low, medium, high "minimal"
Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.
12345
Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.
- Option 1
- Option 2
Show child attributes
Show child attributes
Streaming response options. Can be set when stream is true.
Show child attributes
Show child attributes
List of tool definitions for Function Calling.
Show child attributes
Show child attributes
Controls tool-calling behavior.
none, auto, required Gemini extension parameters.
Show child attributes
Show child attributes
Réponse
Complétion de chat générée avec succès
Identifiant unique pour la complétion de chat
"chatcmpl-20251010015944503180122WJNB8Eid"
Nom du modèle réellement utilisé
"gemini-3.6-flash"
Type de réponse
chat.completion "chat.completion"
Horodatage de création
1760032810
Liste des choix de complétion de chat
Show child attributes
Show child attributes
Statistiques d'utilisation des jetons
Show child attributes
Show child attributes