curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "gpt-6.1-sol",
"messages": [
{
"role": "user",
"content": "Explique l’intrication quantique en une phrase."
}
]
}
'import requests
url = "https://direct.evolink.ai/v1/chat/completions"
payload = {
"model": "gpt-6.1-sol",
"messages": [
{
"role": "user",
"content": "Explique l’intrication quantique en une phrase."
}
]
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({
model: 'gpt-6.1-sol',
messages: [{role: 'user', content: 'Explique l’intrication quantique en une phrase.'}]
})
};
fetch('https://direct.evolink.ai/v1/chat/completions', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://direct.evolink.ai/v1/chat/completions",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gpt-6.1-sol',
'messages' => [
[
'role' => 'user',
'content' => 'Explique l’intrication quantique en une phrase.'
]
]
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://direct.evolink.ai/v1/chat/completions"
payload := strings.NewReader("{\n \"model\": \"gpt-6.1-sol\",\n \"messages\": [\n {\n \"role\": \"user\",\n \"content\": \"Explique l’intrication quantique en une phrase.\"\n }\n ]\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://direct.evolink.ai/v1/chat/completions")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"model\": \"gpt-6.1-sol\",\n \"messages\": [\n {\n \"role\": \"user\",\n \"content\": \"Explique l’intrication quantique en une phrase.\"\n }\n ]\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://direct.evolink.ai/v1/chat/completions")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"model\": \"gpt-6.1-sol\",\n \"messages\": [\n {\n \"role\": \"user\",\n \"content\": \"Explique l’intrication quantique en une phrase.\"\n }\n ]\n}"
response = http.request(request)
puts response.read_body{
"id": "chatcmpl-CvJ2p8mQxK7nR4wS",
"object": "chat.completion",
"created": 1786705221,
"model": "gpt-6.1-sol",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Quantum entanglement means the states of two particles are correlated, so measuring one instantly determines the state of the other.",
"tool_calls": [
{}
]
},
"logprobs": {},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 18,
"completion_tokens": 42,
"total_tokens": 60,
"prompt_tokens_details": {
"cached_tokens": 0,
"cache_write_tokens": 0
},
"completion_tokens_details": {
"reasoning_tokens": 16
}
}
}{
"error": {
"code": 400,
"message": "Unsupported parameter: 'stop' is not supported with this model.",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/credits"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}API tous modèles GPT - Référence complète Chat Completions
- API Chat Completions compatible OpenAI pour les modèles de texte de la série GPT ; le modèle précis est choisi via
model(toutes les valeurs possibles figurent dans le tableau comparatif du paramètremodel) - Toute la série est composée de modèles de raisonnement ; la profondeur se contrôle via
reasoning_effortet les tokens de raisonnement sont facturés comme des tokens de sortie - Le cache de prompts s’applique automatiquement : les tokens d’entrée servis depuis le cache sont facturés au tarif de cache, plus bas
- Prend en charge les modes synchrone et streaming (SSE)
- Prend en charge une entrée mixte texte et image, ainsi que les appels d’outils
function - Les outils côté serveur (recherche web, exécution de code, recherche documentaire, MCP) ne sont proposés que sur l’API Responses
- Remarque Le périmètre de prise en charge des paramètres d’échantillonnage (
temperature,top_p,logprobs, etc.) varie selon le modèle ; voir les notes de chaque paramètre ci-dessous
GPT-6 : gpt-6-sol / gpt-6-luna utilisent medium par défaut. Les appels de fonctions dans Chat Completions exigent explicitement reasoning_effort: "none". gpt-6-astra et gpt-6.1-sol ne prennent pas en charge none ; utilisez Responses pour les fonctions. Le niveau max de GPT-6 est disponible uniquement dans Responses.
curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "gpt-6.1-sol",
"messages": [
{
"role": "user",
"content": "Explique l’intrication quantique en une phrase."
}
]
}
'import requests
url = "https://direct.evolink.ai/v1/chat/completions"
payload = {
"model": "gpt-6.1-sol",
"messages": [
{
"role": "user",
"content": "Explique l’intrication quantique en une phrase."
}
]
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({
model: 'gpt-6.1-sol',
messages: [{role: 'user', content: 'Explique l’intrication quantique en une phrase.'}]
})
};
fetch('https://direct.evolink.ai/v1/chat/completions', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://direct.evolink.ai/v1/chat/completions",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gpt-6.1-sol',
'messages' => [
[
'role' => 'user',
'content' => 'Explique l’intrication quantique en une phrase.'
]
]
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://direct.evolink.ai/v1/chat/completions"
payload := strings.NewReader("{\n \"model\": \"gpt-6.1-sol\",\n \"messages\": [\n {\n \"role\": \"user\",\n \"content\": \"Explique l’intrication quantique en une phrase.\"\n }\n ]\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://direct.evolink.ai/v1/chat/completions")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"model\": \"gpt-6.1-sol\",\n \"messages\": [\n {\n \"role\": \"user\",\n \"content\": \"Explique l’intrication quantique en une phrase.\"\n }\n ]\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://direct.evolink.ai/v1/chat/completions")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"model\": \"gpt-6.1-sol\",\n \"messages\": [\n {\n \"role\": \"user\",\n \"content\": \"Explique l’intrication quantique en une phrase.\"\n }\n ]\n}"
response = http.request(request)
puts response.read_body{
"id": "chatcmpl-CvJ2p8mQxK7nR4wS",
"object": "chat.completion",
"created": 1786705221,
"model": "gpt-6.1-sol",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Quantum entanglement means the states of two particles are correlated, so measuring one instantly determines the state of the other.",
"tool_calls": [
{}
]
},
"logprobs": {},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 18,
"completion_tokens": 42,
"total_tokens": 60,
"prompt_tokens_details": {
"cached_tokens": 0,
"cache_write_tokens": 0
},
"completion_tokens_details": {
"reasoning_tokens": 16
}
}
}{
"error": {
"code": 400,
"message": "Unsupported parameter: 'stop' is not supported with this model.",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/credits"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.function ordinaires.reasoning_effort: "none" sur cet endpoint. Utilisez Responses pour les appels de fonctions avec Astra et 6.1 Sol, ou pour le niveau max de GPT-6.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Authorization: Bearer YOUR_API_KEY
Corps
Modèle à appeler :
| ID du modèle | Fenêtre de contexte | Positionnement |
|---|---|---|
gpt-6.1-sol | 1,050,000 | Nouvelle version de Sol : performances proches d’Astra pour un coût moindre (recommandé) |
gpt-6-astra | 1 050 000 | Raisonnement phare pour les tâches de bout en bout exigeantes |
gpt-6-sol | 1,050,000 | Programmation complexe et workflows agentiques |
gpt-6-luna | 1,050,000 | Classification et extraction à grand volume et à coût réduit |
gpt-5.6-sol | 1 050 000 | Famille GPT-5.6, raisonnement de pointe |
gpt-5.6-terra | 1 050 000 | Famille GPT-5.6, production équilibrée |
gpt-5.6-luna | 1 050 000 | Famille GPT-5.6, débit élevé et maîtrise des coûts |
gpt-5.5 | 400 000 | Modèle de raisonnement polyvalent |
gpt-5.4 | 128 000 | Modèle de raisonnement polyvalent |
gpt-5.2 | 400 000 | Modèle de raisonnement polyvalent |
gpt-5.1 | 400 000 | Modèle de raisonnement polyvalent |
gpt-6.1-sol, gpt-6-astra, gpt-6-sol, gpt-6-luna, gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-5.5, gpt-5.4, gpt-5.2, gpt-5.1 "gpt-6.1-sol"
Liste des messages de chat, prenant en charge le contexte multi-tours et l'entrée multimodale.
role peut valoir system / developer / user / assistant / tool.
content peut être une chaîne de caractères ou un tableau de blocs de contenu. Deux types de blocs sont pris en charge : text (texte) et image_url (image) :
"content": [ { "type": "text", "text": "Que voit-on sur cette image ?" }, { "type": "image_url", "image_url": { "url": "https://example.com/photo.png", "detail": "auto" } } ]
Image
- Transmettez dans
image_url.urll'URL publique de l'image image_urlpeut aussi s'écrire directement sous forme de chaîne, équivalent à{ "url": "..." }detailcontrôle la précision d'analyse de l'image :auto(par défaut) /low/high/original- L'image doit pouvoir être téléchargée, sinon
400est retourné
Remarque Les types de blocs de cette API diffèrent de ceux de l'API Responses (qui utilise input_text / input_image). Ils ne peuvent pas être mélangés ; une erreur de type retourne 400.
Point de cache explicite pour GPT-6 / GPT-5.6 dans un bloc de contenu. Quatre écritures maximum par requête ; un point implicite occupe un emplacement. prompt_cache_breakpoint: {"mode": "explicit"}.
Show child attributes
Show child attributes
[ { "role": "system", "content": "You are a concise assistant." }, { "role": "user", "content": "Explain quantum entanglement in one sentence." } ]
Indique si la réponse est retournée en flux (flux d'événements SSE se terminant par data: [DONE]). Valeur par défaut false.
false
Nombre maximal de tokens générés, raisonnement compris. Privilégiez max_completion_tokens. GPT-6 convertit l’ancien champ max_tokens ; si les deux sont fournis, max_completion_tokens est conservé et max_tokens supprimé. GPT-6 Astra / Sol / Luna et GPT-6.1 Sol acceptent jusqu’à 128 000 tokens de sortie.
2048
Contrôle de la profondeur de raisonnement. Les valeurs possibles varient selon le modèle :
| Modèle | Valeurs possibles |
|---|---|
gpt-6-astra / gpt-6.1-sol | low, medium, high, xhigh |
gpt-6-sol / gpt-6-luna | none, low, medium, high, xhigh |
gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 | none, low, medium, high, xhigh |
gpt-5.4 / gpt-5.2 / gpt-5.1 | low, medium, high, xhigh |
Les tokens de raisonnement sont facturés comme des tokens de sortie et comptabilisés dans usage.completion_tokens_details.reasoning_tokens.
GPT-6 utilise medium par défaut. gpt-6-astra et gpt-6.1-sol ne prennent pas en charge none ; gpt-6-sol / gpt-6-luna le permettent. Le niveau max de GPT-6 est réservé à Responses.
none, low, medium, high, xhigh "medium"
Niveau de détail de la réponse : low / medium / high.
GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.
Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :
Remarque Pris en charge par gpt-6-astra, gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna et gpt-5.5 ; les autres modèles ne prennent pas en charge ce paramètre.
low, medium, high "low"
Température d'échantillonnage, valeurs de 0 à 2. Plus la valeur est basse, plus la sortie est déterministe.
GPT-6 : omettez ce paramètre avec gpt-6-astra et gpt-6.1-sol. Avec gpt-6-sol / gpt-6-luna, il est réglable uniquement avec un effort none ; omettez-le aux autres niveaux. Sans effort explicite, la valeur est medium, pas none.
Modèles existants : gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 permettent un réglage ; la famille gpt-5.6 accepte uniquement la valeur par défaut 1.
0 <= x <= 21
Paramètre d'échantillonnage nucléus, valeurs de 0 à 1. Il est déconseillé de l'ajuster en même temps que temperature.
GPT-6 : omettez ce paramètre avec gpt-6-astra et gpt-6.1-sol. Avec gpt-6-sol / gpt-6-luna, il est réglable uniquement avec un effort none ; omettez-le aux autres niveaux. Sans effort explicite, la valeur est medium, pas none.
Modèles existants : gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 permettent un réglage ; la famille gpt-5.6 accepte uniquement la valeur par défaut 1.
0 <= x <= 11
Pénalité de fréquence, valeurs de -2 à 2. Les valeurs positives pénalisent les tokens selon leur fréquence d'apparition et réduisent les contenus répétitifs.
GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.
Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :
Remarque Réglable uniquement sur gpt-5.4 / gpt-5.2 / gpt-5.1 ; la famille gpt-5.6 et gpt-5.5 ne permettent aucun réglage. GPT-6 Astra n'accepte que la valeur par défaut 0 ; toute autre valeur retourne 400.
-2 <= x <= 20
Pénalité de présence, valeurs de -2 à 2. Les valeurs positives encouragent le modèle à aborder de nouveaux sujets.
GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.
Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :
Remarque Réglable uniquement sur gpt-5.4 / gpt-5.2 / gpt-5.1 ; la famille gpt-5.6 et gpt-5.5 ne permettent aucun réglage. GPT-6 Astra n'accepte que la valeur par défaut 0 ; toute autre valeur retourne 400.
-2 <= x <= 20
Indique s'il faut retourner les probabilités logarithmiques de chaque token de sortie.
GPT-6 : Astra et 6.1 Sol ne prennent pas en charge les logprobs de sortie. Sol / Luna les permettent uniquement avec un effort none. Aux autres niveaux, retirez logprobs, top_logprobs et message.output_text.logprobs de include dans Responses.
Les règles suivantes pour les modèles existants excluent GPT-6 Sol / Luna et GPT-6.1 Sol :
Remarque Pris en charge uniquement par gpt-5.4 / gpt-5.2 / gpt-5.1 ; la famille gpt-5.6 et gpt-5.5 ne prennent pas en charge ce paramètre.
GPT-6 Astra et GPT-6.1 Sol ne prennent pas en charge ce paramètre.
true
Nombre de tokens candidats retournés à chaque position, valeurs de 0 à 20 ; doit être utilisé avec logprobs: true.
Remarque Même périmètre de prise en charge que logprobs.
GPT-6 : Astra et 6.1 Sol ne prennent pas en charge les logprobs de sortie. Sol / Luna les permettent uniquement avec un effort none. Aux autres niveaux, retirez logprobs, top_logprobs et message.output_text.logprobs de include dans Responses.
0 <= x <= 202
Nombre de réponses candidates à générer, retournées sous forme de plusieurs entrées dans le tableau choices. Tous les tokens (y compris la sortie de chaque candidate) sont facturés.
GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.
1
Graine aléatoire. Avec la même graine et la même combinaison de paramètres, le modèle s'efforce de retourner des résultats cohérents (au mieux ; une reproductibilité totale n'est pas garantie).
GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.
42
Contrôle du format de sortie :
{"type": "text"}: texte libre, la valeur par défaut{"type": "json_object"}: retourne un JSON valide et exige que le motjsonfigure dansmessages, sinon400est retourné{"type": "json_schema", "json_schema": {...}}: retourne des résultats structurés conformes au JSON Schema fourni ; associez-le à"strict": truepour imposer la conformité au schéma
Show child attributes
Show child attributes
Liste d'outils, utilisée pour le Function Calling (appels de fonctions côté client, sans frais à l'appel).
Les outils côté serveur (recherche web, exécution de code, etc.) ne sont pas proposés sur cette API ; utilisez plutôt l'API Responses.
GPT-6 : gpt-6-sol / gpt-6-luna utilisent medium par défaut. Les appels de fonctions dans Chat Completions exigent explicitement reasoning_effort: "none". gpt-6-astra et gpt-6.1-sol ne prennent pas en charge none ; utilisez Responses pour les fonctions. Le niveau max de GPT-6 est disponible uniquement dans Responses.
Show child attributes
Show child attributes
Contrôle du choix des outils : "auto" (par défaut) / "none" / "required", ou un objet désignant une fonction précise, comme {"type": "function", "function": {"name": "get_weather"}}.
none, auto, required Indique si le modèle peut appeler plusieurs outils en parallèle au cours d'un même tour. Valeur par défaut true ; avec false, les appels sont forcés un par un.
GPT-6 Sol / Luna et GPT-6.1 Sol : la prise en charge de ce paramètre reste à confirmer ; omettez-le dans les requêtes de base.
true
Clé de regroupement du cache. GPT-6 / GPT-5.6 gèrent automatiquement le routage ; ce champ n’est pas nécessaire pour l’optimiser. Des clés distinctes séparent la réutilisation et la comptabilisation par client ou utilisateur. Gardez une clé stable pour les requêtes partageant un préfixe réutilisable. Pour les modèles antérieurs, elle peut faciliter le routage du cache.
"app-chat-v1"
Identifiant de l'utilisateur final, utilisé pour distinguer l'origine des appels.
"user-1024"
Options de cache pour GPT-6 et GPT-5.6. Les points implicites sont utilisés par défaut. mode: "explicit" utilise uniquement les points explicites ; sans point, aucune mise en cache.
Show child attributes
Show child attributes
{ "ttl": "30m", "mode": "implicit" }
Réponse
Génération de la conversation réussie (objet JSON ; avec stream=true, un flux d'événements SSE se terminant par data: [DONE])
Identifiant unique de cette conversation
"chatcmpl-CvJ2p8mQxK7nR4wS"
Type de réponse
chat.completion "chat.completion"
Horodatage de création
1786705221
Nom du modèle réellement utilisé
"gpt-6.1-sol"
Liste des résultats générés (sa longueur est égale à n dans la requête)
Show child attributes
Show child attributes
Statistiques d'utilisation des tokens. Le cache de prompts s'applique automatiquement ; les tokens d'entrée servis depuis le cache sont facturés au tarif de cache, plus bas.
GPT-6 facture séparément les entrées hors cache, les lectures et écritures du cache et les sorties. Au-delà de 272 000 tokens en entrée, toute la requête est facturée à 2× les tarifs des entrées et du cache et à 1,5× le tarif des sorties. La génération d’images intégrée est facturée séparément. Voir les tarifs actuels.
Show child attributes
Show child attributes