GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

GPT-6 Astra API

Accédez à GPT-6 Astra de OpenAI — aussi recherché sous GPT-6 / GPT 6 Astra / gpt-6-astra — via l'API de chat unifiée d'EvoLink. Testez le raisonnement, le codage, l'usage d'outils avant d'intégrer.

OpenAIGénération de texteDisponible
à partir de $9.000 / 1M tokens d’entrée$10.000 prix officiel-10%
Documentation API
Chat CompletionsResponses APIEffort de raisonnementCache de promptsAppel d'outils
Route productionLive
Contexte
1.05M de contexte · 128K de sortie max.
Idéal pour
Raisonnement frontière, code agentique, computer use
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée) · appels d'outils

Choisir GPT-6 Astra

Un seul model ID exact sur l’intégration compatible OpenAI. Les tarifs contexte court et contexte long des quatre rôles de tokens figurent sur la carte.

GPT-6 Astra

Le modèle le plus capable d’OpenAI, conçu pour le travail de bout en bout le plus difficile.

Sélectionné
ID du modèle
gpt-6-astra
Idéal pour

Raisonnement complexe, code agentique, computer use, recherche et création de documents

< 272K
Entrée
$9.000 / 1M-10%
612 cr / 1M$10.000prix officiel
Lecture cache
$0.900 / 1M-10%
61.2 cr / 1M$1.000prix officiel
Écriture cache
$11.250 / 1M-10%
765 cr / 1M$12.500prix officiel
Sortie
$45.000 / 1M-10%
3060 cr / 1M$50.000prix officiel
≥ 272K
Entrée
$18.000 / 1M-10%
1224 cr / 1M$20.000prix officiel
Lecture cache
$1.800 / 1M-10%
122.4 cr / 1M$2.000prix officiel
Écriture cache
$22.500 / 1M-10%
1530 cr / 1M$25.000prix officiel
Sortie
$67.500 / 1M-10%
4590 cr / 1M$75.000prix officiel

Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte. Au-delà de 272K tokens de prompt, le palier long contexte s'applique : ×2 pour l'entrée et les rôles de cache, ×1.5 pour la sortie.

Tarifs GPT-6 Astra

Estimez le coût d'une requête GPT-6 Astra avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.

Calculateur de requête

Saisissez la répartition des tokens d'une requête.

Coût estimé par requête

GPT-6 Astra
Tarif contexte court
USD$0.023
Crédits1.5423

Estimation officielle $0.026 · économie $0.0026 (10%)

Tokens d'entrée0.612 cr
Tokens lus en cache0.0123 cr
Tokens écrits en cache0 cr
Tokens de sortie0.918 cr

Facturation minimale : 0.01 crédit par requête. À partir de 272K tokens de prompt, l'entrée et les rôles de cache sont facturés ×2, la sortie ×1.5. Les appels d'outils ne sont pas multipliés.

Guide budgétaire

Nombre approximatif de requêtes avec la répartition actuelle.
Ajouter des crédits
$10
Environ 440 requêtes

Pour des tests rapides

$50
Environ 2204 requêtes

Pour le développement courant

$100
Environ 4408 requêtes

Pour l'évaluation en production

API GPT-6 Astra

Le modèle le plus performant d’OpenAI, conçu pour les tâches de bout en bout les plus difficiles — raisonnement complexe, codage agentique, computer use, recherche et création de documents — disponible via une seule clé API EvoLink avec Chat Completions et Responses.

GPT-6 Astra est servi sur EvoLink sous l'ID de modèle gpt-6-astra via Chat Completions · Responses, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 1.05M et jusqu'à 128K tokens de sortie, ainsi que le raisonnement, le codage, l'usage d'outils.

GPT-6 Astra

Spécifications et capacités de GPT-6 Astra

Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.

Fenêtre de contexte
1.05M tokens
Sortie max.
128K tokens
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée) · appels d'outils
Raisonnement
Effort de raisonnement configurable
Usage d'outils
Appels de fonctions avec séquences d'outils multi-étapes
Cache de prompt
Tarifs écriture + lecture de cache
Palier long contexte
×2 entrée / ×1.5 sortie au-delà de 272K tokens de prompt
Protocoles
Chat Completions · Responses
ID du modèle
gpt-6-astra

À quoi GPT-6 Astra convient le mieux

Un seul model ID exact pour le travail de bout en bout le plus difficile ; gardez le trafic courant ou sensible à la latence sur une route plus légère.

Achever des tâches de code complexes

Traiter modifications multifichiers, tests, débogage et longues implémentations au lieu de seulement suggérer du code plausible.

Continuer pendant l’exécution des outils

Avec les outils asynchrones, Astra peut raisonner ou traiter un travail indépendant pendant qu’une fonction lente s’exécute, puis reprendre son résultat via l’ID d’appel.

Exploiter un long contexte projet

Garder davantage de dépôt, documents, exigences et résultats d’outils dans 1,05 M de tokens ; la récupération et le respect des contraintes doivent être testés.

Rechercher et créer des livrables

Combiner navigation, code, données et raisonnement scientifique, puis créer ou réviser documents, feuilles de calcul, présentations, sites web et autres livrables structurés.

Deux façons d'utiliser GPT-6 Astra : API EvoLink ou Agent

Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez GPT-6 Astra depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.

Option 1

Intégrer avec l'API EvoLink

Idéal pour : backends produit, traitements par lots, pipelines automatisés

Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.

  1. 1Créez une clé API EvoLink dans la console
  2. 2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
  3. 3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
  4. 4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Option 2

L'appeler avec un Agent

Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini

Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle GPT-6 Astra via EvoLink et renvoie la réponse avec la consommation de tokens.

  1. 1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
  2. 2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
  3. 3Demandez à l'Agent d'appeler GPT-6 Astra via EvoLink et d'afficher la requête avant l'envoi
  4. 4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur

Exemple de code API GPT-6 Astra et gestion des erreurs

Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.

Voir la documentation API complète
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "reasoning_effort": "high",
    "max_tokens": 4096
  }'

# There is no generic gpt-6 alias: use the exact ID gpt-6-astra on both
# Chat Completions and Responses. reasoning_effort accepts low, medium,
# high, xhigh, and max; reasoning tokens are billed as output. The
# response includes choices[0].message and a usage object (prompt_tokens,
# completion_tokens, and cached tokens when a prefix is reused).

Requête invalide ou paramètre non pris en charge

Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.

Problème d'authentification ou de solde

Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.

Longueur de contexte dépassée

Les tokens du prompt dépassent la fenêtre de contexte de GPT-6 Astra. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.

Limite de débit (429)

Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.

Contenu ou appel d'outil rejeté

Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.

Avant de passer GPT-6 Astra en production

Quatre vérifications qui décident du coût et de la stabilité.

01

Choisir l’ID de modèle GPT-6 Astra exact

Utilisez gpt-6-astra sur Chat Completions et Responses ; il n’existe pas d’alias générique gpt-6.

Obligatoire
02

Prévoir le seuil de long contexte de 272K

Au-delà de 272K tokens de prompt, toute la requête passe au tarif long contexte ; restez en dessous quand c’est possible.

Recommandé
03

Structurer les prompts pour les lectures de cache

Placez les instructions stables et les références en premier pour que les lectures de cache remplacent l’entrée au plein tarif.

Recommandé
04

Mesurer avec usage, pas avec le prix catalogue

Rapprochez le coût depuis l’objet usage (entrée non mise en cache, lecture, écriture, sortie) avant de monter en charge.

Obligatoire

Cache de prompt en quatre parties

L’entrée non cachée, les lectures de cache, les écritures de cache et la sortie sont réglées séparément à partir de l’objet d’usage final. Les écritures de cache ne sont pas refacturées comme entrée ordinaire.

Seuil de contexte long

Au-delà de 272K tokens de prompt, l’entrée et les deux rôles de cache passent à 2× et la sortie à 1,5× pour la requête entière.

GPT-6 Astra face aux autres modèles de pointe

EvoLink

Comparez GPT-6 Astra avec Claude Fable 5.1 et GPT-5.6 Sol selon les prix EvoLink par 1M de tokens.

GPT-6 Astra
Prix EvoLink / 1M (entrée / sortie)$9 / $45
Fenêtre de contexte1.05M
Cache de promptLecture + écriture de cache
Idéal pourRaisonnement complexe, code agentique, computer use, recherche et création de documents
Claude Fable 5.1
Prix EvoLink / 1M (entrée / sortie)$9.5 / $47.5
Fenêtre de contexte1M
Cache de promptLecture de cache + écriture 5 min / 1 h
Idéal pourRaisonnement profond, longues sessions agentiques et code intensif en cache
GPT-5.6 Sol
Prix EvoLink / 1M (entrée / sortie)$4.5 / $27
Fenêtre de contexte1.05M
Cache de promptLecture + écriture de cache
Idéal pourRaisonnement exigeant et agents de code sur la génération GPT précédente, avec les niveaux Sol, Terra et Luna

Les prix en contexte de base utilisent le groupe d’utilisateurs EvoLink actuel. Les utilisateurs connectés voient les tarifs de leur groupe ; les autres voient les tarifs Default. Les multiplicateurs long contexte figurent dans la section Tarifs.

Famille de modèles GPT

Même clé API, même solde : changez de palier sans toucher à l’intégration.

Comparer tous les modèles GPT
GPT-5.6

GPT-5.6

Paliers Sol, Terra et Luna — même intégration, prix plus bas

Voir le modèle
GPT-5.5

GPT-5.5

Précédent modèle phare, contexte de 1M

Voir le modèle
GPT-5.4

GPT-5.4

Prédécesseur équilibré avec computer use

Voir le modèle

Autres modèles texte sur EvoLink en plus de GPT-6 Astra

Claude Fable 5.1

Claude Fable 5.1

Modèle phare d’Anthropic au même prix catalogue qu’Astra, avec thinking adaptatif toujours actif et contexte de 1M.

Voir le modèle
Kimi K3

Kimi K3

Route de raisonnement phare de Moonshot avec 1,05 M de contexte, performante en front-end visuel et en codage à l'échelle du dépôt.

Voir le modèle
Gemini 3.1 Pro

Gemini 3.1 Pro

Modèle phare de Google pour le raisonnement multimodal et les charges à grand contexte.

Voir le modèle
Grok 4.6

Grok 4.6

Route xAI de raisonnement et d’outils avec recherche côté serveur pour la recherche et les workflows d’agents.

Voir le modèle

API GPT-6 Astra – FAQ

Quel model ID utiliser ?

Utilisez gpt-6-astra. Il n’existe pas d’alias générique gpt-6, et le même ID fonctionne sur Chat Completions et Responses.

Combien coûte GPT-6 Astra sur EvoLink ?

Les tarifs du groupe par défaut EvoLink sont de $9.000 en entrée et $45.000 en sortie par 1M de tokens, contre $10.000 / $50.000 au catalogue OpenAI. Les lectures de cache coûtent $0.900 et les écritures $11.250 par 1M de tokens ; les utilisateurs connectés voient les tarifs de leur groupe.

Comment l’entrée en cache est-elle facturée ?

Les lectures et les écritures de cache sont des segments de tokens distincts. Aucun n’est refacturé comme entrée ordinaire.

Quand les tarifs contexte long s’appliquent-ils ?

Lorsque le total des tokens de prompt dépasse 272 000, la requête entière utilise les multiplicateurs de contexte long : 2× pour l’entrée et les deux rôles de cache, 1,5× pour la sortie.

Quels niveaux d’effort de raisonnement sont pris en charge ?

reasoning_effort sur Chat Completions et reasoning.effort sur Responses acceptent low, medium, high, xhigh et max. Un effort plus élevé consomme plus de tokens de raisonnement, facturés comme sortie.

Quels sont la fenêtre de contexte et la sortie maximale ?

GPT-6 Astra dispose d’une fenêtre de contexte de 1 050 000 tokens et jusqu’à 128 000 tokens de sortie par requête.