Claude Opus 5 API
Choisir Claude Opus 5
Le tout dernier modèle phare de gamme Opus d’Anthropic pour le code le plus difficile, les agents de longue durée et les revues exigeant du jugement. Cinq dimensions de facturation — entrée, écriture de cache, lecture de cache, sortie et outil de recherche web — sont mesurées séparément, avec des tarifs de tokens 5 % sous les tarifs officiels.
Claude Opus 5
Modèle phare de gamme Opus d’Anthropic
claude-opus-5Ingénierie logicielle à l’échelle du dépôt, longues exécutions d’agents avec usage intensif d’outils, revues de code à fort enjeu, et travaux de recherche ou d’analyse où une mauvaise réponse coûte plus cher qu’un tarif premium au token.
Tarifs de Claude Opus 5
Estimez une requête avec le calculateur de tarifs interactif. Les tarifs de tokens EvoLink sont 5 % sous les tarifs officiels d’Anthropic.
Calculateur de tokens
Saisissez la répartition des tokens et les recherches web d’une requête.Coût estimé de la requête
Claude Opus 5Facturation minimale : 0,01 crédit par requête.
EvoLink vs Anthropic en direct
Même répartition de tokens avec les tarifs EvoLink affichés.Guide de budget
Nombre approximatif de requêtes avec la répartition actuelle.Pour des tests rapides
Pour le développement courant
Pour l’évaluation en production
Tarifs du modèle
| Modèle | Contexte | Tokens d’entrée | Tokens d’écriture du cache | Tokens de lecture du cache | Tokens de sortie | Recherches web |
|---|---|---|---|---|---|---|
Claude Opus 5claude-opus-5 | Toutes tailles de contexte | $4.750 / 1M-5% 323 cr / 1M$5.000tarif officiel | $5.939 / 1M-5% 403.8 cr / 1M$6.250tarif officiel | $0.475 / 1M-5% 32.3 cr / 1M$0.500tarif officiel | $23.750 / 1M-5% 1615 cr / 1M$25.000tarif officiel | $0.010 / recherche0.68 cr / recherche |
Claude Opus 5
Toutes tailles de contexteLes prix en USD et en crédits sont affichés par million de tokens. Avant la mise en production, vérifiez les tarifs actuellement indiqués dans le tableau.
L’outil de recherche web est facturé par recherche au tarif officiel, en plus des tokens que les résultats ajoutent à la requête.
API Claude Opus 5 pour le code et les agents les plus exigeants
Utilisez le dernier modèle phare de la gamme Opus d’Anthropic via l’API unifiée d’EvoLink à 4,75 $ par million de tokens d’entrée et 23,75 $ par million de tokens de sortie, soit 5 % sous le tarif officiel. Avec une fenêtre de contexte de 1 000 000 tokens, une sortie maximale de 128K, un cache de prompts aux tarifs d’écriture et de lecture distincts, et la recherche web facturée par recherche.

Cache de prompts facturé sur deux dimensions distinctes
Claude facture l’écriture d’un préfixe dans le cache, puis applique un tarif de lecture nettement inférieur lors de sa réutilisation. Pour les prompts système stables, les instructions de dépôt et les schémas d’outils, les frais d’écriture ne s’appliquent qu’une fois ; les lectures suivantes sont ensuite facturées à bas coût.
Contexte de 1M tokens avec sortie max de 128K
Gardez ensemble code, spécifications, documents et état de l’agent dans un même contexte de travail. Traitez la limite comme une capacité et non comme un objectif : récupérez les éléments pertinents, mettez le préfixe stable en cache et fixez des budgets de sortie adaptés.
Thinking et effort modifient la latence et l’usage des tokens
Anthropic active la pensée adaptative par défaut sur Opus 5 et l’API Claude utilise effort high par défaut. Avant la production, vérifiez la prise en charge des paramètres par l’endpoint EvoLink choisi et mesurez la réponse réelle, les tokens de sortie et la latence. max_tokens n’est pas un budget de thinking.
Rejouer des charges réelles avant de déplacer le trafic de production
Un même tarif au token ne garantit pas le même coût par tâche terminée. Le comportement du modèle et la tokenisation peuvent modifier les tokens facturés, les nouvelles tentatives et les parcours d’outils. Comparez le taux de réussite, le coût total et les corrections humaines sur des échantillons réels de production.
Là où Claude Opus 5 justifie son tarif premium
Les tarifs de gamme Opus ne sont rentables que si la tâche est assez difficile pour qu’une meilleure réponse supprime du travail en aval. Routez selon le coût de l’erreur, pas selon le coût par token.
Ingénierie logicielle à l’échelle du dépôt
Inspectez de grandes bases de code, suivez les dépendances entre services et planifiez des changements multi-fichiers tout en conservant les contraintes d’architecture dans un seul contexte. Mesurez les correctifs acceptés et le temps de revue, pas la qualité d’extraits isolés.
Agents de longue durée avec usage intensif d’outils
Orchestration multi-étapes, sélection d’outils et exécution de code sur de longues sessions, où une seule mauvaise branche coûte bien plus que l’écart de tokens. Rejouez les messages complets de l’assistant, les IDs d’appels d’outils, les arguments et les résultats à chaque tour.
Revue et analyse à fort enjeu
Revue de sécurité, planification de migration, analyse de contrats et de recherche, et tout cas où une réponse fausse mais assurée coûte cher. La fenêtre de 1M tokens garde l’ensemble des preuves au même endroit.
Quand une autre route vaut mieux
Le code quotidien, les agents à fort volume, la classification et le chat sensible à la latence relèvent généralement de Claude Sonnet 5. Claude Opus 4.8 bénéficie d’une remise plus forte sur EvoLink et reste la route Opus la moins chère tant que ses réponses suffisent.
Cinq dimensions de facturation, mesurées séparément
Claude Opus 5 ne se facture pas à un tarif global unique. Comprendre quelle dimension une charge de travail consomme réellement rend un budget de gamme Opus prévisible.
Tokens d’entrée et de sortie
Les deux dimensions que touche chaque requête : 4,75 $ par 1M de tokens d’entrée et 23,75 $ par 1M de tokens de sortie sur EvoLink, 5 % sous les 5,00 $ et 25,00 $ d’Anthropic. Sur les travaux de génération intensive, la sortie domine : plafonnez max_tokens selon la complexité.
Écriture et lecture du cache
Stocker un préfixe coûte 5,939 $ par 1M de tokens ; le réutiliser coûte 0,475 $ par 1M. Pour les prompts système stables, les instructions de dépôt et les schémas d’outils, les frais d’écriture ne s’appliquent qu’une fois ; les lectures suivantes coûtent environ un dixième du tarif d’entrée.
Outil de recherche web
La recherche web est facturée 0,01 $ par recherche, au tarif officiel sans remise. Les résultats ajoutent aussi des tokens d’entrée à la requête : une recherche intensive cumule donc les deux coûts.
Adopter Claude Opus 5 sans remplacer votre architecture de modèles
Conservez un seul client et une seule clé API EvoLink, routez les charges les plus difficiles vers Opus 5 et gardez des alternatives testées pour le trafic simple ou sensible à la latence.
Utiliser le flux client compatible existant
Pointez le client vers EvoLink, authentifiez-vous avec la même clé API et sélectionnez claude-opus-5. Le point de terminaison Chat Completions compatible OpenAI et celui d’Anthropic Messages fonctionnent tous deux.
Utiliser l’ID de modèle documenté
La route API est claude-opus-5 sur les deux protocoles. Pour ce modèle, l’URL de la page et le paramètre de modèle sont identiques.
Structurer les prompts pour réutiliser le cache
Placez le prompt système stable, les instructions de dépôt et les schémas d’outils en tête de requête afin d’écrire le préfixe coûteux une fois et de le lire à bas coût ensuite.
Orienter les requêtes selon la valeur du résultat
Comparez le taux de réussite, les reprises, les tokens de sortie, le taux de cache, la durée et les corrections humaines sur vos tâches — pas seulement le prix au token.
Copiez l’ID du modèle et envoyez votre première requête
Cette page produit ne conserve qu’une requête minimale vérifiable. Le guide API complet couvre thinking, effort, les appels d’outils, la gestion des échecs et la migration en production.
curl https://direct.evolink.ai/v1/messages \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{"role": "user", "content": "Review this pull request and list the blocking issues."}
]
}'Comparer les routes Claude après les tests de charge de travail
EvoLinkVérifiez d’abord si Opus 5 réduit les reprises et la revue. Comparez ensuite prix, contexte, cache et adéquation à la charge de travail.
| Modèle | Claude Opus 5 | Claude Opus 4.8 | Claude Sonnet 5 |
|---|---|---|---|
| Entrée / sortie | $4.75 / $23.75 | $4.5 / $22.5 | $1.8 / $9 |
| Contexte | 1M | 1M | 1M |
| Cache | Lecture + écriture | Lecture + écriture | Lecture + écriture |
| Idéal pour | Ingénierie logicielle à l’échelle du dépôt, longues exécutions d’agents avec usage intensif d’outils, revues de code à fort enjeu, et travaux de recherche ou d’analyse où une mauvaise réponse coûte plus cher qu’un tarif premium au token. | Le précédent fleuron Opus, toujours la route Opus la moins chère sur EvoLink pour le code premium et le travail d’agents. | Des performances de code et d’agents proches d’Opus au tarif équilibré de Sonnet pour le trafic de production quotidien. |
Autres modèles Claude sur EvoLink

Claude Opus 4.8
Le précédent fleuron Opus, avec une remise EvoLink plus forte pour les charges qu’il traite encore de façon fiable.
Voir le modèle
Claude Sonnet 5
Une route plus équilibrée pour le code quotidien, les agents à fort volume et le trafic de production sensible à la latence.
Voir le modèle
Claude Fable 5
Une route Claude plus performante pour les agents les plus longs et les plus exigeants lorsque la qualité prime sur le coût.
Voir le modèle
Claude Haiku 4.5
La route Claude la plus rapide et la moins chère pour les sous-agents, la classification à fort volume et le chat à faible latence.
Voir le modèleAutres modèles de texte

GPT-5.6
La gamme de modèles de pointe d’OpenAI pour router selon les capacités, la latence et le coût.
Voir le modèle
Grok 4.5
La route de raisonnement et d’outils de xAI avec un contexte de 500K et une recherche côté serveur.
Voir le modèle
Kimi K3
Un modèle de raisonnement à contexte long pour le code à l’échelle d’un dépôt et le travail multi-document.
Voir le modèle
Gemini 3.6 Flash
Une route rapide et économique pour le trafic qui ne nécessite pas le niveau de jugement d’Opus.
Voir le modèleÀ lire également

Suivi de la sortie de Claude Opus 6
Suivez la prochaine génération Opus sans présenter la date, l’accès à l’API, l’identifiant, le prix ou les spécifications comme confirmés.
Lire le guide
Claude Opus 5 vs Claude Opus 4.8
Quelle route Opus faire tourner en production, et ce qui doit progresser pour qu’Opus 5 vaille sa remise plus faible.
Lire le guide
Claude Opus 5 vs Claude Fable 5
Quand Opus 5 doit devenir le défaut premium et quand Fable 5 justifie deux fois le prix officiel par token.
Lire le guide
Claude Opus 5 vs GPT-5.6
Comment les deux routes de pointe se comparent sur les dimensions tarifaires, le contexte et les charges de travail d’agents.
Lire le guide
GPT-6 vs Claude Opus 5 après Astra
Comparez les faits vérifiables d’Opus 5 aux affirmations non résolues sur Astra et GPT-6 sans inventer de spécifications.
Lire le guide
Guide de l’API Claude Opus 5
Effectuez le premier appel, réglez thinking et effort, puis suivez les contrôles de migration et de production.
Lire le guideFAQ de l’API Claude Opus 5
L’API Claude Opus 5 est-elle disponible via EvoLink ?
Oui. Claude Opus 5 est disponible sur EvoLink comme route de production avec l’ID de modèle "claude-opus-5".
Quel ID de modèle utiliser pour l’API Claude Opus 5 ?
Envoyez le modèle "claude-opus-5". Le même ID fonctionne pour le point de terminaison Chat Completions compatible OpenAI et pour le point de terminaison Messages d’Anthropic.
Combien coûte l’API Claude Opus 5 sur EvoLink ?
Les tarifs EvoLink sont 5 % sous le tarif officiel : 4,75 $ par 1M de tokens d’entrée et 23,75 $ par 1M de tokens de sortie, contre 5,00 $ et 25,00 $ chez Anthropic.
Comment le cache de prompts de Claude Opus 5 est-il facturé ?
L’écriture et la lecture du cache sont des dimensions distinctes : 5,939 $ par 1M de tokens d’écriture et 0,475 $ par 1M de tokens de lecture sur EvoLink, contre 6,25 $ et 0,50 $ officiels.
Comment l’outil de recherche web de Claude Opus 5 est-il facturé ?
La recherche web est facturée 0,01 $ par recherche, le tarif officiel sans remise. Les tokens ajoutés à la requête par les résultats sont facturés normalement.
Quels protocoles et SDK fonctionnent avec Claude Opus 5 ?
Utilisez le point de terminaison Chat Completions compatible OpenAI ou le point de terminaison Messages d’Anthropic avec la même clé API EvoLink. Claude Code et les autres clients natifs Anthropic fonctionnent en pointant l’URL de base vers EvoLink.
Quelle fenêtre de contexte et quelle sortie maximale Claude Opus 5 prend-il en charge ?
La route EvoLink enregistre une fenêtre de contexte de 1 000 000 tokens avec jusqu’à 128K tokens de sortie par réponse.
Thinking est-il activé par défaut sur Claude Opus 5 ?
Anthropic active la pensée adaptative par défaut sur Opus 5 et l’API Claude utilise effort high par défaut. Vérifiez dans la documentation et avec une requête réelle que l’endpoint EvoLink choisi transmet les paramètres nécessaires.
À quelles charges de travail Claude Opus 5 convient-il ?
Claude Opus 5 convient au code particulièrement complexe, aux agents de longue durée utilisant de nombreux outils et aux revues critiques où une erreur entraîne un coût élevé.
Puis-je utiliser Claude Opus 5 avec d’autres routes de modèles ?
Oui. Avec le même client et la même clé API EvoLink, vous pouvez envoyer les tâches les plus difficiles à Claude Opus 5 et conserver d’autres routes testées pour les requêtes plus simples ou sensibles à la latence.
Que doit mesurer une évaluation en production de Claude Opus 5 ?
Mesurez la réussite au premier essai, les livrables acceptés, les reprises, les tokens de sortie, le taux de cache, les appels d’outils valides, le délai jusqu’au résultat accepté, la correction humaine et le taux de repli — pas seulement le tarif au token.