Seedance 2.5 est disponible sur EvoLinkEssayer Seedance 2.5

Claude Opus 5 API

Anthropic-Génération de texte-à partir de $4.750 / 1M tokens d’entrée$5.000 tarif officiel-Disponible
Contexte 1MSortie max 128KCache de prompts lecture + écritureOutil de recherche webChat + Messages API
Route de productionActive
Statut de sortie et chronologie de Claude Opus 5
Fournisseur
Anthropic
Modèle
Opus 5
Fenêtre de contexte
1 000 000 tokens
Protocoles
Chat + Messages

Choisir Claude Opus 5

Le tout dernier modèle phare de gamme Opus d’Anthropic pour le code le plus difficile, les agents de longue durée et les revues exigeant du jugement. Cinq dimensions de facturation — entrée, écriture de cache, lecture de cache, sortie et outil de recherche web — sont mesurées séparément, avec des tarifs de tokens 5 % sous les tarifs officiels.

Claude Opus 5

Modèle phare de gamme Opus d’Anthropic

Sélectionné
À partir de $4.750 / 1M tokens d’entrée$5.000 tarif officielclaude-opus-5
Idéal pour

Ingénierie logicielle à l’échelle du dépôt, longues exécutions d’agents avec usage intensif d’outils, revues de code à fort enjeu, et travaux de recherche ou d’analyse où une mauvaise réponse coûte plus cher qu’un tarif premium au token.

Entrée
$4.750 / 1M-5%
323 cr / 1M$5.000tarif officiel
Écriture du cache
$5.939 / 1M-5%
403.8 cr / 1M$6.250tarif officiel
Lecture du cache
$0.475 / 1M-5%
32.3 cr / 1M$0.500tarif officiel
Sortie
$23.750 / 1M-5%
1615 cr / 1M$25.000tarif officiel
Recherches web$0.010 / recherche0.68 cr / recherche

Tarifs de Claude Opus 5

Estimez une requête avec le calculateur de tarifs interactif. Les tarifs de tokens EvoLink sont 5 % sous les tarifs officiels d’Anthropic.

Opus 5

Calculateur de tokens

Saisissez la répartition des tokens et les recherches web d’une requête.

Coût estimé de la requête

Claude Opus 5
5 % sous le tarif officiel
USD$0.012
Credits0.814
Tokens d’entrée0.323 cr
Tokens d’écriture du cache0 cr
Tokens de lecture du cache0.0065 cr
Tokens de sortie0.4845 cr
Recherches web0 cr

Facturation minimale : 0,01 crédit par requête.

EvoLink vs Anthropic en direct

Même répartition de tokens avec les tarifs EvoLink affichés.
-5%
Estimation EvoLink$0.012
Anthropic officiel$0.013
Vous économisez$0.0007

Guide de budget

Nombre approximatif de requêtes avec la répartition actuelle.
Ajouter des crédits
$10
Environ 835 requêtes

Pour des tests rapides

$50
Environ 4176 requêtes

Pour le développement courant

$100
Environ 8353 requêtes

Pour l’évaluation en production

Tarifs du modèle

Claude Opus 5

Toutes tailles de contexte
Tokens d’entrée
$4.750 / 1M-5%
323 cr / 1M$5.000tarif officiel
Tokens d’écriture du cache
$5.939 / 1M-5%
403.8 cr / 1M$6.250tarif officiel
Tokens de lecture du cache
$0.475 / 1M-5%
32.3 cr / 1M$0.500tarif officiel
Tokens de sortie
$23.750 / 1M-5%
1615 cr / 1M$25.000tarif officiel
Recherches web$0.010 / recherche0.68 cr / recherche

Les prix en USD et en crédits sont affichés par million de tokens. Avant la mise en production, vérifiez les tarifs actuellement indiqués dans le tableau.

L’outil de recherche web est facturé par recherche au tarif officiel, en plus des tokens que les résultats ajoutent à la requête.

API Claude Opus 5 pour le code et les agents les plus exigeants

Utilisez le dernier modèle phare de la gamme Opus d’Anthropic via l’API unifiée d’EvoLink à 4,75 $ par million de tokens d’entrée et 23,75 $ par million de tokens de sortie, soit 5 % sous le tarif officiel. Avec une fenêtre de contexte de 1 000 000 tokens, une sortie maximale de 128K, un cache de prompts aux tarifs d’écriture et de lecture distincts, et la recherche web facturée par recherche.

Claude Opus 5

Cache de prompts facturé sur deux dimensions distinctes

Claude facture l’écriture d’un préfixe dans le cache, puis applique un tarif de lecture nettement inférieur lors de sa réutilisation. Pour les prompts système stables, les instructions de dépôt et les schémas d’outils, les frais d’écriture ne s’appliquent qu’une fois ; les lectures suivantes sont ensuite facturées à bas coût.

Contexte de 1M tokens avec sortie max de 128K

Gardez ensemble code, spécifications, documents et état de l’agent dans un même contexte de travail. Traitez la limite comme une capacité et non comme un objectif : récupérez les éléments pertinents, mettez le préfixe stable en cache et fixez des budgets de sortie adaptés.

Thinking et effort modifient la latence et l’usage des tokens

Anthropic active la pensée adaptative par défaut sur Opus 5 et l’API Claude utilise effort high par défaut. Avant la production, vérifiez la prise en charge des paramètres par l’endpoint EvoLink choisi et mesurez la réponse réelle, les tokens de sortie et la latence. max_tokens n’est pas un budget de thinking.

Rejouer des charges réelles avant de déplacer le trafic de production

Un même tarif au token ne garantit pas le même coût par tâche terminée. Le comportement du modèle et la tokenisation peuvent modifier les tokens facturés, les nouvelles tentatives et les parcours d’outils. Comparez le taux de réussite, le coût total et les corrections humaines sur des échantillons réels de production.

Cas d’usage de Claude Opus 5

Là où Claude Opus 5 justifie son tarif premium

Les tarifs de gamme Opus ne sont rentables que si la tâche est assez difficile pour qu’une meilleure réponse supprime du travail en aval. Routez selon le coût de l’erreur, pas selon le coût par token.

Ingénierie logicielle à l’échelle du dépôt

Inspectez de grandes bases de code, suivez les dépendances entre services et planifiez des changements multi-fichiers tout en conservant les contraintes d’architecture dans un seul contexte. Mesurez les correctifs acceptés et le temps de revue, pas la qualité d’extraits isolés.

Agents de longue durée avec usage intensif d’outils

Orchestration multi-étapes, sélection d’outils et exécution de code sur de longues sessions, où une seule mauvaise branche coûte bien plus que l’écart de tokens. Rejouez les messages complets de l’assistant, les IDs d’appels d’outils, les arguments et les résultats à chaque tour.

Revue et analyse à fort enjeu

Revue de sécurité, planification de migration, analyse de contrats et de recherche, et tout cas où une réponse fausse mais assurée coûte cher. La fenêtre de 1M tokens garde l’ensemble des preuves au même endroit.

Quand une autre route vaut mieux

Le code quotidien, les agents à fort volume, la classification et le chat sensible à la latence relèvent généralement de Claude Sonnet 5. Claude Opus 4.8 bénéficie d’une remise plus forte sur EvoLink et reste la route Opus la moins chère tant que ses réponses suffisent.

Modèle de facturation

Cinq dimensions de facturation, mesurées séparément

Claude Opus 5 ne se facture pas à un tarif global unique. Comprendre quelle dimension une charge de travail consomme réellement rend un budget de gamme Opus prévisible.

Tokens d’entrée et de sortie

Les deux dimensions que touche chaque requête : 4,75 $ par 1M de tokens d’entrée et 23,75 $ par 1M de tokens de sortie sur EvoLink, 5 % sous les 5,00 $ et 25,00 $ d’Anthropic. Sur les travaux de génération intensive, la sortie domine : plafonnez max_tokens selon la complexité.

Écriture et lecture du cache

Stocker un préfixe coûte 5,939 $ par 1M de tokens ; le réutiliser coûte 0,475 $ par 1M. Pour les prompts système stables, les instructions de dépôt et les schémas d’outils, les frais d’écriture ne s’appliquent qu’une fois ; les lectures suivantes coûtent environ un dixième du tarif d’entrée.

Outil de recherche web

La recherche web est facturée 0,01 $ par recherche, au tarif officiel sans remise. Les résultats ajoutent aussi des tokens d’entrée à la requête : une recherche intensive cumule donc les deux coûts.

Intégration en production

Adopter Claude Opus 5 sans remplacer votre architecture de modèles

Conservez un seul client et une seule clé API EvoLink, routez les charges les plus difficiles vers Opus 5 et gardez des alternatives testées pour le trafic simple ou sensible à la latence.

01

Utiliser le flux client compatible existant

Pointez le client vers EvoLink, authentifiez-vous avec la même clé API et sélectionnez claude-opus-5. Le point de terminaison Chat Completions compatible OpenAI et celui d’Anthropic Messages fonctionnent tous deux.

Migration faible
02

Utiliser l’ID de modèle documenté

La route API est claude-opus-5 sur les deux protocoles. Pour ce modèle, l’URL de la page et le paramètre de modèle sont identiques.

ID vérifié
03

Structurer les prompts pour réutiliser le cache

Placez le prompt système stable, les instructions de dépôt et les schémas d’outils en tête de requête afin d’écrire le préfixe coûteux une fois et de le lire à bas coût ensuite.

Maîtrise des coûts
04

Orienter les requêtes selon la valeur du résultat

Comparez le taux de réussite, les reprises, les tokens de sortie, le taux de cache, la durée et les corrections humaines sur vos tâches — pas seulement le prix au token.

Évaluer
Requête minimale

Copiez l’ID du modèle et envoyez votre première requête

Cette page produit ne conserve qu’une requête minimale vérifiable. Le guide API complet couvre thinking, effort, les appels d’outils, la gestion des échecs et la migration en production.

Claude Messages API
curl https://direct.evolink.ai/v1/messages \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {"role": "user", "content": "Review this pull request and list the blocking issues."}
    ]
  }'

Comparer les routes Claude après les tests de charge de travail

EvoLink

Vérifiez d’abord si Opus 5 réduit les reprises et la revue. Comparez ensuite prix, contexte, cache et adéquation à la charge de travail.

Claude Opus 5
Entrée / sortie$4.75 / $23.75
Contexte1M
CacheLecture + écriture
Idéal pourIngénierie logicielle à l’échelle du dépôt, longues exécutions d’agents avec usage intensif d’outils, revues de code à fort enjeu, et travaux de recherche ou d’analyse où une mauvaise réponse coûte plus cher qu’un tarif premium au token.
Claude Opus 4.8
Entrée / sortie$4.5 / $22.5
Contexte1M
CacheLecture + écriture
Idéal pourLe précédent fleuron Opus, toujours la route Opus la moins chère sur EvoLink pour le code premium et le travail d’agents.
Claude Sonnet 5
Entrée / sortie$1.8 / $9
Contexte1M
CacheLecture + écriture
Idéal pourDes performances de code et d’agents proches d’Opus au tarif équilibré de Sonnet pour le trafic de production quotidien.

Autres modèles Claude sur EvoLink

Autres modèles de texte

À lire également

FAQ de l’API Claude Opus 5

L’API Claude Opus 5 est-elle disponible via EvoLink ?

Oui. Claude Opus 5 est disponible sur EvoLink comme route de production avec l’ID de modèle "claude-opus-5".

Quel ID de modèle utiliser pour l’API Claude Opus 5 ?

Envoyez le modèle "claude-opus-5". Le même ID fonctionne pour le point de terminaison Chat Completions compatible OpenAI et pour le point de terminaison Messages d’Anthropic.

Combien coûte l’API Claude Opus 5 sur EvoLink ?

Les tarifs EvoLink sont 5 % sous le tarif officiel : 4,75 $ par 1M de tokens d’entrée et 23,75 $ par 1M de tokens de sortie, contre 5,00 $ et 25,00 $ chez Anthropic.

Comment le cache de prompts de Claude Opus 5 est-il facturé ?

L’écriture et la lecture du cache sont des dimensions distinctes : 5,939 $ par 1M de tokens d’écriture et 0,475 $ par 1M de tokens de lecture sur EvoLink, contre 6,25 $ et 0,50 $ officiels.

Comment l’outil de recherche web de Claude Opus 5 est-il facturé ?

La recherche web est facturée 0,01 $ par recherche, le tarif officiel sans remise. Les tokens ajoutés à la requête par les résultats sont facturés normalement.

Quels protocoles et SDK fonctionnent avec Claude Opus 5 ?

Utilisez le point de terminaison Chat Completions compatible OpenAI ou le point de terminaison Messages d’Anthropic avec la même clé API EvoLink. Claude Code et les autres clients natifs Anthropic fonctionnent en pointant l’URL de base vers EvoLink.

Quelle fenêtre de contexte et quelle sortie maximale Claude Opus 5 prend-il en charge ?

La route EvoLink enregistre une fenêtre de contexte de 1 000 000 tokens avec jusqu’à 128K tokens de sortie par réponse.

Thinking est-il activé par défaut sur Claude Opus 5 ?

Anthropic active la pensée adaptative par défaut sur Opus 5 et l’API Claude utilise effort high par défaut. Vérifiez dans la documentation et avec une requête réelle que l’endpoint EvoLink choisi transmet les paramètres nécessaires.

À quelles charges de travail Claude Opus 5 convient-il ?

Claude Opus 5 convient au code particulièrement complexe, aux agents de longue durée utilisant de nombreux outils et aux revues critiques où une erreur entraîne un coût élevé.

Puis-je utiliser Claude Opus 5 avec d’autres routes de modèles ?

Oui. Avec le même client et la même clé API EvoLink, vous pouvez envoyer les tâches les plus difficiles à Claude Opus 5 et conserver d’autres routes testées pour les requêtes plus simples ou sensibles à la latence.

Que doit mesurer une évaluation en production de Claude Opus 5 ?

Mesurez la réussite au premier essai, les livrables acceptés, les reprises, les tokens de sortie, le taux de cache, les appels d’outils valides, le délai jusqu’au résultat accepté, la correction humaine et le taux de repli — pas seulement le tarif au token.