GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

Claude Sonnet 5 API

Accédez à Claude Sonnet 5 de Anthropic — aussi recherché sous Sonnet 5 / Claude 5 Sonnet — via l'API de chat unifiée d'EvoLink. Testez le codage à long contexte, l'usage d'outils, le cache de prompt avant d'intégrer.

AnthropicGénération de texteDisponible
à partir de $1.800 / 1M tokens d'entrée$2.000 prix officiel-10%
Documentation API
Adaptive thinkingCoding agentiqueAppel d'outilsCache de promptsChat + Messages API
Route productionLive
Contexte
1M de contexte
Idéal pour
Codage à l’échelle d’un dépôt, agents longue durée, revues critiques
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée) · appels d'outils

Choisir Claude Sonnet 5

Le Sonnet précédent d'Anthropic pour le code et le travail agentique, et un remplacement drop-in de Sonnet 4.6. L'entrée, l'écriture de cache, la lecture de cache, la sortie et l'outil de recherche web sont facturés comme des dimensions distinctes.

Claude Sonnet 5

Modèle Anthropic de gamme Sonnet pour le code et les agents

Sélectionné
ID du modèle
claude-sonnet-5
Idéal pour

Code de production quotidien, agents terminal et navigateur, usage d'outils sur longue durée et analyses à grand contexte où l'équilibre des coûts compte plus qu'un tarif de gamme Opus.

Entrée
$1.800 / 1M-10%
122.4 cr / 1M$2.000prix officiel
Écriture cache
$2.250 / 1M-10%
153 cr / 1M$2.500prix officiel
Lecture cache
$0.181 / 1M-10%
12.3 cr / 1M$0.200prix officiel
Sortie
$9.000 / 1M-10%
612 cr / 1M$10.000prix officiel

Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte.

Tarifs Claude Sonnet 5

Estimez le coût d'une requête Claude Sonnet 5 avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.

Calculateur de requête

Saisissez la répartition des tokens d'une requête et le nombre d'appels d'outils réussis.

Coût estimé par requête

Claude Sonnet 5
USD$0.0046
Crédits0.3085

Estimation officielle $0.0051 · économie $0.0006 (10%)

Tokens d'entrée0.1224 cr
Tokens écrits en cache0 cr
Tokens lus en cache0.0025 cr
Tokens de sortie0.1836 cr

Facturation minimale : 0.01 crédit par requête.

Guide budgétaire

Nombre approximatif de requêtes avec la répartition actuelle.
Ajouter des crédits
$10
Environ 2106 requêtes

Pour des tests rapides

$50
Environ 11021 requêtes

Pour le développement courant

$100
Environ 22042 requêtes

Pour l'évaluation en production

Tarifs des outils côté serveur

Seuls les appels côté serveur réussis sont facturés à l'appel ; les tentatives échouées n'ont pas de frais d'outil, mais les tokens restent facturés.
  • Recherche web$0.010/ appel0.68 cr / appel

Claude Sonnet 5 API — le Sonnet précédent d'Anthropic pour le code et les agents

Claude Sonnet 5 (Claude 5 Sonnet) offre de solides performances de code et d'agents à travers les terminaux et les navigateurs, avec une fenêtre de contexte 1M, jusqu'à 128K tokens de sortie et l'adaptive thinking activé par défaut.

Claude Sonnet 5 est servi sur EvoLink sous l'ID de modèle claude-sonnet-5 via Chat Completions · Anthropic Messages, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 1M, ainsi que le codage à long contexte, l'usage d'outils, le cache de prompt.

Claude Sonnet 5

Spécifications et capacités de Claude Sonnet 5

Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.

Fenêtre de contexte
1M tokens
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée) · appels d'outils
Raisonnement
Mode réflexion (activé par défaut)
Usage d'outils
Appels de fonctions avec séquences d'outils multi-étapes
Cache de prompt
Tarifs écriture + lecture de cache
Outils côté serveur
Recherche web, facturés par appel réussi
Protocoles
Chat Completions · Anthropic Messages
ID du modèle
claude-sonnet-5

Que pouvez-vous construire avec l'API Claude Sonnet 5 ?

Assistant de codage agentique

Sonnet 5 réalise ses plus grands gains par rapport à Sonnet 4.6 sur le code — planifiant des changements multi-étapes, exécutant des terminaux et itérant sur les résultats. Avec jusqu'à 128K de sortie et une fenêtre de contexte 1M, il traite de grandes bases de code et génère des diffs complets, des suites de tests et des plans d'implémentation en une seule requête.

Agents autonomes

Construisez des agents qui planifient une séquence d'étapes, appellent des outils, lisent le résultat et continuent sans intervention humaine à chaque tour. Sonnet 5 est conçu pour l'usage du terminal et du navigateur ainsi que pour les exécutions à long horizon, offrant un usage d'outils fiable à travers les workflows multi-étapes.

Analyse à grand contexte

Lisez de très grands documents, bases de code ou longues traces d'agents en une seule requête grâce à la fenêtre de contexte 1M, et laissez l'adaptive thinking appliquer un raisonnement plus profond uniquement quand une tâche le nécessite — gardant le coût prévisible pour la recherche, la planification et la stratégie technique.

Deux façons d'utiliser Claude Sonnet 5 : API EvoLink ou Agent

Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez Claude Sonnet 5 depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.

Option 1

Intégrer avec l'API EvoLink

Idéal pour : backends produit, traitements par lots, pipelines automatisés

Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.

  1. 1Créez une clé API EvoLink dans la console
  2. 2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
  3. 3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
  4. 4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Option 2

L'appeler avec un Agent

Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini

Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle Claude Sonnet 5 via EvoLink et renvoie la réponse avec la consommation de tokens.

  1. 1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
  2. 2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
  3. 3Demandez à l'Agent d'appeler Claude Sonnet 5 via EvoLink et d'afficher la requête avant l'envoi
  4. 4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur

Exemple de code API Claude Sonnet 5 et gestion des erreurs

Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.

Voir la documentation API complète
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [
      { "role": "system", "content": "You are a senior engineer. Produce clean, well-tested code." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 8192
  }'

# Anthropic Messages API is also available at /v1/messages with the same model ID.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).

Requête invalide ou paramètre non pris en charge

Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.

Problème d'authentification ou de solde

Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.

Longueur de contexte dépassée

Les tokens du prompt dépassent la fenêtre de contexte de Claude Sonnet 5. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.

Limite de débit (429)

Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.

Contenu ou appel d'outil rejeté

Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.

Comment intégrer l'API Claude Sonnet 5

Connectez-vous via EvoLink, choisissez votre ID de modèle et commencez à construire en minutes.

1

Étape 1 — Créer votre clé API EvoLink

Inscrivez-vous sur EvoLink pour obtenir une clé API unique qui route vers Anthropic, Bedrock ou Google Cloud.

2

Étape 2 — Sélectionner l'ID de modèle

Utilisez `claude-sonnet-5` pour accéder au modèle Sonnet 5 via l'API unifiée d'EvoLink. C'est un remplacement drop-in de `claude-sonnet-4-6`.

3

Étape 3 — Optimiser qualité et coût

L'adaptive thinking est activé par défaut et peut être ajusté avec le paramètre effort ; utilisez le prompt caching pour les system prompts stables et les longs contextes répétés afin de réduire les coûts répétés.

Le cache de prompts est facturé sur deux dimensions distinctes

L'écriture et la lecture de cache sont comptabilisées séparément, et les hits de cache sont facturés à 0,1x le tarif d'entrée de base. Les prompts système stables, les instructions de dépôt et les schémas d'outils paient l'écriture une fois, puis se lisent à faible coût tout au long d'une longue exécution d'agent.

Contexte de 1M tokens avec 128K de sortie max

1M est à la fois la valeur par défaut et le maximum, sans variante plus petite. Gardez le code lié, les spécifications et l'état de l'agent dans un même contexte de travail, mais traitez la limite comme une capacité et non comme un objectif : récupérez les éléments pertinents, mettez en cache le préfixe stable et définissez des budgets de sortie adaptés à la tâche.

L'adaptive thinking est activé par défaut et remplace les budgets manuels

Sonnet 5 adapte automatiquement le raisonnement à la difficulté de la tâche. Définir `budget_tokens` pour la réflexion étendue manuelle renvoie une erreur 400 — utilisez le paramètre effort pour guider la profondeur, ou passez `thinking: {type: "disabled"}` pour la désactiver. Les valeurs non par défaut de `temperature`, `top_p` et `top_k` renvoient aussi une erreur 400 : retirez-les lors de la migration.

Recomptez les tokens avant de basculer le trafic de production

Sonnet 5 utilise un nouveau tokenizer qui produit environ 30 % de tokens en plus pour le même texte. Le prix par token est inchangé, mais le coût facturé et la capacité de contexte d'une requête équivalente peuvent différer — recomptez vos prompts, revoyez les limites `max_tokens` proches de votre sortie attendue, et comparez taux de succès et coût total sur des échantillons de production.

Capacités de l'API Claude Sonnet 5

Spécifications clés et features modèle pour l'usage en production

Fenêtre de contexte 1M

Lisez de très grands documents ou bases de code en une seule requête. 1M est à la fois le contexte par défaut et le maximum.

128K de sortie max

Générez des réponses longues, des plans et du code sans coupure prématurée.

Adaptive thinking

Le raisonnement s'adapte automatiquement à la difficulté de la tâche, activé par défaut — ajustez-le avec le paramètre effort plutôt qu'avec des budgets de thinking manuels.

Coding agentique & usage d'outils

Conçu pour les agents terminal et navigateur, le function calling fiable et les exécutions multi-étapes à long horizon.

Vision + entrée multilingue

Accepte des entrées texte et image avec une forte compréhension multilingue.

Tarifs de prompt caching

Les écritures et lectures de cache sont tarifées séparément ; les cache hits sont facturés à 0,1x du prix d'entrée de base.

Comparer les routes Claude après tests de charge

EvoLink

Vérifiez d'abord sur vos propres tâches si Sonnet 5 atteint déjà le niveau de qualité requis. Comparez ensuite prix, contexte, cache et adéquation à la charge pour choisir la route de production.

Claude Sonnet 5
Entrée / sortie$1.8 / $9
Contexte1M
CacheLecture + écriture
Idéal pourCode de production quotidien, agents terminal et navigateur, usage d'outils sur longue durée et analyses à grand contexte où l'équilibre des coûts compte plus qu'un tarif de gamme Opus.
Claude Sonnet 4.6
Entrée / sortie$2.7 / $13.5
Contexte1M
CacheLecture + écriture
Idéal pourLa génération Sonnet précédente, conservée pour les charges déjà validées avec elle et pour le trafic sensible au coût.
Claude Opus 5
Entrée / sortie$4.75 / $23.75
Contexte1M
CacheLecture + écriture
Idéal pourLe fleuron de gamme Opus pour les tâches de raisonnement, de revue et d'agents les plus difficiles, où la qualité primes sur le coût.

Famille de modèles Claude

Même clé API, même solde : changez de palier sans toucher à l’intégration.

Comparer tous les modèles Claude
Claude Sonnet API (Sonnet 5.5)

Claude Sonnet API (Sonnet 5.5)

Le Sonnet plus récent, au même prix catalogue officiel ; retestez votre charge dessus avant de déplacer le trafic depuis Sonnet 5.

Voir le modèle
Claude Opus 5.5

Claude Opus 5.5

Le dernier Opus d’Anthropic pour le codage longue durée le plus exigeant, le travail de connaissance et l’analyse visuelle.

Voir le modèle
Claude Fable 5.1

Claude Fable 5.1

Une route Claude plus performante au-dessus d'Opus pour les charges d'agents les plus longues et les plus exigeantes.

Voir le modèle

Autres modèles texte sur EvoLink en plus de Claude Sonnet 5

GPT-5.6

GPT-5.6

La famille frontier à plusieurs niveaux d'OpenAI pour router selon la capacité, la latence et le coût.

Voir le modèle
Grok 4.5

Grok 4.5

La route de raisonnement et d'usage d'outils de xAI avec une fenêtre de contexte 500K et des outils de recherche côté serveur.

Voir le modèle
Kimi K3

Kimi K3

Un modèle de raisonnement à long contexte pour le code à l'échelle du dépôt et le travail multi-documents.

Voir le modèle
Gemini 3.6 Flash

Gemini 3.6 Flash

Une route rapide et économique pour le trafic à grand volume qui n'exige pas un jugement de gamme Opus.

Voir le modèle

Claude Sonnet 5 API - FAQ

Quelle est la fenêtre de contexte et la sortie max pour Claude Sonnet 5 ?

Claude Sonnet 5 prend en charge une fenêtre de contexte de 1M tokens — à la fois le contexte par défaut et le maximum, sans variante plus petite — et jusqu'à 128K tokens de sortie en une seule requête, ce qui le rend adapté aux grandes bases de code, aux documents longs et aux tâches de génération complètes.

Quel ID de modèle dois-je utiliser, et comment y accéder via EvoLink ?

Utilisez `claude-sonnet-5` via l'API unifiée et compatible OpenAI d'EvoLink pour accéder au modèle Sonnet 5 avec une seule clé API. C'est un remplacement drop-in de `claude-sonnet-4-6` — mettez à jour l'ID de modèle et, si nécessaire, révisez les budgets de tokens et les réglages de thinking.

Comment Claude Sonnet 5 gère-t-il l'extended thinking ?

Sonnet 5 utilise l'adaptive thinking, activé par défaut, qui adapte le raisonnement à la difficulté de la tâche. L'extended thinking manuel (définir `budget_tokens`) n'est plus pris en charge et renvoie une erreur 400 — utilisez plutôt le paramètre effort pour guider la profondeur de raisonnement. Pour désactiver le thinking, passez `thinking: {type: "disabled"}`.

Qu'est-ce qui change lors de la migration de Sonnet 4.6 vers Sonnet 5 ?

Sonnet 5 est un remplacement drop-in, mais notez trois points : l'adaptive thinking est activé par défaut, l'extended thinking manuel renvoie une erreur 400, et les paramètres d'échantillonnage non par défaut (`temperature`, `top_p`, `top_k`) renvoient une erreur 400 — supprimez-les lors de la migration. Les définitions d'outils et les formats de réponse restent inchangés.

Pourquoi mes comptes de tokens changent-ils sur Claude Sonnet 5 ?

Sonnet 5 utilise un nouveau tokenizer qui produit environ 30% de tokens en plus pour le même texte. Le prix par token est inchangé, mais le coût et la capacité de contexte d'une requête équivalente peuvent différer — recomptez vos prompts et révisez les limites `max_tokens` dimensionnées au plus près de votre sortie attendue.

Comment Claude Sonnet 5 est-il tarifé ?

Tarifs EvoLink : $1.800 par million de tokens d'entrée et $9.000 par million de tokens de sortie, contre $2.000 et $10.000 chez Anthropic. Le prompt caching est facturé séparément — $2.250 par million de tokens de cache write et $0.181 par million de tokens de cache read chez EvoLink, contre $2.500 et $0.200 en officiel.

Comment l'outil de recherche web de Claude Sonnet 5 est-il facturé ?

La recherche web est facturée par recherche à $0.010. Les tokens que les résultats de recherche ajoutent à la requête sont facturés normalement.

Comment Sonnet 5 se compare-t-il à Opus 4.8 ?

Sonnet 5 offre des performances de code et d'agents de classe Opus et constitue le bon défaut pour la plupart des charges de production. Opus 4.8 est le modèle phare pour les tâches de raisonnement et d'agents les plus difficiles, où une qualité de premier ordre compte le plus.

Où est disponible Claude Sonnet 5 ?

Claude Sonnet 5 est disponible via l'API Anthropic, AWS Bedrock, Google Cloud (Vertex AI) et Microsoft Foundry (preview). EvoLink peut router vers le fournisseur que vous choisissez.

Claude Sonnet 5 supporte-t-il la vision et l'entrée multimodale ?

Oui. Sonnet 5 prend en charge les entrées texte et image avec de fortes capacités multilingues, vous permettant de combiner documents, captures d'écran et visuels dans une seule requête.