Accédez à Claude Sonnet 5 de Anthropic — aussi recherché sous Sonnet 5 / Claude 5 Sonnet — via l'API de chat unifiée d'EvoLink. Testez le codage à long contexte, l'usage d'outils, le cache de prompt avant d'intégrer.
Anthropic·Génération de texte·Disponible
à partir de $1.800 / 1M tokens d'entrée$2.000 prix officiel-10%
Adaptive thinkingCoding agentiqueAppel d'outilsCache de promptsChat + Messages API
Route productionCe taux reflète la disponibilité côté plateforme — seules les erreurs serveur confirmées (HTTP 500 / réponse vide) comptent comme échecs. Les problèmes côté utilisateur (modération de contenu, paramètres invalides, annulation) ainsi que les limites de débit, timeouts et erreurs d'authentification sont exclus. Avant l'arrivée de trafic réel, les intervalles vides peuvent apparaître comme disponibles.Live
Live
Contexte
1M de contexte
Idéal pour
Codage à l’échelle d’un dépôt, agents longue durée, revues critiques
Le Sonnet précédent d'Anthropic pour le code et le travail agentique, et un remplacement drop-in de Sonnet 4.6. L'entrée, l'écriture de cache, la lecture de cache, la sortie et l'outil de recherche web sont facturés comme des dimensions distinctes.
Claude Sonnet 5
Modèle Anthropic de gamme Sonnet pour le code et les agents
Sélectionné
ID du modèle
claude-sonnet-5
Idéal pour
Code de production quotidien, agents terminal et navigateur, usage d'outils sur longue durée et analyses à grand contexte où l'équilibre des coûts compte plus qu'un tarif de gamme Opus.
Entrée
$1.800 / 1M-10%
122.4 cr / 1M$2.000prix officiel
Écriture cache
$2.250 / 1M-10%
153 cr / 1M$2.500prix officiel
Lecture cache
$0.181 / 1M-10%
12.3 cr / 1M$0.200prix officiel
Sortie
$9.000 / 1M-10%
612 cr / 1M$10.000prix officiel
Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte.
Tarifs Claude Sonnet 5
Estimez le coût d'une requête Claude Sonnet 5 avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.
Calculateur de requête
Saisissez la répartition des tokens d'une requête et le nombre d'appels d'outils réussis.
Seuls les appels côté serveur réussis sont facturés à l'appel ; les tentatives échouées n'ont pas de frais d'outil, mais les tokens restent facturés.
Recherche web$0.010/ appel·0.68 cr / appel
Claude Sonnet 5 API — le Sonnet précédent d'Anthropic pour le code et les agents
Claude Sonnet 5 (Claude 5 Sonnet) offre de solides performances de code et d'agents à travers les terminaux et les navigateurs, avec une fenêtre de contexte 1M, jusqu'à 128K tokens de sortie et l'adaptive thinking activé par défaut.
Claude Sonnet 5 est servi sur EvoLink sous l'ID de modèle claude-sonnet-5 via Chat Completions · Anthropic Messages, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 1M, ainsi que le codage à long contexte, l'usage d'outils, le cache de prompt.
Spécifications et capacités de Claude Sonnet 5
Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.
Appels de fonctions avec séquences d'outils multi-étapes
Cache de prompt
Tarifs écriture + lecture de cache
Outils côté serveur
Recherche web, facturés par appel réussi
Protocoles
Chat Completions · Anthropic Messages
ID du modèle
claude-sonnet-5
Que pouvez-vous construire avec l'API Claude Sonnet 5 ?
Assistant de codage agentique
Sonnet 5 réalise ses plus grands gains par rapport à Sonnet 4.6 sur le code — planifiant des changements multi-étapes, exécutant des terminaux et itérant sur les résultats. Avec jusqu'à 128K de sortie et une fenêtre de contexte 1M, il traite de grandes bases de code et génère des diffs complets, des suites de tests et des plans d'implémentation en une seule requête.
Agents autonomes
Construisez des agents qui planifient une séquence d'étapes, appellent des outils, lisent le résultat et continuent sans intervention humaine à chaque tour. Sonnet 5 est conçu pour l'usage du terminal et du navigateur ainsi que pour les exécutions à long horizon, offrant un usage d'outils fiable à travers les workflows multi-étapes.
Analyse à grand contexte
Lisez de très grands documents, bases de code ou longues traces d'agents en une seule requête grâce à la fenêtre de contexte 1M, et laissez l'adaptive thinking appliquer un raisonnement plus profond uniquement quand une tâche le nécessite — gardant le coût prévisible pour la recherche, la planification et la stratégie technique.
Deux façons d'utiliser Claude Sonnet 5 : API EvoLink ou Agent
Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez Claude Sonnet 5 depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.
Option 1
Intégrer avec l'API EvoLink
Idéal pour : backends produit, traitements par lots, pipelines automatisés
Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.
1Créez une clé API EvoLink dans la console
2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini
Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle Claude Sonnet 5 via EvoLink et renvoie la réponse avec la consommation de tokens.
1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
3Demandez à l'Agent d'appeler Claude Sonnet 5 via EvoLink et d'afficher la requête avant l'envoi
4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur
Exemple de code API Claude Sonnet 5 et gestion des erreurs
Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.
curl -X POST https://api.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [
{ "role": "system", "content": "You are a senior engineer. Produce clean, well-tested code." },
{ "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
],
"max_tokens": 8192
}'
# Anthropic Messages API is also available at /v1/messages with the same model ID.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).
Requête invalide ou paramètre non pris en charge
Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.
Problème d'authentification ou de solde
Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.
Longueur de contexte dépassée
Les tokens du prompt dépassent la fenêtre de contexte de Claude Sonnet 5. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.
Limite de débit (429)
Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.
Contenu ou appel d'outil rejeté
Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.
Comment intégrer l'API Claude Sonnet 5
Connectez-vous via EvoLink, choisissez votre ID de modèle et commencez à construire en minutes.
1
Étape 1 — Créer votre clé API EvoLink
Inscrivez-vous sur EvoLink pour obtenir une clé API unique qui route vers Anthropic, Bedrock ou Google Cloud.
2
Étape 2 — Sélectionner l'ID de modèle
Utilisez `claude-sonnet-5` pour accéder au modèle Sonnet 5 via l'API unifiée d'EvoLink. C'est un remplacement drop-in de `claude-sonnet-4-6`.
3
Étape 3 — Optimiser qualité et coût
L'adaptive thinking est activé par défaut et peut être ajusté avec le paramètre effort ; utilisez le prompt caching pour les system prompts stables et les longs contextes répétés afin de réduire les coûts répétés.
Le cache de prompts est facturé sur deux dimensions distinctes
L'écriture et la lecture de cache sont comptabilisées séparément, et les hits de cache sont facturés à 0,1x le tarif d'entrée de base. Les prompts système stables, les instructions de dépôt et les schémas d'outils paient l'écriture une fois, puis se lisent à faible coût tout au long d'une longue exécution d'agent.
Contexte de 1M tokens avec 128K de sortie max
1M est à la fois la valeur par défaut et le maximum, sans variante plus petite. Gardez le code lié, les spécifications et l'état de l'agent dans un même contexte de travail, mais traitez la limite comme une capacité et non comme un objectif : récupérez les éléments pertinents, mettez en cache le préfixe stable et définissez des budgets de sortie adaptés à la tâche.
L'adaptive thinking est activé par défaut et remplace les budgets manuels
Sonnet 5 adapte automatiquement le raisonnement à la difficulté de la tâche. Définir `budget_tokens` pour la réflexion étendue manuelle renvoie une erreur 400 — utilisez le paramètre effort pour guider la profondeur, ou passez `thinking: {type: "disabled"}` pour la désactiver. Les valeurs non par défaut de `temperature`, `top_p` et `top_k` renvoient aussi une erreur 400 : retirez-les lors de la migration.
Recomptez les tokens avant de basculer le trafic de production
Sonnet 5 utilise un nouveau tokenizer qui produit environ 30 % de tokens en plus pour le même texte. Le prix par token est inchangé, mais le coût facturé et la capacité de contexte d'une requête équivalente peuvent différer — recomptez vos prompts, revoyez les limites `max_tokens` proches de votre sortie attendue, et comparez taux de succès et coût total sur des échantillons de production.
Capacités de l'API Claude Sonnet 5
Spécifications clés et features modèle pour l'usage en production
Fenêtre de contexte 1M
Lisez de très grands documents ou bases de code en une seule requête. 1M est à la fois le contexte par défaut et le maximum.
128K de sortie max
Générez des réponses longues, des plans et du code sans coupure prématurée.
Adaptive thinking
Le raisonnement s'adapte automatiquement à la difficulté de la tâche, activé par défaut — ajustez-le avec le paramètre effort plutôt qu'avec des budgets de thinking manuels.
Coding agentique & usage d'outils
Conçu pour les agents terminal et navigateur, le function calling fiable et les exécutions multi-étapes à long horizon.
Vision + entrée multilingue
Accepte des entrées texte et image avec une forte compréhension multilingue.
Tarifs de prompt caching
Les écritures et lectures de cache sont tarifées séparément ; les cache hits sont facturés à 0,1x du prix d'entrée de base.
Comparer les routes Claude après tests de charge
EvoLink
Vérifiez d'abord sur vos propres tâches si Sonnet 5 atteint déjà le niveau de qualité requis. Comparez ensuite prix, contexte, cache et adéquation à la charge pour choisir la route de production.
Code de production quotidien, agents terminal et navigateur, usage d'outils sur longue durée et analyses à grand contexte où l'équilibre des coûts compte plus qu'un tarif de gamme Opus.
La génération Sonnet précédente, conservée pour les charges déjà validées avec elle et pour le trafic sensible au coût.
Le fleuron de gamme Opus pour les tâches de raisonnement, de revue et d'agents les plus difficiles, où la qualité primes sur le coût.
Claude Sonnet 5
Entrée / sortie$1.8 / $9
Contexte1M
CacheLecture + écriture
Idéal pourCode de production quotidien, agents terminal et navigateur, usage d'outils sur longue durée et analyses à grand contexte où l'équilibre des coûts compte plus qu'un tarif de gamme Opus.
Quelle est la fenêtre de contexte et la sortie max pour Claude Sonnet 5 ?
Claude Sonnet 5 prend en charge une fenêtre de contexte de 1M tokens — à la fois le contexte par défaut et le maximum, sans variante plus petite — et jusqu'à 128K tokens de sortie en une seule requête, ce qui le rend adapté aux grandes bases de code, aux documents longs et aux tâches de génération complètes.
Quel ID de modèle dois-je utiliser, et comment y accéder via EvoLink ?
Utilisez `claude-sonnet-5` via l'API unifiée et compatible OpenAI d'EvoLink pour accéder au modèle Sonnet 5 avec une seule clé API. C'est un remplacement drop-in de `claude-sonnet-4-6` — mettez à jour l'ID de modèle et, si nécessaire, révisez les budgets de tokens et les réglages de thinking.
Comment Claude Sonnet 5 gère-t-il l'extended thinking ?
Sonnet 5 utilise l'adaptive thinking, activé par défaut, qui adapte le raisonnement à la difficulté de la tâche. L'extended thinking manuel (définir `budget_tokens`) n'est plus pris en charge et renvoie une erreur 400 — utilisez plutôt le paramètre effort pour guider la profondeur de raisonnement. Pour désactiver le thinking, passez `thinking: {type: "disabled"}`.
Qu'est-ce qui change lors de la migration de Sonnet 4.6 vers Sonnet 5 ?
Sonnet 5 est un remplacement drop-in, mais notez trois points : l'adaptive thinking est activé par défaut, l'extended thinking manuel renvoie une erreur 400, et les paramètres d'échantillonnage non par défaut (`temperature`, `top_p`, `top_k`) renvoient une erreur 400 — supprimez-les lors de la migration. Les définitions d'outils et les formats de réponse restent inchangés.
Pourquoi mes comptes de tokens changent-ils sur Claude Sonnet 5 ?
Sonnet 5 utilise un nouveau tokenizer qui produit environ 30% de tokens en plus pour le même texte. Le prix par token est inchangé, mais le coût et la capacité de contexte d'une requête équivalente peuvent différer — recomptez vos prompts et révisez les limites `max_tokens` dimensionnées au plus près de votre sortie attendue.
Comment Claude Sonnet 5 est-il tarifé ?
Tarifs EvoLink : $1.800 par million de tokens d'entrée et $9.000 par million de tokens de sortie, contre $2.000 et $10.000 chez Anthropic. Le prompt caching est facturé séparément — $2.250 par million de tokens de cache write et $0.181 par million de tokens de cache read chez EvoLink, contre $2.500 et $0.200 en officiel.
Comment l'outil de recherche web de Claude Sonnet 5 est-il facturé ?
La recherche web est facturée par recherche à $0.010. Les tokens que les résultats de recherche ajoutent à la requête sont facturés normalement.
Comment Sonnet 5 se compare-t-il à Opus 4.8 ?
Sonnet 5 offre des performances de code et d'agents de classe Opus et constitue le bon défaut pour la plupart des charges de production. Opus 4.8 est le modèle phare pour les tâches de raisonnement et d'agents les plus difficiles, où une qualité de premier ordre compte le plus.
Où est disponible Claude Sonnet 5 ?
Claude Sonnet 5 est disponible via l'API Anthropic, AWS Bedrock, Google Cloud (Vertex AI) et Microsoft Foundry (preview). EvoLink peut router vers le fournisseur que vous choisissez.
Claude Sonnet 5 supporte-t-il la vision et l'entrée multimodale ?
Oui. Sonnet 5 prend en charge les entrées texte et image avec de fortes capacités multilingues, vous permettant de combiner documents, captures d'écran et visuels dans une seule requête.