Accédez à Claude Haiku 5.5 de Anthropic — aussi recherché sous Haiku 5.5 — via l'API de chat unifiée d'EvoLink. Testez l'usage d'outils, la sortie structurée, le cache de prompt avant d'intégrer.
Anthropic·Génération de texte·Disponible
À partir de $0.096 / 1M tokens d’entrée$0.100 prix officiel-4%
Réflexion adaptativeContrôle de l’effortAppel d’outilsSortie structuréeCache de promptChat + Messages API
Route productionCe taux reflète la disponibilité côté plateforme — seules les erreurs serveur confirmées (HTTP 500 / réponse vide) comptent comme échecs. Les problèmes côté utilisateur (modération de contenu, paramètres invalides, annulation) ainsi que les limites de débit, timeouts et erreurs d'authentification sont exclus. Avant l'arrivée de trafic réel, les intervalles vides peuvent apparaître comme disponibles.Live
Live
Contexte
1M de contexte · 128K de sortie max.
Idéal pour
Classification et extraction à fort volume, routage, tâches de sous-agents
Le dernier modèle Haiku d’Anthropic pour la classification, l’extraction, le routage et le travail de sous-agent à fort volume. La longueur du prompt détermine laquelle des deux grilles tarifaires s’applique, et cinq dimensions de facturation — entrée, écriture de cache, lecture de cache, sortie et outil de recherche web — sont mesurées séparément.
Claude Haiku 5.5
Le dernier modèle Haiku d’Anthropic
Sélectionné
ID du modèle
claude-haiku-5-5
Idéal pour
Classification de tickets et d’intentions, extraction de champs vers du JSON, routage de requêtes et étapes de sous-agent sous un modèle plus grand — le travail à fort volume et sensible à la latence qu’une route au tarif Haiku doit mener à terme sans passer à Sonnet.
≤ 100K
Entrée
$0.096 / 1M-4%
6.5 cr / 1M$0.100prix officiel
Écriture cache
$0.120 / 1M-5%
8.1 cr / 1M$0.125prix officiel
Lecture cache
$0.011 / 1M
0.7 cr / 1M
Sortie
$0.475 / 1M-5%
32.3 cr / 1M$0.500prix officiel
> 100K
Entrée
$0.478 / 1M-4%
32.5 cr / 1M$0.500prix officiel
Écriture cache
$0.596 / 1M-5%
40.5 cr / 1M$0.625prix officiel
Lecture cache
$0.052 / 1M
3.5 cr / 1M
Sortie
$2.375 / 1M-5%
161.5 cr / 1M$2.500prix officiel
Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte. Au-delà de 100K tokens de prompt, le palier long contexte (×5) s'applique à chaque rôle de token.
Tarifs Claude Haiku 5.5
Estimez le coût d'une requête Claude Haiku 5.5 avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.
Calculateur de requête
Saisissez la répartition des tokens d'une requête et le nombre d'appels d'outils réussis.
La recherche web dépend de la route choisie et n’est pas disponible sur certaines routes. Vérifiez la prise en charge avant d’envoyer web_search ; les tarifs ci-dessous ne s’appliquent que là où il est pris en charge.
Recherche web$0.010/ appel·0.68 cr / appel
API Claude Haiku 5.5
Utilisez l’API Claude Haiku 5.5 via la passerelle unifiée d’EvoLink. Exécutez classification, extraction, routage et appels de sous-agents à fort volume via l’API unifiée d’EvoLink, avec une fenêtre de contexte de 1M de tokens et jusqu’à 128K tokens en sortie. Comparez $0.096 en entrée et $0.475 en sortie par million de tokens pour les prompts jusqu’à 100K tokens, réutilisez une clé API entre modèles et vérifiez les réglages de réflexion et de max_tokens avant votre première requête.
Claude Haiku 5.5 est servi sur EvoLink sous l'ID de modèle claude-haiku-5-5 via Chat Completions · Anthropic Messages, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 1M et jusqu'à 128K tokens de sortie, ainsi que l'usage d'outils, la sortie structurée, le cache de prompt.
Spécifications et capacités de Claude Haiku 5.5
Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.
Appels de fonctions avec séquences d'outils multi-étapes
Cache de prompt
Tarifs écriture + lecture de cache
Palier long contexte
×5 au-delà de 100K tokens de prompt
Protocoles
Chat Completions · Anthropic Messages
ID du modèle
claude-haiku-5-5
Quand Claude Haiku 5.5 est la bonne route par défaut
Haiku 5.5 est le Claude rapide et peu coûteux d’Anthropic pour le travail à fort volume et sensible à la latence. Choisissez cette route selon le coût d’une tâche accomplie, et réglez l’effort avant de toucher au prompt.
Classification, routage et extraction à fort volume
Étiqueter des tickets, détecter l’intention, router des requêtes et extraire des champs de documents vers du JSON. Gardez chaque prompt compact et contraignez la réponse avec une sortie structurée ou un outil à valeurs d’énumération (enum) : la réponse reste courte et la requête reste sur la grille tarifaire de base.
Sous-agents sous un modèle plus grand
Confier la recherche, la lecture de fichiers et d’autres étapes ciblées à Haiku 5.5 pendant qu’un modèle Opus ou Sonnet planifie la tâche. Anthropic décrit Haiku 5.5 comme nettement meilleur que Haiku 4.5 pour suivre les consignes et pour fonctionner comme sous-agent. Mesurez les étapes accomplies, pas les réponses isolées.
Chat et assistants de support à faible latence
Répondre aux questions courantes et appeler un petit ensemble d’outils avec un prompt système court. Commencez à l’effort low pour le chat et les tâches d’outils courtes, et augmentez-le là où l’assistant doit suivre des règles strictes sur une longue conversation.
Quand une autre route convient mieux
Le codage multi-fichiers, les agents de longue haleine et la rédaction de niveau analyste relèvent de Claude Sonnet 5.5, avec Claude Opus 5.5 au-dessus. Gardez Claude Haiku 4.5 là où une charge dépend des paramètres d’échantillonnage, d’un budget de réflexion ou du préremplissage de l’assistant (prefill) et n’a pas encore été retestée.
Deux façons d'utiliser Claude Haiku 5.5 : API EvoLink ou Agent
Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez Claude Haiku 5.5 depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.
Option 1
Intégrer avec l'API EvoLink
Idéal pour : backends produit, traitements par lots, pipelines automatisés
Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.
1Créez une clé API EvoLink dans la console
2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini
Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle Claude Haiku 5.5 via EvoLink et renvoie la réponse avec la consommation de tokens.
1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
3Demandez à l'Agent d'appeler Claude Haiku 5.5 via EvoLink et d'afficher la requête avant l'envoi
4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur
Exemple de code API Claude Haiku 5.5 et gestion des erreurs
Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.
curl -X POST https://direct.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{ "role": "system", "content": "Classify each support ticket as billing, bug, or how-to. Reply with one word." },
{ "role": "user", "content": "I was charged twice for my subscription." }
],
"max_tokens": 4096
}'
# Thinking is on by default and counts toward max_tokens, so leave room for
# it. This Chat Completions request returns choices[0].message and usage
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).
# For the Anthropic Messages format at /v1/messages, follow the linked
# Claude reference; its request fields and response format are different.
Requête invalide ou paramètre non pris en charge
Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.
Problème d'authentification ou de solde
Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.
Longueur de contexte dépassée
Les tokens du prompt dépassent la fenêtre de contexte de Claude Haiku 5.5. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.
Limite de débit (429)
Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.
Contenu ou appel d'outil rejeté
Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.
Vérifications pour intégrer l’API Claude Haiku 5.5
Gardez un seul client EvoLink et une seule clé API. La plupart des requêtes restent inchangées ; les quatre étapes ci-dessous couvrent les réglages qui se comportent autrement que sur Claude Haiku 4.5.
01
Changer l’ID du modèle
Pointez le client vers EvoLink, gardez la même clé API et sélectionnez claude-haiku-5-5. L’endpoint Chat Completions compatible OpenAI comme l’endpoint Anthropic Messages l’acceptent.
Migration légère
02
Laisser de la place à la réflexion
La réflexion est activée par défaut et compte dans max_tokens : un plafond dimensionné pour une réponse d’un seul mot peut être épuisé avant qu’aucun texte ne soit écrit. Augmentez max_tokens ou baissez l’effort, et lisez le contenu par type de bloc, car une réponse peut commencer par un bloc thinking.
Changement de comportement
03
Retirer les réglages propres à Haiku 4.5
Anthropic rejette les budgets de réflexion, les valeurs d’échantillonnage autres que celles par défaut et le préremplissage de l’assistant (prefill) sur Haiku 5.5. EvoLink convertit un budget de réflexion en réflexion adaptative avec un niveau d’effort et retire temperature, top_p et top_k ; remplacez le préremplissage par une sortie structurée ou une consigne dans le prompt système.
Changement cassant
04
Surveiller le seuil de 100K tokens de prompt
L’entrée, les écritures de cache et les lectures de cache déterminent ensemble la grille tarifaire. Réduisez l’historique, récupérez moins de contenu ou découpez le travail pour garder les requêtes à fort volume à 100K tokens de prompt ou moins, et prévoyez le budget de la grille supérieure pour celles qui ont besoin de plus de contexte.
Maîtrise des coûts
Cache de prompt pour le contexte répété
Mettez en cache les prompts système, les schémas d’outils et les documents de référence stables pour les réutiliser d’une requête à l’autre. Écritures et lectures sont facturées séparément. Anthropic a abaissé la longueur minimale de prompt pouvant être mise en cache par rapport à Haiku 4.5 : des prompts plus courts peuvent désormais être mis en cache. Les tokens mis en cache comptent toujours dans la longueur du prompt qui détermine la grille tarifaire.
Contexte de 1M de tokens avec une grille tarifaire qui change à 100K
La route indique une fenêtre de contexte de 1M de tokens et jusqu’à 128K tokens de sortie. Les prompts jusqu’à 100K tokens — entrée, écritures de cache et lectures de cache réunies — utilisent les tarifs de base ; au-delà de 100K, toute la requête, sortie comprise, est facturée à 5×. La réflexion compte dans max_tokens, laissez-lui donc de la place.
La réflexion est activée par défaut — effort sert de réglage
Une requête qui ne définit pas thinking utilise la réflexion adaptative, à l’effort medium sauf si vous choisissez un niveau. La réflexion est facturée comme de la sortie et son texte est omis sauf si vous demandez des résumés. thinking: disabled reste accepté avec un effort high ou inférieur ; Anthropic recommande plutôt de baisser l’effort.
Paramètres de Haiku 4.5 qui ne s’appliquent plus
Anthropic rejette les budgets de réflexion, les valeurs d’échantillonnage autres que celles par défaut et le préremplissage de l’assistant (prefill) sur Haiku 5.5. EvoLink convertit un budget en réflexion adaptative avec un niveau d’effort et retire temperature, top_p et top_k pour la compatibilité. Le choix d’outil forcé est accepté, mais la réponse commence alors par l’appel d’outil, sans réflexion.
Claude Haiku 5.5 : deux grilles tarifaires et cinq dimensions de facturation
Claude Haiku 5.5 n’est pas facturé à un tarif unique mélangé. La longueur du prompt détermine la grille tarifaire, chaque dimension est mesurée séparément et la réflexion est facturée comme de la sortie.
Tokens d’entrée et de sortie, selon la longueur du prompt
Pour les prompts jusqu’à 100K tokens : $0.096 par 1M de tokens d’entrée et $0.475 par 1M de tokens de sortie sur EvoLink, contre $0.100 et $0.500 chez Anthropic. Au-delà de 100K tokens de prompt, toute la requête passe à la grille tarifaire supérieure : $0.478 en entrée et $2.375 en sortie. La réflexion est facturée comme de la sortie même si son texte n’est pas renvoyé.
Écritures de cache de 5 minutes et lectures du cache
Conserver un préfixe pendant 5 minutes coûte $0.120 par 1M de tokens ; le réutiliser coûte $0.011 par 1M de tokens. Les tokens mis en cache comptent toujours dans la longueur du prompt qui détermine la grille tarifaire. Les tarifs EvoLink sont arrondis à l’unité de facturation entière supérieure, si bien que le tarif de lecture du cache peut se situer légèrement au-dessus du prix catalogue officiel ; utilisez les prix affichés pour estimer vos économies.
Outil de recherche web
Sur les routes compatibles avec web_search, chaque recherche coûte $0.010 et n’est pas multipliée par la grille tarifaire supérieure. Les tokens des résultats de recherche sont facturés en entrée normale. Vérifiez la compatibilité de la route avant l’intégration ; un tarif configuré ne signifie pas que toutes les routes prennent en charge l’outil.
Comparer les routes Claude après test des charges
EvoLink
Vérifiez d’abord si Haiku 5.5 maintient la qualité sur vos propres tâches au niveau d’effort que vous prévoyez d’utiliser. Comparez ensuite prix, contexte, cache et adéquation à la charge pour choisir la route de production.
Classification de tickets et d’intentions, extraction de champs vers du JSON, routage de requêtes et étapes de sous-agent sous un modèle plus grand — le travail à fort volume et sensible à la latence qu’une route au tarif Haiku doit mener à terme sans passer à Sonnet.
Le précédent Haiku, facturé à un tarif unique quelle que soit la longueur du prompt ; à garder là où une charge a encore besoin des paramètres d’échantillonnage ou d’un budget de réflexion.
Le dernier Sonnet d’Anthropic, le cran au-dessus pour le codage multi-fichiers, les agents très outillés et le travail que Haiku 5.5 ne termine pas.
Claude Haiku 5.5
Entrée / sortie$0.096 / $0.475
Contexte1M
CacheLecture + écriture
Idéal pourClassification de tickets et d’intentions, extraction de champs vers du JSON, routage de requêtes et étapes de sous-agent sous un modèle plus grand — le travail à fort volume et sensible à la latence qu’une route au tarif Haiku doit mener à terme sans passer à Sonnet.
Idéal pourLe précédent Haiku, facturé à un tarif unique quelle que soit la longueur du prompt ; à garder là où une charge a encore besoin des paramètres d’échantillonnage ou d’un budget de réflexion.
Idéal pourLe dernier Sonnet d’Anthropic, le cran au-dessus pour le codage multi-fichiers, les agents très outillés et le travail que Haiku 5.5 ne termine pas.
Famille de modèles Claude
Même clé API, même solde : changez de palier sans toucher à l’intégration.
Cette page présente Claude Haiku 5.5, disponible sur EvoLink avec l’identifiant de modèle "claude-haiku-5-5". Haiku désigne une famille de modèles : indiquez la version exacte dans votre requête plutôt que d’envoyer "haiku" comme identifiant de modèle. Claude Haiku 4.5 a sa propre page de modèle et ses propres tarifs.
Quel ID de modèle utiliser pour l’API Claude Haiku 5.5 ?
Envoyez model "claude-haiku-5-5". Le même ID fonctionne pour l’endpoint Chat Completions compatible OpenAI et pour l’endpoint Anthropic Messages.
Combien coûte l’API Claude Haiku 5.5 sur EvoLink ?
Pour les prompts jusqu’à 100K tokens, EvoLink facture $0.096 par 1M de tokens d’entrée et $0.475 par 1M de tokens de sortie, contre $0.100 et $0.500 chez Anthropic. Au-delà de 100K tokens de prompt, les tarifs sont $0.478 et $2.375.
Comment fonctionne la grille tarifaire à 100K tokens ?
La longueur du prompt correspond aux tokens d’entrée plus les tokens d’écriture et de lecture du cache. À 100K ou moins, les tarifs de base s’appliquent. Au-delà de 100K, toute la requête est facturée à 5× — entrée, sortie, écritures de cache et lectures de cache — et pas seulement les tokens au-delà du seuil. Les appels de recherche web ne sont pas multipliés.
Claude Haiku 5.5 est-il moins cher que Claude Haiku 4.5 ?
Anthropic affiche Haiku 5.5 à un dixième du tarif de Haiku 4.5 pour les prompts jusqu’à 100K tokens, et à la moitié de ce tarif au-delà. Haiku 5.5 utilise un tokeniseur plus récent qui compte environ 30 % de tokens en plus pour le même texte, et la réflexion est activée par défaut : comparez donc le coût d’une tâche accomplie sur votre propre charge plutôt que le seul tarif par token.
Comment le cache de prompt de Claude Haiku 5.5 est-il facturé ?
Sur la grille tarifaire de base, les écritures de cache de 5 minutes coûtent $0.120 par 1M de tokens et les lectures de cache $0.011 sur EvoLink ; Anthropic affiche $0.125 et $0.010. Elles sont mesurées séparément, et toutes deux sont facturées à 5× au-delà de 100K tokens de prompt. Utilisez les tarifs affichés, arrondis compris, pour estimer votre charge.
Comment l’outil de recherche web de Claude Haiku 5.5 est-il facturé ?
Sur les routes compatibles avec web_search, chaque recherche coûte $0.010. Les tokens des résultats de recherche sont facturés en entrée normale. Vérifiez la compatibilité de la route avant l’intégration ; un tarif configuré ne signifie pas que toutes les routes prennent en charge l’outil.
Peut-on désactiver la réflexion sur Claude Haiku 5.5 ?
Oui, avec un effort high ou inférieur : envoyez thinking: disabled. À xhigh ou max, Anthropic le rejette : baissez alors le niveau d’effort ou utilisez la réflexion adaptative. Anthropic recommande de baisser l’effort plutôt que de désactiver la réflexion, car à l’effort low le modèle peut se passer de réflexion sur les requêtes simples.
Quel niveau d’effort utiliser sur Claude Haiku 5.5 ?
La valeur par défaut est medium. Anthropic suggère low pour le chat, les tâches d’outils courtes et les requêtes simples à fort volume, medium pour la plupart des travaux, codage agentique compris, et high pour le travail de connaissance et le suivi strict des consignes. Comparez xhigh et max à Claude Sonnet 5.5 avant de les adopter.
Qu’est-ce qui change en migrant depuis Claude Haiku 4.5 ?
Changez l’ID du modèle, remplacez les budgets de réflexion par la réflexion adaptative et un niveau d’effort, retirez temperature, top_p et top_k, et remplacez le préremplissage de l’assistant (prefill). La réflexion est activée par défaut : lisez donc le contenu par type de bloc et revoyez les petites valeurs de max_tokens. Le tokeniseur compte plus de tokens pour le même texte, le contexte passe à 1M de tokens, la sortie maximale passe à 128K et, sur l’API Claude, le computer use requiert le computer toolset.
Pourquoi une courte requête de classification s’arrête-t-elle à max_tokens sans aucun texte ?
La réflexion compte dans max_tokens. Un plafond dimensionné pour une réponse d’un seul mot peut être épuisé par la réflexion ; la réponse se termine alors après un bloc thinking et avant tout texte. Augmentez max_tokens pour laisser de la place à la réflexion, ou baissez le niveau d’effort.
À quoi ressemble un refus de Claude Haiku 5.5 ?
Les classifieurs de sécurité peuvent refuser une requête. La réponse est un succès normal avec stop_reason "refusal" et une catégorie : vérifiez donc stop_reason avant de lire le contenu. Anthropic ne ressert pas sur un autre modèle une requête Haiku 5.5 refusée ; gérez le refus dans votre client et essayez un autre prompt.
Quels protocoles et SDK fonctionnent avec Claude Haiku 5.5 ?
Utilisez l’endpoint Chat Completions compatible OpenAI ou l’endpoint Anthropic Messages avec la même clé API EvoLink. Claude Code et les autres clients natifs Anthropic fonctionnent en pointant l’URL de base vers EvoLink.
Les limites d’usage de l’abonnement Claude Code s’appliquent-elles à l’API Claude Haiku 5.5 sur EvoLink ?
Les quotas d’abonnement Claude sont distincts de la facturation API d’EvoLink. Les requêtes passant par EvoLink consomment votre solde EvoLink aux tarifs affichés et restent soumises aux limites de votre compte et de la route. Configurez une clé API EvoLink et le point de terminaison documenté dans un client compatible.
Quelle fenêtre de contexte et quelle sortie maximale Claude Haiku 5.5 prend-il en charge ?
La route EvoLink indique une fenêtre de contexte de 1 000 000 tokens et jusqu’à 128K tokens de sortie par réponse. La réflexion compte dans max_tokens, et les prompts au-delà de 100K tokens sont facturés sur la grille tarifaire supérieure.
Que doit mesurer une évaluation de production de Claude Haiku 5.5 ?
Suivez la réussite au premier passage, les sorties structurées valides, les relances, les requêtes au modèle par tâche, les tokens de sortie au niveau d’effort choisi, le taux de succès du cache, la part des requêtes au-delà de 100K tokens de prompt, le délai jusqu’au résultat accepté et les corrections humaines — pas seulement le tarif par token.