GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5
Couverture comparative Claude Opus 5.5 vs 5 avec des chemins reliés en terre cuite et anthracite
Comparison

Claude Opus 5.5 vs Claude Opus 5 : faut-il passer à la nouvelle version ?

EvoLink Team
EvoLink Team
Équipe produit
22 septembre 2026
17 min de lecture
Réponse courte : pilotez Claude Opus 5.5 sur le codage agentique de longue durée, l'analyse de documents volumineux et le travail visuel riche en graphiques, et gardez Claude Opus 5 comme route de retour arrière jusqu'à ce qu'une relecture appariée dise le contraire. Au prix catalogue d'Anthropic, Opus 5.5 coûte 20 % de moins par token et 60 % de moins en lectures de cache, et Anthropic affirme qu'il termine les tâches avec moins de tokens. Ce n'est pas un remplacement direct : quatre formes de requêtes qui fonctionnent sur Opus 5 renvoient 400 sur Opus 5.5, l'effort par défaut passe de high à medium, et le modèle réfléchit davantage par tour à un niveau d'effort donné.
Ce guide s'adresse aux équipes qui exploitent déjà Opus 5 en production. Les faits de la sortie et le dénouement de la rumeur « Opus 5.2 » sont dans Sortie de Claude Opus 5.5. Les tarifs EvoLink actuels, l'ID de modèle et les paramètres d'intégration sont sur la page du modèle Claude Opus 5.5 et la page du modèle Claude Opus 5. Les prix ci-dessous sont les prix catalogue publiés par Anthropic, utilisés uniquement pour comparer les deux modèles sur la même base.

La décision en un coup d'œil

Si votre situation estFaites ceciParce que
Nouvelle charge, pas encore de référence OpusDémarrer sur Opus 5.5Défaut recommandé par Anthropic, prix catalogue plus bas, mêmes limites
Opus 5 en production, thinking déjà actif, tool_choice: autoPiloter 5.5 derrière un canariLe code se transpose généralement une fois effort fixé explicitement ; vérifiez tout de même les cinq risques ci-dessous (réglages de thinking, choix d'outil, texte de progression, fallback des blocs de thinking, version de computer use)
Opus 5 en production avec thinking: disabled ou choix d'outil forcéCorriger d'abord les requêtes, puis piloterLes deux formes renvoient 400 sur 5.5
Agent très caché avec un grand préfixe stablePrioriser le piloteLes lectures de cache sont 60 % moins chères sur 5.5
Chaîne de fallback qui descend d'Opus vers Sonnet ou Haiku en cours de conversationRetester le chemin de fallbackSeuls Fable 5.1 et Mythos 5.1 lisent les blocs de thinking d'Opus 5.5
UI en streaming qui affiche le texte entre appels d'outilsGérer thinking.display avant le déploiementCe texte arrive désormais dans des blocs de thinking, vides par défaut
Sensible à la latence, thinking coupé pour la vitesseComparer l'effort low sur 5.5 à Opus 5 sans thinkingLe thinking ne se désactive pas ; l'effort est le seul levier

Il n'y a pas de gagnant inconditionnel dans ce tableau. La mise à niveau rapporte quand votre charge fait partie de celles qu'Anthropic a optimisées et que la forme de vos requêtes est déjà compatible ; sinon, elle coûte d'abord du temps d'ingénierie.

Ce qu'Anthropic a changé

DimensionClaude Opus 5Claude Opus 5.5Documenté par
Sortie24 juillet 202622 septembre 2026Notes de version
ID de modèleclaude-opus-5claude-opus-5-5Vue d'ensemble des modèles
Entrée / sortie5 $ / 25 $ par MTok4 $ / 20 $ par MTokTarification
Écriture de cache 5 min / 1 h6,25 $ / 10 $5 $ / 8 $Tarification
Lecture de cache0,50 $ (10 % de l'entrée)0,20 $ (5 % de l'entrée)Tarification
Batch2,50 $ / 12,50 $2 $ / 10 $Tarification
Fast mode (Claude API uniquement)10 $ / 50 $8 $ / 40 $Tarification
Contexte / sortie max1M / 128K1M / 128KVue d'ensemble des modèles
ThinkingActif par défaut ; disabled autorisé à l'effort high ou moinsToujours actif ; disabled et budget_tokens renvoient 400What's new
Effort par défauthighmediumVue d'ensemble des modèles
Choix d'outil forcé (any, tool)Pris en chargeRenvoie 400What's new
Texte entre appels d'outilsBlocs textBlocs thinking de progression, vides à l'affichage par défautWhat's new
Portabilité des blocs de thinkingLus par Opus 5.5, Fable 5.1, Mythos 5.1Lus seulement par Fable 5.1 et Mythos 5.1What's new
Computer use sur Claude API / Google CloudToolset ou computer_20251124Toolset uniquementWhat's new
Catégories de garde-fouscybercyber, bio, reasoning_extractionWhat's new
Date de connaissanceAntérieureJuin 2026Vue d'ensemble des modèles
Plancher de retraitPas avant le 24 juillet 2027Pas avant le 22 septembre 2027Vue d'ensemble des modèles

Tout ce tableau relève de changements de contrat documentés que vous pouvez vérifier. Les affirmations de capacité d'Anthropic sont une autre catégorie : il rapporte des résultats FrontierCode en tête, une parité avec Claude Fable 5.1 « on most work », une sortie plus de 30 % plus rapide et un coût d'exploitation 40 % inférieur à Opus 5. Ce sont des affirmations sur le mélange de tâches d'Anthropic. Traitez-les comme les hypothèses que votre évaluation met à l'épreuve.

Le coût sur la même base : 20 %, 60 % ou 40 % ?

Trois chiffres circulent, et ils mesurent des choses différentes.

  • 20 %, c'est l'écart de prix catalogue sur l'entrée et la sortie. Il s'applique à chaque token, avant toute différence de comportement.
  • 60 %, c'est l'écart de prix catalogue sur les lectures de cache. Il ne s'applique qu'à la part de votre entrée servie depuis le cache.
  • 40 %, c'est l'estimation par Anthropic du coût total d'exploitation sur ses propres charges. Elle combine les baisses de tarif unitaire et la réduction du nombre de tokens par tâche achevée ; elle dépend donc du comportement de vos tâches sur le nouveau modèle.

Le tableau ci-dessous applique les prix catalogue à trois mélanges de tokens fixes, pour 1 000 tâches. C'est un calcul de prix, pas un coût ajusté de la qualité.

Charge (par tâche)Opus 5Opus 5.5Variation
A. Appel unique, sans cache : 20K en entrée, 4K en sortie200,00 $160,00 $-20 %
B. Agent très caché : 60K lectures de cache, 10K d'entrée fraîche, 5K d'écriture de cache, 6K de sortie261,25 $197,00 $-25 %
C. Comme A, mais 5.5 émet 25 % de tokens de sortie en plus au même effort200,00 $180,00 $-10 %
La charge C est celle à surveiller. La documentation d'Anthropic indique qu'Opus 5.5 tend à réfléchir davantage par tour qu'Opus 5 au même niveau d'effort, surtout en xhigh et max, et le thinking est facturé comme de la sortie. Sur le mélange A, Opus 5.5 peut émettre jusqu'à 50 % de tokens de sortie en plus avant que son prix par tâche rejoigne celui d'Opus 5. Que cela arrive dépend du niveau d'effort choisi et de la capacité du modèle à atteindre un résultat accepté en moins de tours, ce qui est l'origine du chiffre de 40 % d'Anthropic.
La seule comparaison qui tranche une mise à niveau est le coût par tâche acceptée : la dépense totale du groupe d'évaluation, échecs, réessais et frais d'outils compris, divisée par le nombre de tâches ayant passé l'acceptation, avec le temps de correction humaine déclaré à part. Faites-la après le balayage d'effort de la section suivante, pas avant.

Les risques de compatibilité, dans l'ordre où ils mordent

1. Les requêtes qui échouent désormais

Périmètre : les erreurs 400 ci-dessous sont le comportement de l'API Anthropic. Sur EvoLink, la passerelle convertit les anciens réglages thinking: disabled et budget_tokens en réflexion adaptative au lieu de les rejeter, tandis que le choix d'outil forcé est rejeté sur les endpoints Chat Completions et Messages ; la page du modèle Claude Opus 5.5 documente le comportement de la passerelle.
Cherchez trois motifs dans vos constructeurs de requêtes. thinking: {"type": "disabled"} et thinking: {"type": "enabled", "budget_tokens": N} renvoient tous deux 400 invalid_request_error. tool_choice: {"type": "any"} et {"type": "tool", "name": ...} renvoient 400, y compris sur le endpoint de comptage de tokens. Sur la Claude API et Google Cloud, une entrée d'outil computer_20251124 renvoie 400 ; déclarez computer_toolset_20260801 à la place.
Les remplacements sont mécaniques. Retirez le champ thinking, ou envoyez l'équivalent thinking: {"type": "adaptive"}, et fixez output_config.effort explicitement. Gardez tool_choice: auto, mettez strict: true sur les outils qui doivent produire des arguments conformes au schéma ou déplacez le schéma vers les structured outputs, et indiquez dans le prompt quand l'outil s'applique. Vérifiez ensuite dans votre boucle qu'un appel d'outil a bien eu lieu, car auto n'en garantit aucun.

2. La valeur par défaut qui bouge en silence

Une requête qui omet effort tournait en high sur Opus 5 et tourne en medium sur Opus 5.5. Si vos requêtes de production ne fixent jamais l'effort, votre première relecture sur Opus 5.5 n'est pas une comparaison à conditions égales. Fixez le niveau explicitement sur les deux modèles avant de lire un résultat, puis balayez low, medium et high sur 5.5.

3. Le texte de progression qui disparaît

Entre les appels d'outils, Opus 5 renvoyait une courte narration sous forme de blocs text. Opus 5.5 la renvoie sous forme de blocs thinking de progression, au plus un avant chaque appel, avec un champ thinking vide au display: "omitted" par défaut. Rien ne renvoie d'erreur ; votre UI en streaming devient simplement muette. Réglez thinking.display sur "updates" (en-tête bêta thinking-display-updates-2026-08-18) ou "summarized", affichez chaque bloc de thinking non vide avant l'appel d'outil qu'il précède, et renvoyez les blocs inchangés.

4. Les chaînes de fallback qui perdent leur raisonnement

Les blocs de thinking enregistrent le modèle qui les a produits. Opus 5.5 lit les blocs d'Opus 5 et des modèles Opus, Sonnet et Haiku antérieurs, donc une conversation qui commence sur Opus 5 et passe à 5.5 garde son raisonnement. Dans l'autre sens, seuls Claude Fable 5.1 et Mythos 5.1 lisent les blocs d'Opus 5.5. Un routeur qui retombe d'Opus 5.5 vers Opus 5, Sonnet 5 ou Haiku 4.5 exécute les tours restants sans le raisonnement antérieur ; la requête réussit et les blocs abandonnés ne sont pas facturés, mais le comportement change. L'API vérifie aussi que rien avant un bloc de thinking 5.5 n'a été modifié ; les comptes créés le 31 août 2026 ou après reçoivent 400 par défaut lorsqu'ils rejouent un bloc après une telle modification. Gardez l'historique en ajout seul et utilisez des messages système en cours de conversation plutôt que de modifier le system prompt ou les outils.

5. Les nouvelles catégories de refus

Opus 5.5 fait tourner un classifieur biologie en plus de celui de cybersécurité et peut refuser les requêtes qui le poussent à reproduire son raisonnement interne, en renvoyant stop_reason: "refusal" avec stop_details.category à bio ou reasoning_extraction. Le fallback côté serveur ne réessaie pas reasoning_extraction. Si votre intégration Opus 5 n'inspectait jamais stop_reason, ajoutez cette vérification avant le pilote.

Six scénarios et ce que chacun doit prouver

ScénarioEntrée vers sortieCe que « mieux » veut direCe qu'il faut surveiller sur Opus 5.5
Modification de code multi-fichiersContexte du dépôt vers patchLes tests passent ; le relecteur accepte avec moins de retouchesTokens de sortie à l'effort choisi ; étapes jusqu'au vert
Agent d'outils multi-toursTâche plus schémas d'outils vers une séquence d'appelsTâche achevée ; boucle récupérable après échecauto appelle encore l'outil ; blocs de progression affichés ; blocs de thinking renvoyés
Analyse de documents longsDocuments et images vers des conclusions sourcéesLes affirmations correspondent aux preuves ; rien d'oubliéVérification des citations ; Anthropic rapporte moins de chiffres non étayés, vérifiez-le
Extraction structuréeTexte semi-structuré vers un JSON fixeTaux de validité du schéma ; exactitude des champsstrict: true remplace le choix d'outil forcé
Flux très cachéPréfixe fixe plus nouvelle tâche vers résultatLe taux d'acceptation tient ; la facture baisse vraimentPart de hits de cache ; choix entre écriture 5 min et 1 h
Fallback multi-modèlesTour échoué ou expiré vers une route alternativeLa conversation continue ; le coût reste bornéQuels modèles peuvent lire les blocs de thinking 5.5 ; catégories de refus

Rien de tout cela n'est un résultat. Ce sont les fiches d'acceptation à remplir avant de déplacer le trafic, une par classe de tâches, avec les mêmes prompts, outils, délais, niveaux d'effort, règles de réessai et relecteurs sur les deux modèles.

Quand garder Opus 5

Gardez Opus 5 là où il atteint déjà vos objectifs de taux de réussite, de latence et de coût et où la relecture ne montre aucun gain mesuré. Gardez-le là où vos constructeurs de requêtes envoient encore thinking: disabled ou un choix d'outil forcé et où le correctif n'est pas livré. Gardez-le comme route de retour arrière pour chaque canari 5.5 jusqu'à ce que le canari ait tourné assez longtemps pour voir la latence p95 et le comportement de refus sous charge réelle. Et gardez-le là où une chaîne de fallback dépend de la lecture des blocs de thinking par les modèles en aval, jusqu'à ce que cette chaîne soit retestée.

Attendre n'est pas passif tant que vous collectez des références. Anthropic liste Opus 5 comme actif avec un plancher de retrait au 24 juillet 2027 sur les plateformes qu'il opère ; il y a donc le temps de bouger sur des preuves plutôt que sur une date de sortie.

Un plan de migration sûr

1. Geler la référence Opus 5

Choisissez des tâches représentatives de chaque classe ci-dessus. Notez la forme exacte de la requête, le niveau d'effort, le jeu d'outils et les critères d'acceptation, et rejouez-les une fois de plus sur Opus 5 pour que la référence soit fraîche et non un souvenir.

2. Corriger la forme des requêtes

Retirez thinking: disabled et budget_tokens, fixez effort explicitement, remplacez le choix d'outil forcé par auto plus strict, déplacez le computer use vers le toolset et ajoutez la gestion de stop_reason. Livrez d'abord cela sur Opus 5 ; chaque changement y est aussi valide, ce qui vous permet de séparer la correction des requêtes du changement de modèle.

3. Lancer le balayage d'effort

Rejouez la référence sur Opus 5.5 en low, medium et high. Relevez le taux de tâches acceptées, les tokens de sortie, le temps horloge et le coût par tâche acceptée à chaque niveau. Retenez, par classe de tâches, le niveau le moins cher qui atteint la barre d'acceptation. Ne reprenez pas high d'Opus 5 par habitude.

4. Canari par classe de tâches

Routez une petite part d'une classe de tâches vers Opus 5.5 avec Opus 5 comme fallback configuré, et journalisez à chaque appel le modèle demandé, le modèle renvoyé, l'effort, le stop_reason et les dimensions facturées. Promouvez une classe lorsque son coût par tâche acceptée et sa qualité franchissent la porte sur un cycle complet de trafic réel, pas sur une seule bonne journée.

5. Définir le chemin du retour

Le retour arrière est un changement de configuration : rebasculez la classe sur claude-opus-5. Comme Opus 5 ne peut pas lire les blocs de thinking d'Opus 5.5, un retour arrière en cours de conversation continue sans le raisonnement antérieur ; ouvrez une nouvelle frontière de conversation quand vous le pouvez. Fixez qui peut déclencher le retour arrière et quel signal le déclenche avant le début du canari.

Sur EvoLink, le choix du modèle est une chaîne dans votre requête, donc les étapes 4 et 5 n'exigent aucun déploiement de code.

Consulter la route Claude Opus 5.5 et les tarifs actuels Garder la route Claude Opus 5 comme retour arrière

FAQ

Claude Opus 5.5 est-il moins cher que Claude Opus 5 ?

Par token, oui : Anthropic affiche l'entrée et la sortie 20 % plus bas et les lectures de cache 60 % plus bas. Par tâche, cela dépend du nombre de tokens que le modèle dépense à votre niveau d'effort ; le chiffre de 40 % d'Anthropic est sa propre estimation sur ses propres charges.

Opus 5.5 est-il un remplacement direct d'Opus 5 ?

Non. Les requêtes qui désactivent le thinking, fixent un budget de thinking, forcent un choix d'outil ou déclarent l'ancien outil de computer use renvoient 400. L'effort par défaut passe aussi de high à medium, et le texte entre appels d'outils migre dans des blocs de thinking.

Pourquoi Opus 5.5 pourrait-il coûter plus cher qu'Opus 5 sur ma charge ?

Parce qu'il tend à réfléchir davantage par tour au même niveau d'effort, et que le thinking est facturé comme de la sortie. Sur une tâche de 20K en entrée et 4K en sortie, il peut émettre 50 % de sortie en plus avant d'atteindre le prix d'Opus 5 ; choisissez donc l'effort à partir d'un balayage plutôt que de reprendre high.

Puis-je couper le thinking sur Opus 5.5 pour la latence ?

Non. Utilisez effort: low et comparez-le à votre référence Opus 5 sans thinking sur la latence et l'acceptation. Les conseils d'Anthropic pour les prompts écrits avec le thinking désactivé suggèrent aussi de retirer les instructions du type « ne raisonne pas ».

Que deviennent les blocs de thinking si je retombe d'Opus 5.5 vers Opus 5 ?

Opus 5 ne peut pas les lire, donc l'API les abandonne avant que le modèle voie la requête. La requête réussit et les blocs abandonnés ne sont pas facturés, mais les tours restants s'exécutent sans le raisonnement antérieur. D'Opus 5 vers Opus 5.5, ils sont conservés.

Le choix d'outil forcé a-t-il un remplaçant ?

Gardez tool_choice: auto, mettez strict: true sur l'outil pour que tout appel respecte son schéma, et indiquez dans le prompt quand l'outil s'applique. Pour une sortie JSON pure, utilisez les structured outputs plutôt qu'un outil.

Opus 5 doit-il rester disponible en fallback ?

Oui, au moins pendant le canari. Anthropic liste claude-opus-5 comme actif avec un plancher de retrait au 24 juillet 2027 sur les plateformes qu'il opère. Testez la route précise vers laquelle vous prévoyez de retomber, y compris le comportement des blocs de thinking décrit plus haut.

Quelles charges devraient migrer en premier ?

Les longues sessions de codage agentique, l'analyse de documents volumineux et les agents très cachés à préfixe stable, dans cet ordre de gain attendu. Le codage quotidien et le trafic à fort volume sensible à la latence relèvent généralement de Sonnet 5 plutôt que de l'un ou l'autre Opus.

Sources

Faits vérifiés pour la dernière fois le 22 septembre 2026. Les exemples de coût utilisent les prix catalogue d'Anthropic et des mélanges de tokens fixes ; c'est de l'arithmétique de prix, pas des résultats mesurés.

Prêt à réduire vos coûts IA de 89 % ?

Commencez avec EvoLink dès aujourd'hui et découvrez la puissance du routage intelligent des API.