
Claude Opus 5.5 vs Claude Opus 5 : faut-il passer à la nouvelle version ?
400 sur Opus 5.5, l'effort par défaut passe de high à medium, et le modèle réfléchit davantage par tour à un niveau d'effort donné.La décision en un coup d'œil
| Si votre situation est | Faites ceci | Parce que |
|---|---|---|
| Nouvelle charge, pas encore de référence Opus | Démarrer sur Opus 5.5 | Défaut recommandé par Anthropic, prix catalogue plus bas, mêmes limites |
Opus 5 en production, thinking déjà actif, tool_choice: auto | Piloter 5.5 derrière un canari | Le code se transpose généralement une fois effort fixé explicitement ; vérifiez tout de même les cinq risques ci-dessous (réglages de thinking, choix d'outil, texte de progression, fallback des blocs de thinking, version de computer use) |
Opus 5 en production avec thinking: disabled ou choix d'outil forcé | Corriger d'abord les requêtes, puis piloter | Les deux formes renvoient 400 sur 5.5 |
| Agent très caché avec un grand préfixe stable | Prioriser le pilote | Les lectures de cache sont 60 % moins chères sur 5.5 |
| Chaîne de fallback qui descend d'Opus vers Sonnet ou Haiku en cours de conversation | Retester le chemin de fallback | Seuls Fable 5.1 et Mythos 5.1 lisent les blocs de thinking d'Opus 5.5 |
| UI en streaming qui affiche le texte entre appels d'outils | Gérer thinking.display avant le déploiement | Ce texte arrive désormais dans des blocs de thinking, vides par défaut |
| Sensible à la latence, thinking coupé pour la vitesse | Comparer l'effort low sur 5.5 à Opus 5 sans thinking | Le thinking ne se désactive pas ; l'effort est le seul levier |
Il n'y a pas de gagnant inconditionnel dans ce tableau. La mise à niveau rapporte quand votre charge fait partie de celles qu'Anthropic a optimisées et que la forme de vos requêtes est déjà compatible ; sinon, elle coûte d'abord du temps d'ingénierie.
Ce qu'Anthropic a changé
| Dimension | Claude Opus 5 | Claude Opus 5.5 | Documenté par |
|---|---|---|---|
| Sortie | 24 juillet 2026 | 22 septembre 2026 | Notes de version |
| ID de modèle | claude-opus-5 | claude-opus-5-5 | Vue d'ensemble des modèles |
| Entrée / sortie | 5 $ / 25 $ par MTok | 4 $ / 20 $ par MTok | Tarification |
| Écriture de cache 5 min / 1 h | 6,25 $ / 10 $ | 5 $ / 8 $ | Tarification |
| Lecture de cache | 0,50 $ (10 % de l'entrée) | 0,20 $ (5 % de l'entrée) | Tarification |
| Batch | 2,50 $ / 12,50 $ | 2 $ / 10 $ | Tarification |
| Fast mode (Claude API uniquement) | 10 $ / 50 $ | 8 $ / 40 $ | Tarification |
| Contexte / sortie max | 1M / 128K | 1M / 128K | Vue d'ensemble des modèles |
| Thinking | Actif par défaut ; disabled autorisé à l'effort high ou moins | Toujours actif ; disabled et budget_tokens renvoient 400 | What's new |
| Effort par défaut | high | medium | Vue d'ensemble des modèles |
Choix d'outil forcé (any, tool) | Pris en charge | Renvoie 400 | What's new |
| Texte entre appels d'outils | Blocs text | Blocs thinking de progression, vides à l'affichage par défaut | What's new |
| Portabilité des blocs de thinking | Lus par Opus 5.5, Fable 5.1, Mythos 5.1 | Lus seulement par Fable 5.1 et Mythos 5.1 | What's new |
| Computer use sur Claude API / Google Cloud | Toolset ou computer_20251124 | Toolset uniquement | What's new |
| Catégories de garde-fous | cyber | cyber, bio, reasoning_extraction | What's new |
| Date de connaissance | Antérieure | Juin 2026 | Vue d'ensemble des modèles |
| Plancher de retrait | Pas avant le 24 juillet 2027 | Pas avant le 22 septembre 2027 | Vue d'ensemble des modèles |
Tout ce tableau relève de changements de contrat documentés que vous pouvez vérifier. Les affirmations de capacité d'Anthropic sont une autre catégorie : il rapporte des résultats FrontierCode en tête, une parité avec Claude Fable 5.1 « on most work », une sortie plus de 30 % plus rapide et un coût d'exploitation 40 % inférieur à Opus 5. Ce sont des affirmations sur le mélange de tâches d'Anthropic. Traitez-les comme les hypothèses que votre évaluation met à l'épreuve.
Le coût sur la même base : 20 %, 60 % ou 40 % ?
Trois chiffres circulent, et ils mesurent des choses différentes.
- 20 %, c'est l'écart de prix catalogue sur l'entrée et la sortie. Il s'applique à chaque token, avant toute différence de comportement.
- 60 %, c'est l'écart de prix catalogue sur les lectures de cache. Il ne s'applique qu'à la part de votre entrée servie depuis le cache.
- 40 %, c'est l'estimation par Anthropic du coût total d'exploitation sur ses propres charges. Elle combine les baisses de tarif unitaire et la réduction du nombre de tokens par tâche achevée ; elle dépend donc du comportement de vos tâches sur le nouveau modèle.
Le tableau ci-dessous applique les prix catalogue à trois mélanges de tokens fixes, pour 1 000 tâches. C'est un calcul de prix, pas un coût ajusté de la qualité.
| Charge (par tâche) | Opus 5 | Opus 5.5 | Variation |
|---|---|---|---|
| A. Appel unique, sans cache : 20K en entrée, 4K en sortie | 200,00 $ | 160,00 $ | -20 % |
| B. Agent très caché : 60K lectures de cache, 10K d'entrée fraîche, 5K d'écriture de cache, 6K de sortie | 261,25 $ | 197,00 $ | -25 % |
| C. Comme A, mais 5.5 émet 25 % de tokens de sortie en plus au même effort | 200,00 $ | 180,00 $ | -10 % |
xhigh et max, et le thinking est facturé comme de la sortie. Sur le mélange A, Opus 5.5 peut émettre jusqu'à 50 % de tokens de sortie en plus avant que son prix par tâche rejoigne celui d'Opus 5. Que cela arrive dépend du niveau d'effort choisi et de la capacité du modèle à atteindre un résultat accepté en moins de tours, ce qui est l'origine du chiffre de 40 % d'Anthropic.Les risques de compatibilité, dans l'ordre où ils mordent
1. Les requêtes qui échouent désormais
400 ci-dessous sont le comportement de l'API Anthropic. Sur EvoLink, la passerelle convertit les anciens réglages thinking: disabled et budget_tokens en réflexion adaptative au lieu de les rejeter, tandis que le choix d'outil forcé est rejeté sur les endpoints Chat Completions et Messages ; la page du modèle Claude Opus 5.5 documente le comportement de la passerelle.thinking: {"type": "disabled"} et thinking: {"type": "enabled", "budget_tokens": N} renvoient tous deux 400 invalid_request_error. tool_choice: {"type": "any"} et {"type": "tool", "name": ...} renvoient 400, y compris sur le endpoint de comptage de tokens. Sur la Claude API et Google Cloud, une entrée d'outil computer_20251124 renvoie 400 ; déclarez computer_toolset_20260801 à la place.thinking, ou envoyez l'équivalent thinking: {"type": "adaptive"}, et fixez output_config.effort explicitement. Gardez tool_choice: auto, mettez strict: true sur les outils qui doivent produire des arguments conformes au schéma ou déplacez le schéma vers les structured outputs, et indiquez dans le prompt quand l'outil s'applique. Vérifiez ensuite dans votre boucle qu'un appel d'outil a bien eu lieu, car auto n'en garantit aucun.2. La valeur par défaut qui bouge en silence
effort tournait en high sur Opus 5 et tourne en medium sur Opus 5.5. Si vos requêtes de production ne fixent jamais l'effort, votre première relecture sur Opus 5.5 n'est pas une comparaison à conditions égales. Fixez le niveau explicitement sur les deux modèles avant de lire un résultat, puis balayez low, medium et high sur 5.5.3. Le texte de progression qui disparaît
text. Opus 5.5 la renvoie sous forme de blocs thinking de progression, au plus un avant chaque appel, avec un champ thinking vide au display: "omitted" par défaut. Rien ne renvoie d'erreur ; votre UI en streaming devient simplement muette. Réglez thinking.display sur "updates" (en-tête bêta thinking-display-updates-2026-08-18) ou "summarized", affichez chaque bloc de thinking non vide avant l'appel d'outil qu'il précède, et renvoyez les blocs inchangés.4. Les chaînes de fallback qui perdent leur raisonnement
400 par défaut lorsqu'ils rejouent un bloc après une telle modification. Gardez l'historique en ajout seul et utilisez des messages système en cours de conversation plutôt que de modifier le system prompt ou les outils.5. Les nouvelles catégories de refus
stop_reason: "refusal" avec stop_details.category à bio ou reasoning_extraction. Le fallback côté serveur ne réessaie pas reasoning_extraction. Si votre intégration Opus 5 n'inspectait jamais stop_reason, ajoutez cette vérification avant le pilote.Six scénarios et ce que chacun doit prouver
| Scénario | Entrée vers sortie | Ce que « mieux » veut dire | Ce qu'il faut surveiller sur Opus 5.5 |
|---|---|---|---|
| Modification de code multi-fichiers | Contexte du dépôt vers patch | Les tests passent ; le relecteur accepte avec moins de retouches | Tokens de sortie à l'effort choisi ; étapes jusqu'au vert |
| Agent d'outils multi-tours | Tâche plus schémas d'outils vers une séquence d'appels | Tâche achevée ; boucle récupérable après échec | auto appelle encore l'outil ; blocs de progression affichés ; blocs de thinking renvoyés |
| Analyse de documents longs | Documents et images vers des conclusions sourcées | Les affirmations correspondent aux preuves ; rien d'oublié | Vérification des citations ; Anthropic rapporte moins de chiffres non étayés, vérifiez-le |
| Extraction structurée | Texte semi-structuré vers un JSON fixe | Taux de validité du schéma ; exactitude des champs | strict: true remplace le choix d'outil forcé |
| Flux très caché | Préfixe fixe plus nouvelle tâche vers résultat | Le taux d'acceptation tient ; la facture baisse vraiment | Part de hits de cache ; choix entre écriture 5 min et 1 h |
| Fallback multi-modèles | Tour échoué ou expiré vers une route alternative | La conversation continue ; le coût reste borné | Quels modèles peuvent lire les blocs de thinking 5.5 ; catégories de refus |
Rien de tout cela n'est un résultat. Ce sont les fiches d'acceptation à remplir avant de déplacer le trafic, une par classe de tâches, avec les mêmes prompts, outils, délais, niveaux d'effort, règles de réessai et relecteurs sur les deux modèles.
Quand garder Opus 5
thinking: disabled ou un choix d'outil forcé et où le correctif n'est pas livré. Gardez-le comme route de retour arrière pour chaque canari 5.5 jusqu'à ce que le canari ait tourné assez longtemps pour voir la latence p95 et le comportement de refus sous charge réelle. Et gardez-le là où une chaîne de fallback dépend de la lecture des blocs de thinking par les modèles en aval, jusqu'à ce que cette chaîne soit retestée.Attendre n'est pas passif tant que vous collectez des références. Anthropic liste Opus 5 comme actif avec un plancher de retrait au 24 juillet 2027 sur les plateformes qu'il opère ; il y a donc le temps de bouger sur des preuves plutôt que sur une date de sortie.
Un plan de migration sûr
1. Geler la référence Opus 5
Choisissez des tâches représentatives de chaque classe ci-dessus. Notez la forme exacte de la requête, le niveau d'effort, le jeu d'outils et les critères d'acceptation, et rejouez-les une fois de plus sur Opus 5 pour que la référence soit fraîche et non un souvenir.
2. Corriger la forme des requêtes
thinking: disabled et budget_tokens, fixez effort explicitement, remplacez le choix d'outil forcé par auto plus strict, déplacez le computer use vers le toolset et ajoutez la gestion de stop_reason. Livrez d'abord cela sur Opus 5 ; chaque changement y est aussi valide, ce qui vous permet de séparer la correction des requêtes du changement de modèle.3. Lancer le balayage d'effort
low, medium et high. Relevez le taux de tâches acceptées, les tokens de sortie, le temps horloge et le coût par tâche acceptée à chaque niveau. Retenez, par classe de tâches, le niveau le moins cher qui atteint la barre d'acceptation. Ne reprenez pas high d'Opus 5 par habitude.4. Canari par classe de tâches
stop_reason et les dimensions facturées. Promouvez une classe lorsque son coût par tâche acceptée et sa qualité franchissent la porte sur un cycle complet de trafic réel, pas sur une seule bonne journée.5. Définir le chemin du retour
claude-opus-5. Comme Opus 5 ne peut pas lire les blocs de thinking d'Opus 5.5, un retour arrière en cours de conversation continue sans le raisonnement antérieur ; ouvrez une nouvelle frontière de conversation quand vous le pouvez. Fixez qui peut déclencher le retour arrière et quel signal le déclenche avant le début du canari.Sur EvoLink, le choix du modèle est une chaîne dans votre requête, donc les étapes 4 et 5 n'exigent aucun déploiement de code.
Consulter la route Claude Opus 5.5 et les tarifs actuels Garder la route Claude Opus 5 comme retour arrièreFAQ
Claude Opus 5.5 est-il moins cher que Claude Opus 5 ?
Par token, oui : Anthropic affiche l'entrée et la sortie 20 % plus bas et les lectures de cache 60 % plus bas. Par tâche, cela dépend du nombre de tokens que le modèle dépense à votre niveau d'effort ; le chiffre de 40 % d'Anthropic est sa propre estimation sur ses propres charges.
Opus 5.5 est-il un remplacement direct d'Opus 5 ?
400. L'effort par défaut passe aussi de high à medium, et le texte entre appels d'outils migre dans des blocs de thinking.Pourquoi Opus 5.5 pourrait-il coûter plus cher qu'Opus 5 sur ma charge ?
high.Puis-je couper le thinking sur Opus 5.5 pour la latence ?
effort: low et comparez-le à votre référence Opus 5 sans thinking sur la latence et l'acceptation. Les conseils d'Anthropic pour les prompts écrits avec le thinking désactivé suggèrent aussi de retirer les instructions du type « ne raisonne pas ».Que deviennent les blocs de thinking si je retombe d'Opus 5.5 vers Opus 5 ?
Opus 5 ne peut pas les lire, donc l'API les abandonne avant que le modèle voie la requête. La requête réussit et les blocs abandonnés ne sont pas facturés, mais les tours restants s'exécutent sans le raisonnement antérieur. D'Opus 5 vers Opus 5.5, ils sont conservés.
Le choix d'outil forcé a-t-il un remplaçant ?
tool_choice: auto, mettez strict: true sur l'outil pour que tout appel respecte son schéma, et indiquez dans le prompt quand l'outil s'applique. Pour une sortie JSON pure, utilisez les structured outputs plutôt qu'un outil.Opus 5 doit-il rester disponible en fallback ?
claude-opus-5 comme actif avec un plancher de retrait au 24 juillet 2027 sur les plateformes qu'il opère. Testez la route précise vers laquelle vous prévoyez de retomber, y compris le comportement des blocs de thinking décrit plus haut.Quelles charges devraient migrer en premier ?
Les longues sessions de codage agentique, l'analyse de documents volumineux et les agents très cachés à préfixe stable, dans cet ordre de gain attendu. Le codage quotidien et le trafic à fort volume sensible à la latence relèvent généralement de Sonnet 5 plutôt que de l'un ou l'autre Opus.
Sources
- Anthropic : What's new in Claude Opus 5.5
- Anthropic : Migrating to Claude Opus 5.5
- Anthropic : Models overview
- Anthropic : Pricing
- Anthropic : Effort parameter
- Anthropic : Preserved thinking
- Anthropic : Refusals and fallback
- Anthropic : Introducing Claude Opus 5.5


