
Claude Opus 5.5 vs Claude Opus 5: Lohnt sich das Upgrade?
400, der Standard-Effort fällt von high auf medium, und das Modell denkt auf einer gegebenen Effort-Stufe pro Turn mehr.Die Entscheidung auf einen Blick
| Wenn Ihre Situation ist | Tun Sie das | Weil |
|---|---|---|
| Neuer Workload, noch keine Opus-Basis | Auf Opus 5.5 starten | Anthropics empfohlener Default, niedrigerer Listenpreis, gleiche Limits |
Opus 5 in Produktion, Thinking bereits an, tool_choice: auto | 5.5 hinter einem Canary pilotieren | Code lässt sich meist übernehmen, sobald effort explizit gesetzt ist; prüfen Sie trotzdem die fünf Risiken unten (Thinking-Einstellungen, Tool-Wahl, Fortschrittstext, Thinking-Block-Fallback, Computer-Use-Version) |
Opus 5 in Produktion mit thinking: disabled oder erzwungener Tool-Wahl | Erst die Anfragen fixen, dann pilotieren | Beide Muster liefern auf 5.5 ein 400 |
| Cache-lastiger Agent mit großem stabilem Prefix | Den Pilot priorisieren | Cache-Reads sind auf 5.5 60 % günstiger |
| Fallback-Kette, die mitten in der Konversation von Opus auf Sonnet oder Haiku fällt | Den Fallback-Pfad neu testen | Nur Fable 5.1 und Mythos 5.1 lesen Opus-5.5-Thinking-Blöcke |
| Streaming-UI, die Text zwischen Tool-Aufrufen zeigt | Vor dem Rollout thinking.display behandeln | Dieser Text kommt jetzt in Thinking-Blöcken, standardmäßig leer |
| Latenzsensitiv, Thinking war aus Geschwindigkeitsgründen aus | low-Effort auf 5.5 gegen Opus 5 ohne Thinking vergleichen | Thinking lässt sich nicht deaktivieren; Effort ist der einzige Hebel |
In dieser Tabelle gibt es keinen bedingungslosen Sieger. Das Upgrade zahlt sich aus, wenn Ihr Workload einer ist, für den Anthropic optimiert hat, und Ihre Anfrageform bereits kompatibel ist; sonst kostet es zuerst Entwicklungszeit.
Was Anthropic geändert hat
| Dimension | Claude Opus 5 | Claude Opus 5.5 | Dokumentiert in |
|---|---|---|---|
| Release | 24. Juli 2026 | 22. September 2026 | Release Notes |
| Modell-ID | claude-opus-5 | claude-opus-5-5 | Modellübersicht |
| Input / Output | 5 $ / 25 $ pro MTok | 4 $ / 20 $ pro MTok | Preise |
| Cache-Write 5m / 1h | 6,25 $ / 10 $ | 5 $ / 8 $ | Preise |
| Cache-Read | 0,50 $ (10 % des Inputs) | 0,20 $ (5 % des Inputs) | Preise |
| Batch | 2,50 $ / 12,50 $ | 2 $ / 10 $ | Preise |
| Fast Mode (nur Claude API) | 10 $ / 50 $ | 8 $ / 40 $ | Preise |
| Kontext / max. Output | 1M / 128K | 1M / 128K | Modellübersicht |
| Thinking | Standardmäßig an; disabled bei Effort high oder darunter erlaubt | Immer an; disabled und budget_tokens liefern 400 | What's new |
| Standard-Effort | high | medium | Modellübersicht |
Erzwungene Tool-Wahl (any, tool) | Unterstützt | Liefert 400 | What's new |
| Text zwischen Tool-Aufrufen | text-Blöcke | Fortschritts-thinking-Blöcke, bei Standardanzeige leer | What's new |
| Portabilität der Thinking-Blöcke | Gelesen von Opus 5.5, Fable 5.1, Mythos 5.1 | Nur von Fable 5.1 und Mythos 5.1 gelesen | What's new |
| Computer Use auf Claude API / Google Cloud | Toolset oder computer_20251124 | Nur Toolset | What's new |
| Safeguard-Kategorien | cyber | cyber, bio, reasoning_extraction | What's new |
| Wissensstand | Früher | Juni 2026 | Modellübersicht |
| Retirement-Untergrenze | Nicht vor dem 24. Juli 2027 | Nicht vor dem 22. September 2027 | Modellübersicht |
Alles in dieser Tabelle ist eine dokumentierte Vertragsänderung, die Sie prüfen können. Anthropics Fähigkeitsaussagen sind eine andere Kategorie: Es berichtet führende FrontierCode-Ergebnisse, Parität mit Claude Fable 5.1 „on most work“, über 30 % schnelleren Output und 40 % niedrigere Betriebskosten als Opus 5. Das sind Aussagen über Anthropics Aufgabenmischung. Behandeln Sie sie als Hypothesen, die Ihre Evaluation prüft.
Kosten auf derselben Basis: 20 %, 60 % oder 40 %?
Drei Zahlen kursieren, und sie messen verschiedene Dinge.
- 20 % ist der Listenpreisabstand bei Input und Output. Er gilt für jeden Token, vor jedem Verhaltensunterschied.
- 60 % ist der Listenpreisabstand bei Cache-Reads. Er gilt nur für den Anteil Ihres Inputs, der aus dem Cache bedient wird.
- 40 % ist Anthropics Schätzung der Gesamtbetriebskosten auf seinen eigenen Workloads. Sie bündelt die Einheitspreissenkungen mit weniger Tokens pro erledigter Aufgabe und hängt deshalb davon ab, wie sich Ihre Aufgaben auf dem neuen Modell verhalten.
Die Tabelle unten wendet die Listenpreise auf drei feste Token-Mischungen an, pro 1.000 Aufgaben. Es ist eine Preisrechnung, keine qualitätsbereinigte Kostenrechnung.
| Workload (pro Aufgabe) | Opus 5 | Opus 5.5 | Änderung |
|---|---|---|---|
| A. Einzelaufruf, kein Cache: 20K Input, 4K Output | 200,00 $ | 160,00 $ | -20 % |
| B. Cache-lastiger Agent: 60K Cache-Reads, 10K frischer Input, 5K Cache-Write, 6K Output | 261,25 $ | 197,00 $ | -25 % |
| C. Wie A, aber 5.5 gibt bei gleichem Effort 25 % mehr Output-Tokens aus | 200,00 $ | 180,00 $ | -10 % |
xhigh und max, und Thinking wird als Output abgerechnet. Bei Mischung A kann Opus 5.5 bis zu 50 % mehr Output-Tokens ausgeben, bevor sein Preis pro Aufgabe den von Opus 5 erreicht. Ob das passiert, hängt von der gewählten Effort-Stufe ab und davon, ob das Modell in weniger Turns ein akzeptiertes Ergebnis erreicht, woher Anthropics 40-%-Zahl stammt.Kompatibilitätsrisiken in der Reihenfolge, in der sie zuschlagen
1. Anfragen, die jetzt scheitern
400-Fehler unten sind das Verhalten der Anthropic API. Auf EvoLink wandelt das Gateway die Alt-Einstellungen thinking: disabled und budget_tokens in adaptives Thinking um, statt sie abzulehnen; erzwungene Tool-Wahl wird dagegen sowohl am Chat-Completions- als auch am Messages-Endpunkt abgelehnt. Das Gateway-Verhalten ist auf der Claude Opus 5.5 Modellseite dokumentiert.thinking: {"type": "disabled"} und thinking: {"type": "enabled", "budget_tokens": N} liefern beide 400 invalid_request_error. tool_choice: {"type": "any"} und {"type": "tool", "name": ...} liefern 400, auch am Token-Counting-Endpunkt. Auf der Claude API und Google Cloud liefert ein computer_20251124-Tool-Eintrag 400; deklarieren Sie stattdessen computer_toolset_20260801.thinking-Feld, oder senden Sie das gleichwertige thinking: {"type": "adaptive"}, und setzen Sie output_config.effort explizit. Behalten Sie tool_choice: auto, setzen Sie strict: true auf Tools, die schemakonforme Argumente liefern müssen, oder verschieben Sie das Schema in Structured Outputs, und sagen Sie im Prompt, wann das Tool gilt. Prüfen Sie dann in Ihrer Schleife, ob tatsächlich ein Tool-Aufruf stattfand, denn auto garantiert keinen.2. Der Default, der sich stillschweigend verschiebt
effort lief auf Opus 5 mit high und läuft auf Opus 5.5 mit medium. Wenn Ihre Produktionsanfragen nie Effort setzen, ist Ihr erster Opus-5.5-Replay kein Vergleich unter gleichen Bedingungen. Setzen Sie die Stufe auf beiden Modellen explizit, bevor Sie irgendein Ergebnis lesen, und sweepen Sie dann low, medium und high auf 5.5.3. Fortschrittstext, der verschwindet
text-Blöcke. Opus 5.5 liefert sie als Fortschritts-thinking-Blöcke, höchstens einen vor jedem Tool-Aufruf, mit leerem thinking-Feld beim Standard display: "omitted". Nichts wirft einen Fehler; Ihre Streaming-UI wird einfach still. Setzen Sie thinking.display auf "updates" (Beta-Header thinking-display-updates-2026-08-18) oder "summarized", rendern Sie jeden nicht leeren Thinking-Block vor dem Tool-Aufruf, dem er vorausgeht, und geben Sie die Blöcke unverändert zurück.4. Fallback-Ketten, die ihr Reasoning verlieren
400, wenn sie einen Block nach einer solchen Änderung erneut senden. Halten Sie die Historie append-only und nutzen Sie System-Nachrichten mitten in der Konversation statt Änderungen an System-Prompt oder Tools.5. Neue Ablehnungskategorien
stop_reason: "refusal" mit stop_details.category gleich bio oder reasoning_extraction. Der serverseitige Fallback wiederholt reasoning_extraction nicht. Wenn Ihre Opus-5-Integration stop_reason nie geprüft hat, ergänzen Sie diese Prüfung vor dem Pilot.Sechs Szenarien und was jedes beweisen muss
| Szenario | Input zu Output | Was „besser“ bedeutet | Worauf bei Opus 5.5 zu achten ist |
|---|---|---|---|
| Mehrdatei-Codeänderung | Repository-Kontext zu Patch | Tests bestehen; Reviewer akzeptiert mit weniger Änderungen | Output-Tokens beim gewählten Effort; Schritte bis Grün |
| Mehrschrittiger Tool-Agent | Aufgabe plus Tool-Schemas zu einer Folge von Tool-Aufrufen | Aufgabe erledigt; Schleife nach Fehler wiederherstellbar | auto ruft das Tool noch auf; Fortschrittsblöcke gerendert; Thinking-Blöcke zurückgegeben |
| Analyse langer Dokumente | Dokumente und Bilder zu belegten Schlüssen | Aussagen passen zur Belegmenge; nichts übersehen | Zitatprüfungen; Anthropic berichtet weniger unbelegte Zahlen, prüfen Sie es |
| Strukturierte Extraktion | Halbstrukturierter Text zu festem JSON | Schema-Gültigkeitsrate; Feldgenauigkeit | strict: true ersetzt die erzwungene Tool-Wahl |
| Cache-lastiger Workflow | Fester Prefix plus neue Aufgabe zu Ergebnis | Akzeptanzrate hält; die Rechnung sinkt tatsächlich | Cache-Hit-Anteil; Wahl zwischen 5m- und 1h-Write |
| Multi-Modell-Fallback | Gescheiterter oder abgelaufener Turn zu alternativer Route | Konversation läuft weiter; Kosten bleiben begrenzt | Welche Modelle 5.5-Thinking-Blöcke lesen können; Ablehnungskategorien |
Nichts davon sind Ergebnisse. Es sind die Abnahmeprotokolle, die auszufüllen sind, bevor Traffic wandert, eines pro Aufgabenklasse, mit denselben Prompts, Tools, Timeouts, Effort-Stufen, Retry-Regeln und Reviewern auf beiden Modellen.
Wann Opus 5 bleiben sollte
thinking: disabled oder erzwungene Tool-Wahl senden und der Fix nicht ausgeliefert ist. Behalten Sie es als Rollback-Route für jeden 5.5-Canary, bis der Canary lang genug lief, um p95-Latenz und Ablehnungsverhalten unter realer Last zu sehen. Und behalten Sie es, wo eine Fallback-Kette davon abhängt, dass nachgelagerte Modelle die Thinking-Blöcke der Konversation lesen, bis diese Kette neu getestet ist.Warten ist nicht passiv, solange Sie Baselines sammeln. Anthropic führt Opus 5 als aktiv mit einer Retirement-Untergrenze vom 24. Juli 2027 auf den von ihm betriebenen Plattformen, es bleibt also Zeit, nach Belegen statt nach Release-Datum umzusteigen.
Ein sicherer Migrationsplan
1. Die Opus-5-Basis einfrieren
Wählen Sie repräsentative Aufgaben aus jeder Klasse oben. Notieren Sie exakte Anfrageform, Effort-Stufe, Tool-Set und Abnahmekriterien, und lassen Sie sie noch einmal auf Opus 5 laufen, damit die Basis frisch ist und keine Erinnerung.
2. Die Anfrageform fixen
thinking: disabled und budget_tokens, setzen Sie effort explizit, ersetzen Sie erzwungene Tool-Wahl durch auto plus strict, verschieben Sie Computer Use auf das Toolset und ergänzen Sie die stop_reason-Behandlung. Liefern Sie das zuerst für Opus 5 aus; jede Änderung ist auch dort gültig, sodass Sie den Anfrage-Fix vom Modellwechsel trennen können.3. Den Effort-Sweep fahren
low, medium und high ab. Erfassen Sie pro Stufe die Rate akzeptierter Aufgaben, Output-Tokens, Wandzeit und Kosten pro akzeptierter Aufgabe. Wählen Sie pro Aufgabenklasse die günstigste Stufe, die die Abnahmegrenze erfüllt. Übernehmen Sie high nicht aus Gewohnheit von Opus 5.4. Canary nach Aufgabenklasse
stop_reason und abgerechnete Dimensionen. Befördern Sie eine Klasse, wenn Kosten pro akzeptierter Aufgabe und Qualität das Gate über einen vollen Zyklus realen Traffics hinweg passieren, nicht an einem einzelnen guten Tag.5. Den Weg zurück definieren
claude-opus-5. Weil Opus 5 keine Opus-5.5-Thinking-Blöcke lesen kann, läuft ein Rollback mitten in der Konversation ohne das frühere Reasoning weiter; beginnen Sie eine frische Konversationsgrenze, wenn Sie können. Legen Sie fest, wer den Rollback auslösen darf und welches Signal ihn auslöst, bevor der Canary startet.Auf EvoLink ist die Modellauswahl ein String in Ihrer Anfrage, sodass Schritt 4 und 5 kein Code-Deployment erfordern.
Claude Opus 5.5 Route und aktuelle Preise prüfen Claude Opus 5 Route als Rollback behaltenFAQ
Ist Claude Opus 5.5 günstiger als Claude Opus 5?
Pro Token ja: Anthropic listet Input und Output 20 % niedriger und Cache-Reads 60 % niedriger. Pro Aufgabe hängt es davon ab, wie viele Tokens das Modell auf Ihrer Effort-Stufe verbraucht; Anthropics 40-%-Zahl ist seine eigene Schätzung auf seinen eigenen Workloads.
Ist Opus 5.5 ein Drop-in-Ersatz für Opus 5?
400. Der Standard-Effort fällt außerdem von high auf medium, und Text zwischen Tool-Aufrufen wandert in Thinking-Blöcke.Warum könnte Opus 5.5 auf meinem Workload mehr kosten als Opus 5?
high zu übernehmen.Kann ich das Thinking auf Opus 5.5 wegen der Latenz abschalten?
effort: low und vergleichen Sie es bei Latenz und Akzeptanz mit Ihrer Opus-5-Basis ohne Thinking. Anthropics Hinweise für Prompts, die für deaktiviertes Thinking geschrieben wurden, empfehlen zudem, Anweisungen wie „nicht nachdenken“ zu entfernen.Was passiert mit Thinking-Blöcken, wenn ich von Opus 5.5 auf Opus 5 zurückfalle?
Opus 5 kann sie nicht lesen, also verwirft die API sie, bevor das Modell die Anfrage sieht. Die Anfrage gelingt und die verworfenen Blöcke werden nicht abgerechnet, aber die verbleibenden Turns laufen ohne das frühere Reasoning. Von Opus 5 zu Opus 5.5 bleiben sie erhalten.
Gibt es einen Ersatz für die erzwungene Tool-Wahl?
tool_choice: auto, setzen Sie strict: true auf dem Tool, damit jeder Aufruf seinem Schema entspricht, und sagen Sie im Prompt, wann das Tool gilt. Für reine JSON-Ausgabe nutzen Sie Structured Outputs statt eines Tools.Sollte Opus 5 als Fallback verfügbar bleiben?
claude-opus-5 als aktiv mit einer Retirement-Untergrenze vom 24. Juli 2027 auf den von ihm betriebenen Plattformen. Testen Sie die konkrete Route, auf die Sie zurückfallen wollen, inklusive des oben beschriebenen Thinking-Block-Verhaltens.Welche Workloads sollten zuerst wechseln?
Lange agentische Coding-Läufe, die Analyse großer Dokumente und cache-lastige Agents mit stabilem Prefix, in dieser Reihenfolge des erwarteten Nutzens. Alltags-Coding und hochvolumiger, latenzsensitiver Traffic gehören meist auf Sonnet 5 statt auf eines der beiden Opus-Modelle.
Quellen
- Anthropic: What's new in Claude Opus 5.5
- Anthropic: Migrating to Claude Opus 5.5
- Anthropic: Models overview
- Anthropic: Pricing
- Anthropic: Effort parameter
- Anthropic: Preserved thinking
- Anthropic: Refusals and fallback
- Anthropic: Introducing Claude Opus 5.5


