GPT Image 2.5 Flare & Sunburst sind jetzt auf EvoLink verfügbarGPT Image 2.5 testen
Vergleichs-Cover Claude Opus 5.5 vs 5 mit verbundenen Pfaden in Terrakotta und Anthrazit
Comparison

Claude Opus 5.5 vs Claude Opus 5: Lohnt sich das Upgrade?

EvoLink Team
EvoLink Team
Produktteam
22. September 2026
14 Min. Lesezeit
Kurze Antwort: Pilotieren Sie Claude Opus 5.5 für langlaufendes agentisches Coding, die Analyse großer Dokumente und diagrammlastige visuelle Arbeit, und behalten Sie Claude Opus 5 als Rollback-Route, bis ein gepaarter Replay etwas anderes sagt. Opus 5.5 kostet nach Anthropics Listenpreis 20 % weniger pro Token und 60 % weniger bei Cache-Reads, und Anthropic sagt, es erledige Aufgaben mit weniger Tokens. Ein Drop-in-Tausch ist es nicht: Vier Anfragemuster, die auf Opus 5 funktionieren, liefern auf Opus 5.5 ein 400, der Standard-Effort fällt von high auf medium, und das Modell denkt auf einer gegebenen Effort-Stufe pro Turn mehr.
Dieser Leitfaden richtet sich an Teams, die Opus 5 bereits in Produktion betreiben. Release-Fakten und die Auflösung des „Opus 5.2“-Gerüchts stehen in Claude Opus 5.5 Release. Live-Preise von EvoLink, Modell-ID und Integrationseinstellungen finden Sie auf der Claude Opus 5.5 Modellseite und der Claude Opus 5 Modellseite. Die Preise unten sind Anthropics veröffentlichte Listenpreise und dienen nur dem Vergleich beider Modelle auf derselben Basis.

Die Entscheidung auf einen Blick

Wenn Ihre Situation istTun Sie dasWeil
Neuer Workload, noch keine Opus-BasisAuf Opus 5.5 startenAnthropics empfohlener Default, niedrigerer Listenpreis, gleiche Limits
Opus 5 in Produktion, Thinking bereits an, tool_choice: auto5.5 hinter einem Canary pilotierenCode lässt sich meist übernehmen, sobald effort explizit gesetzt ist; prüfen Sie trotzdem die fünf Risiken unten (Thinking-Einstellungen, Tool-Wahl, Fortschrittstext, Thinking-Block-Fallback, Computer-Use-Version)
Opus 5 in Produktion mit thinking: disabled oder erzwungener Tool-WahlErst die Anfragen fixen, dann pilotierenBeide Muster liefern auf 5.5 ein 400
Cache-lastiger Agent mit großem stabilem PrefixDen Pilot priorisierenCache-Reads sind auf 5.5 60 % günstiger
Fallback-Kette, die mitten in der Konversation von Opus auf Sonnet oder Haiku fälltDen Fallback-Pfad neu testenNur Fable 5.1 und Mythos 5.1 lesen Opus-5.5-Thinking-Blöcke
Streaming-UI, die Text zwischen Tool-Aufrufen zeigtVor dem Rollout thinking.display behandelnDieser Text kommt jetzt in Thinking-Blöcken, standardmäßig leer
Latenzsensitiv, Thinking war aus Geschwindigkeitsgründen auslow-Effort auf 5.5 gegen Opus 5 ohne Thinking vergleichenThinking lässt sich nicht deaktivieren; Effort ist der einzige Hebel

In dieser Tabelle gibt es keinen bedingungslosen Sieger. Das Upgrade zahlt sich aus, wenn Ihr Workload einer ist, für den Anthropic optimiert hat, und Ihre Anfrageform bereits kompatibel ist; sonst kostet es zuerst Entwicklungszeit.

Was Anthropic geändert hat

DimensionClaude Opus 5Claude Opus 5.5Dokumentiert in
Release24. Juli 202622. September 2026Release Notes
Modell-IDclaude-opus-5claude-opus-5-5Modellübersicht
Input / Output5 $ / 25 $ pro MTok4 $ / 20 $ pro MTokPreise
Cache-Write 5m / 1h6,25 $ / 10 $5 $ / 8 $Preise
Cache-Read0,50 $ (10 % des Inputs)0,20 $ (5 % des Inputs)Preise
Batch2,50 $ / 12,50 $2 $ / 10 $Preise
Fast Mode (nur Claude API)10 $ / 50 $8 $ / 40 $Preise
Kontext / max. Output1M / 128K1M / 128KModellübersicht
ThinkingStandardmäßig an; disabled bei Effort high oder darunter erlaubtImmer an; disabled und budget_tokens liefern 400What's new
Standard-EfforthighmediumModellübersicht
Erzwungene Tool-Wahl (any, tool)UnterstütztLiefert 400What's new
Text zwischen Tool-Aufrufentext-BlöckeFortschritts-thinking-Blöcke, bei Standardanzeige leerWhat's new
Portabilität der Thinking-BlöckeGelesen von Opus 5.5, Fable 5.1, Mythos 5.1Nur von Fable 5.1 und Mythos 5.1 gelesenWhat's new
Computer Use auf Claude API / Google CloudToolset oder computer_20251124Nur ToolsetWhat's new
Safeguard-Kategoriencybercyber, bio, reasoning_extractionWhat's new
WissensstandFrüherJuni 2026Modellübersicht
Retirement-UntergrenzeNicht vor dem 24. Juli 2027Nicht vor dem 22. September 2027Modellübersicht

Alles in dieser Tabelle ist eine dokumentierte Vertragsänderung, die Sie prüfen können. Anthropics Fähigkeitsaussagen sind eine andere Kategorie: Es berichtet führende FrontierCode-Ergebnisse, Parität mit Claude Fable 5.1 „on most work“, über 30 % schnelleren Output und 40 % niedrigere Betriebskosten als Opus 5. Das sind Aussagen über Anthropics Aufgabenmischung. Behandeln Sie sie als Hypothesen, die Ihre Evaluation prüft.

Kosten auf derselben Basis: 20 %, 60 % oder 40 %?

Drei Zahlen kursieren, und sie messen verschiedene Dinge.

  • 20 % ist der Listenpreisabstand bei Input und Output. Er gilt für jeden Token, vor jedem Verhaltensunterschied.
  • 60 % ist der Listenpreisabstand bei Cache-Reads. Er gilt nur für den Anteil Ihres Inputs, der aus dem Cache bedient wird.
  • 40 % ist Anthropics Schätzung der Gesamtbetriebskosten auf seinen eigenen Workloads. Sie bündelt die Einheitspreissenkungen mit weniger Tokens pro erledigter Aufgabe und hängt deshalb davon ab, wie sich Ihre Aufgaben auf dem neuen Modell verhalten.

Die Tabelle unten wendet die Listenpreise auf drei feste Token-Mischungen an, pro 1.000 Aufgaben. Es ist eine Preisrechnung, keine qualitätsbereinigte Kostenrechnung.

Workload (pro Aufgabe)Opus 5Opus 5.5Änderung
A. Einzelaufruf, kein Cache: 20K Input, 4K Output200,00 $160,00 $-20 %
B. Cache-lastiger Agent: 60K Cache-Reads, 10K frischer Input, 5K Cache-Write, 6K Output261,25 $197,00 $-25 %
C. Wie A, aber 5.5 gibt bei gleichem Effort 25 % mehr Output-Tokens aus200,00 $180,00 $-10 %
Workload C ist der, den man im Auge behalten muss. Anthropics Dokumentation sagt, Opus 5.5 denke auf derselben Effort-Stufe pro Turn tendenziell mehr als Opus 5, am meisten bei xhigh und max, und Thinking wird als Output abgerechnet. Bei Mischung A kann Opus 5.5 bis zu 50 % mehr Output-Tokens ausgeben, bevor sein Preis pro Aufgabe den von Opus 5 erreicht. Ob das passiert, hängt von der gewählten Effort-Stufe ab und davon, ob das Modell in weniger Turns ein akzeptiertes Ergebnis erreicht, woher Anthropics 40-%-Zahl stammt.
Der einzige Vergleich, der ein Upgrade entscheidet, sind die Kosten pro akzeptierter Aufgabe: Gesamtausgaben der Evaluationsgruppe inklusive Fehlschlägen, Retries und Tool-Gebühren, geteilt durch die Zahl der Aufgaben, die die Abnahme bestanden haben, mit separat ausgewiesener menschlicher Korrekturzeit. Führen Sie ihn nach dem Effort-Sweep aus dem nächsten Abschnitt durch, nicht davor.

Kompatibilitätsrisiken in der Reihenfolge, in der sie zuschlagen

1. Anfragen, die jetzt scheitern

Hinweis zum Geltungsbereich: Die 400-Fehler unten sind das Verhalten der Anthropic API. Auf EvoLink wandelt das Gateway die Alt-Einstellungen thinking: disabled und budget_tokens in adaptives Thinking um, statt sie abzulehnen; erzwungene Tool-Wahl wird dagegen sowohl am Chat-Completions- als auch am Messages-Endpunkt abgelehnt. Das Gateway-Verhalten ist auf der Claude Opus 5.5 Modellseite dokumentiert.
Durchsuchen Sie Ihre Request-Builder nach drei Mustern. thinking: {"type": "disabled"} und thinking: {"type": "enabled", "budget_tokens": N} liefern beide 400 invalid_request_error. tool_choice: {"type": "any"} und {"type": "tool", "name": ...} liefern 400, auch am Token-Counting-Endpunkt. Auf der Claude API und Google Cloud liefert ein computer_20251124-Tool-Eintrag 400; deklarieren Sie stattdessen computer_toolset_20260801.
Die Ersetzungen sind mechanisch. Entfernen Sie das thinking-Feld, oder senden Sie das gleichwertige thinking: {"type": "adaptive"}, und setzen Sie output_config.effort explizit. Behalten Sie tool_choice: auto, setzen Sie strict: true auf Tools, die schemakonforme Argumente liefern müssen, oder verschieben Sie das Schema in Structured Outputs, und sagen Sie im Prompt, wann das Tool gilt. Prüfen Sie dann in Ihrer Schleife, ob tatsächlich ein Tool-Aufruf stattfand, denn auto garantiert keinen.

2. Der Default, der sich stillschweigend verschiebt

Eine Anfrage ohne effort lief auf Opus 5 mit high und läuft auf Opus 5.5 mit medium. Wenn Ihre Produktionsanfragen nie Effort setzen, ist Ihr erster Opus-5.5-Replay kein Vergleich unter gleichen Bedingungen. Setzen Sie die Stufe auf beiden Modellen explizit, bevor Sie irgendein Ergebnis lesen, und sweepen Sie dann low, medium und high auf 5.5.

3. Fortschrittstext, der verschwindet

Zwischen Tool-Aufrufen lieferte Opus 5 kurze Erzählung als text-Blöcke. Opus 5.5 liefert sie als Fortschritts-thinking-Blöcke, höchstens einen vor jedem Tool-Aufruf, mit leerem thinking-Feld beim Standard display: "omitted". Nichts wirft einen Fehler; Ihre Streaming-UI wird einfach still. Setzen Sie thinking.display auf "updates" (Beta-Header thinking-display-updates-2026-08-18) oder "summarized", rendern Sie jeden nicht leeren Thinking-Block vor dem Tool-Aufruf, dem er vorausgeht, und geben Sie die Blöcke unverändert zurück.

4. Fallback-Ketten, die ihr Reasoning verlieren

Thinking-Blöcke speichern das Modell, das sie erzeugt hat. Opus 5.5 liest Blöcke von Opus 5 und früheren Opus-, Sonnet- und Haiku-Modellen, sodass eine Konversation, die auf Opus 5 beginnt und zu 5.5 wechselt, ihr Reasoning behält. In der Gegenrichtung lesen nur Claude Fable 5.1 und Mythos 5.1 Opus-5.5-Blöcke. Ein Router, der von Opus 5.5 auf Opus 5, Sonnet 5 oder Haiku 4.5 zurückfällt, führt die verbleibenden Turns ohne das frühere Reasoning aus; die Anfrage gelingt und die verworfenen Blöcke werden nicht abgerechnet, aber das Verhalten ändert sich. Die API prüft außerdem, dass nichts vor einem 5.5-Thinking-Block bearbeitet wurde; Konten, die am oder nach dem 31. August 2026 angelegt wurden, erhalten standardmäßig 400, wenn sie einen Block nach einer solchen Änderung erneut senden. Halten Sie die Historie append-only und nutzen Sie System-Nachrichten mitten in der Konversation statt Änderungen an System-Prompt oder Tools.

5. Neue Ablehnungskategorien

Opus 5.5 betreibt neben dem Cybersecurity-Klassifikator einen Biologie-Klassifikator und kann Anfragen ablehnen, die es drängen, internes Reasoning wiederzugeben; zurück kommt stop_reason: "refusal" mit stop_details.category gleich bio oder reasoning_extraction. Der serverseitige Fallback wiederholt reasoning_extraction nicht. Wenn Ihre Opus-5-Integration stop_reason nie geprüft hat, ergänzen Sie diese Prüfung vor dem Pilot.

Sechs Szenarien und was jedes beweisen muss

SzenarioInput zu OutputWas „besser“ bedeutetWorauf bei Opus 5.5 zu achten ist
Mehrdatei-CodeänderungRepository-Kontext zu PatchTests bestehen; Reviewer akzeptiert mit weniger ÄnderungenOutput-Tokens beim gewählten Effort; Schritte bis Grün
Mehrschrittiger Tool-AgentAufgabe plus Tool-Schemas zu einer Folge von Tool-AufrufenAufgabe erledigt; Schleife nach Fehler wiederherstellbarauto ruft das Tool noch auf; Fortschrittsblöcke gerendert; Thinking-Blöcke zurückgegeben
Analyse langer DokumenteDokumente und Bilder zu belegten SchlüssenAussagen passen zur Belegmenge; nichts übersehenZitatprüfungen; Anthropic berichtet weniger unbelegte Zahlen, prüfen Sie es
Strukturierte ExtraktionHalbstrukturierter Text zu festem JSONSchema-Gültigkeitsrate; Feldgenauigkeitstrict: true ersetzt die erzwungene Tool-Wahl
Cache-lastiger WorkflowFester Prefix plus neue Aufgabe zu ErgebnisAkzeptanzrate hält; die Rechnung sinkt tatsächlichCache-Hit-Anteil; Wahl zwischen 5m- und 1h-Write
Multi-Modell-FallbackGescheiterter oder abgelaufener Turn zu alternativer RouteKonversation läuft weiter; Kosten bleiben begrenztWelche Modelle 5.5-Thinking-Blöcke lesen können; Ablehnungskategorien

Nichts davon sind Ergebnisse. Es sind die Abnahmeprotokolle, die auszufüllen sind, bevor Traffic wandert, eines pro Aufgabenklasse, mit denselben Prompts, Tools, Timeouts, Effort-Stufen, Retry-Regeln und Reviewern auf beiden Modellen.

Wann Opus 5 bleiben sollte

Behalten Sie Opus 5, wo es Ihre Ziele für Trefferquote, Latenz und Kosten bereits erfüllt und der Replay keinen gemessenen Vorteil zeigt. Behalten Sie es, wo Ihre Request-Builder noch thinking: disabled oder erzwungene Tool-Wahl senden und der Fix nicht ausgeliefert ist. Behalten Sie es als Rollback-Route für jeden 5.5-Canary, bis der Canary lang genug lief, um p95-Latenz und Ablehnungsverhalten unter realer Last zu sehen. Und behalten Sie es, wo eine Fallback-Kette davon abhängt, dass nachgelagerte Modelle die Thinking-Blöcke der Konversation lesen, bis diese Kette neu getestet ist.

Warten ist nicht passiv, solange Sie Baselines sammeln. Anthropic führt Opus 5 als aktiv mit einer Retirement-Untergrenze vom 24. Juli 2027 auf den von ihm betriebenen Plattformen, es bleibt also Zeit, nach Belegen statt nach Release-Datum umzusteigen.

Ein sicherer Migrationsplan

1. Die Opus-5-Basis einfrieren

Wählen Sie repräsentative Aufgaben aus jeder Klasse oben. Notieren Sie exakte Anfrageform, Effort-Stufe, Tool-Set und Abnahmekriterien, und lassen Sie sie noch einmal auf Opus 5 laufen, damit die Basis frisch ist und keine Erinnerung.

2. Die Anfrageform fixen

Entfernen Sie thinking: disabled und budget_tokens, setzen Sie effort explizit, ersetzen Sie erzwungene Tool-Wahl durch auto plus strict, verschieben Sie Computer Use auf das Toolset und ergänzen Sie die stop_reason-Behandlung. Liefern Sie das zuerst für Opus 5 aus; jede Änderung ist auch dort gültig, sodass Sie den Anfrage-Fix vom Modellwechsel trennen können.

3. Den Effort-Sweep fahren

Spielen Sie die Basis auf Opus 5.5 mit low, medium und high ab. Erfassen Sie pro Stufe die Rate akzeptierter Aufgaben, Output-Tokens, Wandzeit und Kosten pro akzeptierter Aufgabe. Wählen Sie pro Aufgabenklasse die günstigste Stufe, die die Abnahmegrenze erfüllt. Übernehmen Sie high nicht aus Gewohnheit von Opus 5.

4. Canary nach Aufgabenklasse

Routen Sie einen kleinen Anteil einer Aufgabenklasse auf Opus 5.5 mit Opus 5 als konfiguriertem Fallback, und protokollieren Sie bei jedem Aufruf angefragtes Modell, zurückgegebenes Modell, Effort, stop_reason und abgerechnete Dimensionen. Befördern Sie eine Klasse, wenn Kosten pro akzeptierter Aufgabe und Qualität das Gate über einen vollen Zyklus realen Traffics hinweg passieren, nicht an einem einzelnen guten Tag.

5. Den Weg zurück definieren

Rollback ist eine Konfigurationsänderung: Schalten Sie die Klasse zurück auf claude-opus-5. Weil Opus 5 keine Opus-5.5-Thinking-Blöcke lesen kann, läuft ein Rollback mitten in der Konversation ohne das frühere Reasoning weiter; beginnen Sie eine frische Konversationsgrenze, wenn Sie können. Legen Sie fest, wer den Rollback auslösen darf und welches Signal ihn auslöst, bevor der Canary startet.

Auf EvoLink ist die Modellauswahl ein String in Ihrer Anfrage, sodass Schritt 4 und 5 kein Code-Deployment erfordern.

Claude Opus 5.5 Route und aktuelle Preise prüfen Claude Opus 5 Route als Rollback behalten

FAQ

Ist Claude Opus 5.5 günstiger als Claude Opus 5?

Pro Token ja: Anthropic listet Input und Output 20 % niedriger und Cache-Reads 60 % niedriger. Pro Aufgabe hängt es davon ab, wie viele Tokens das Modell auf Ihrer Effort-Stufe verbraucht; Anthropics 40-%-Zahl ist seine eigene Schätzung auf seinen eigenen Workloads.

Ist Opus 5.5 ein Drop-in-Ersatz für Opus 5?

Nein. Anfragen, die Thinking deaktivieren, ein Thinking-Budget setzen, eine Tool-Wahl erzwingen oder das ältere Computer-Use-Tool deklarieren, liefern 400. Der Standard-Effort fällt außerdem von high auf medium, und Text zwischen Tool-Aufrufen wandert in Thinking-Blöcke.

Warum könnte Opus 5.5 auf meinem Workload mehr kosten als Opus 5?

Weil es auf derselben Effort-Stufe tendenziell pro Turn mehr denkt und Thinking als Output abgerechnet wird. Bei einer Aufgabe mit 20K Input und 4K Output kann es 50 % mehr Output ausgeben, bevor sein Preis dem von Opus 5 entspricht; wählen Sie Effort also über einen Sweep statt high zu übernehmen.

Kann ich das Thinking auf Opus 5.5 wegen der Latenz abschalten?

Nein. Nutzen Sie effort: low und vergleichen Sie es bei Latenz und Akzeptanz mit Ihrer Opus-5-Basis ohne Thinking. Anthropics Hinweise für Prompts, die für deaktiviertes Thinking geschrieben wurden, empfehlen zudem, Anweisungen wie „nicht nachdenken“ zu entfernen.

Was passiert mit Thinking-Blöcken, wenn ich von Opus 5.5 auf Opus 5 zurückfalle?

Opus 5 kann sie nicht lesen, also verwirft die API sie, bevor das Modell die Anfrage sieht. Die Anfrage gelingt und die verworfenen Blöcke werden nicht abgerechnet, aber die verbleibenden Turns laufen ohne das frühere Reasoning. Von Opus 5 zu Opus 5.5 bleiben sie erhalten.

Gibt es einen Ersatz für die erzwungene Tool-Wahl?

Behalten Sie tool_choice: auto, setzen Sie strict: true auf dem Tool, damit jeder Aufruf seinem Schema entspricht, und sagen Sie im Prompt, wann das Tool gilt. Für reine JSON-Ausgabe nutzen Sie Structured Outputs statt eines Tools.

Sollte Opus 5 als Fallback verfügbar bleiben?

Ja, mindestens während des Canary. Anthropic führt claude-opus-5 als aktiv mit einer Retirement-Untergrenze vom 24. Juli 2027 auf den von ihm betriebenen Plattformen. Testen Sie die konkrete Route, auf die Sie zurückfallen wollen, inklusive des oben beschriebenen Thinking-Block-Verhaltens.

Welche Workloads sollten zuerst wechseln?

Lange agentische Coding-Läufe, die Analyse großer Dokumente und cache-lastige Agents mit stabilem Prefix, in dieser Reihenfolge des erwarteten Nutzens. Alltags-Coding und hochvolumiger, latenzsensitiver Traffic gehören meist auf Sonnet 5 statt auf eines der beiden Opus-Modelle.

Quellen

Fakten zuletzt geprüft am 22. September 2026. Die Kostenbeispiele verwenden Anthropics Listenpreise und feste Token-Mischungen; sie sind Preisarithmetik, keine gemessenen Ergebnisse.

Bereit, Ihre KI-Kosten um 89 % zu senken?

Starten Sie noch heute mit EvoLink und erleben Sie die Vorteile intelligenter API-Routing.