GPT Image 2.5 Flare & Sunburst sind jetzt auf EvoLink verfügbarGPT Image 2.5 testen
Claude Opus 5.5 Release-Cover mit einem Torbogen aus Terrakotta und fließenden Linien
Release-Beobachtung

Claude Opus 5.5 Release: Was sich am 22. September geändert hat

EvoLink Team
EvoLink Team
Produktteam
22. September 2026
14 Min. Lesezeit
Claude Opus 5.5 wurde am 22. September 2026 veröffentlicht. Anthropic führt es als neuestes Opus-Modell für langlaufendes agentisches Coding und Wissensarbeit, zu 4 $ pro Million Input-Tokens und 20 $ pro Million Output-Tokens, statt 5 $ und 25 $ bei Opus 5. Die Modell-ID lautet claude-opus-5-5, das 1M-Token-Kontextfenster und die 128K maximale Ausgabe bleiben wie bei Opus 5, und das Thinking ist jetzt immer aktiv. Vier dokumentierte Breaking Changes betreffen Code, der bereits auf Opus 5 läuft.
Für EvoLink-Nutzer ist das Modell bereits aufrufbar: Die Claude Opus 5.5 Modellseite ist die verbindliche Quelle für die Live-Route, die aktuellen EvoLink-Preise und die Integrationseinstellungen. Dieser Artikel behandelt, was Anthropic veröffentlicht hat, was sich für Entwickler ändert und wie die Woche der „Opus 5.2“-Gerüchte ausging. Die Upgrade-Entscheidung selbst, mit Kostenmodell und Canary-Plan, steht in Claude Opus 5.5 vs Claude Opus 5.

Release-Status von Claude Opus 5.5

PunktBestätigter Status
Release-Datum22. September 2026
Anthropic-LebenszyklusAktiv; empfohlener Ausgangspunkt für die meisten Workloads
Offizielle Modell-IDclaude-opus-5-5 (ohne Datumssuffix, gleiches Schema wie claude-opus-5)
Standardpreis4 $ / MTok Input, 20 $ / MTok Output
Prompt-Caching5-Minuten-Write 5 $, 1-Stunden-Write 8 $, Cache-Read 0,20 $ pro MTok (5 % des Inputs)
Batch API2 $ / MTok Input, 10 $ / MTok Output
Kontextfenster1 Million Tokens
Maximale Ausgabe128.000 Tokens (300K in der Batch API mit Beta-Header)
Ein- und AusgabeText und Bilder zu Text
ThinkingAdaptiv, immer aktiv; Standard-Effort medium
WissensstandJuni 2026
Veröffentlichte Retirement-UntergrenzeNicht vor dem 22. September 2027 auf Anthropic-betriebenen Plattformen
Offizielle VerfügbarkeitClaude API, Amazon Bedrock (anthropic.claude-opus-5-5), Claude Platform on AWS, Google Cloud, Microsoft Foundry

Das sind vom Anbieter veröffentlichte Fakten aus Anthropics Release Notes, Modellübersicht und Preisseite, geprüft am 22. September 2026. Gateway-Verfügbarkeit, regionale Bedingungen, Durchsatz und Abrechnung unterscheiden sich weiterhin je Kanal und Konto; prüfen Sie den Vertrag, den Sie tatsächlich nutzen.

Was sich mit dem Release vom 22. September geändert hat

Die Schlagzeile ist eine Preissenkung auf jeder Token-Dimension bei unveränderten Kontext- und Ausgabelimits. Standard-Input und -Output fallen um 20 % gegenüber Opus 5. Cache-Reads fallen von 0,50 $ auf 0,20 $ pro Million Tokens, ein Minus von 60 %, weil Opus 5.5 Cache-Treffer mit 5 % des Input-Preises bepreist, wo andere Claude-Modelle 10 % verlangen (Fable 5.1 und Mythos 5.1: 2,5 %). Cache-Writes fallen im Gleichschritt mit dem Input: 5 $ und 8 $ statt 6,25 $ und 10 $.
Anthropics Ankündigung geht weiter und sagt, Opus 5.5 „costs 40% less to run than Opus 5“ und erzeugt Output „more than 30% faster“. Lesen Sie diese beiden Zahlen genau. 20 % und 60 % sind Listenpreis-Arithmetik, die Sie auf der Preisseite nachrechnen können. Die 40 % sind Anthropics Messung der Gesamtkosten auf seiner eigenen Aufgabenmischung; sie verbindet die niedrigeren Einheitspreise mit weniger verbrauchten Tokens pro erledigter Aufgabe. Es ist eine Herstellerschätzung für einen Workload, den Sie nicht betreiben. Anthropics eigene Dokumentation merkt zudem an, dass Opus 5.5 auf einer gegebenen Effort-Stufe pro Turn tendenziell mehr denkt als Opus 5; eine Anfrage, die ihre alte effort-Einstellung unverändert übernimmt, sieht die beschriebene Ersparnis möglicherweise nicht.

Bei den Fähigkeiten positioniert Anthropic Opus 5.5 für langlaufendes agentisches Coding, Wissensarbeit auf Analystenniveau und das Lesen dichter Diagramme, Schaubilder und Screenshots. Die Ankündigung nennt einen FrontierCode-Wert von 54,6 %, beschreibt es als besser als GPT-6 Astra bei etwa 20 % der Kosten bei Standard-Effort und sagt, es „performs at the level of Claude Fable 5.1 on most work“. Wir haben die Evaluationskonfigurationen hinter diesen Aussagen nicht geprüft; dieser Artikel behandelt sie als Behauptungen, die auf Ihren eigenen Traces zu reproduzieren sind, nicht als Ergebnisse.

Vier Breaking Changes, die bestehende Integrationen testen müssen

Code auf Opus 5 wechselt nicht durch das Ändern des Modell-Strings allein zu Opus 5.5. Anthropic dokumentiert vier Änderungen, die einen 400-Fehler zurückgeben oder das Verhalten stillschweigend ändern.
Hinweis zum Geltungsbereich: Die 400-Fehler unten sind das Verhalten der Anthropic API. Auf EvoLink wandelt das Gateway die Alt-Einstellungen thinking: disabled und budget_tokens in adaptives Thinking um, statt sie abzulehnen; erzwungene Tool-Wahl wird dagegen sowohl am Chat-Completions- als auch am Messages-Endpunkt abgelehnt. Das Gateway-Verhalten ist auf der Claude Opus 5.5 Modellseite dokumentiert.
  1. Thinking lässt sich nicht deaktivieren. thinking: {"type": "disabled"} und die manuelle budget_tokens-Form liefern beide 400 invalid_request_error. Lassen Sie das thinking-Feld weg oder senden Sie adaptive, und steuern Sie die Tiefe mit effort. Wer Thinking abgeschaltet hatte, um Tokens zu sparen, nutzt stattdessen eine niedrigere Effort-Stufe.
  2. Erzwungene Tool-Nutzung wird abgelehnt. tool_choice vom Typ any und tool liefert 400, auch am Token-Counting-Endpunkt. Behalten Sie auto, setzen Sie strict: true am Tool für schemakonforme Argumente oder verschieben Sie das Schema in Structured Outputs, und sagen Sie im Prompt, wann das Tool gilt.
  3. Thinking-Blöcke sind an Modell und Konversation gebunden. Opus 5.5 liest Thinking-Blöcke von Opus 5 und früheren Opus-, Sonnet- und Haiku-Modellen, aber nicht von Fable oder Mythos. In der Gegenrichtung lesen nur Claude Fable 5.1 und Mythos 5.1 Opus-5.5-Blöcke; ein Fallback auf ein anderes Modell läuft ohne sie. Das Bearbeiten von System-Prompt, Tools oder früheren Turns mitten in der Konversation macht die Blöcke ungültig, und Konten, die am oder nach dem 31. August 2026 angelegt wurden, erhalten standardmäßig 400, wenn sie nach einer solchen Änderung einen Block erneut senden.
  4. Das Tool computer_20251124 wird auf der Claude API und Google Cloud nicht akzeptiert. Deklarieren Sie stattdessen computer_toolset_20260801 und stellen Sie die Agent-Schleife auf Member-Tool-Use-Blöcke um. Auf Amazon Bedrock funktioniert das ältere Tool weiter.
Eine fünfte Änderung bricht nichts, verändert aber, was Nutzer sehen: Die kurzen Notizen, die das Modell zwischen Tool-Aufrufen schreibt, kommen jetzt als Fortschritts-thinking-Blöcke statt als text-Blöcke zurück. Beim Standard display: "omitted" ist ihr Text leer; eine Anwendung, die diese Notizen als Fortschritt gestreamt hat, wird zwischen Tool-Aufrufen still. Setzen Sie display auf "updates" (Beta, Header thinking-display-updates-2026-08-18) oder "summarized" und rendern Sie die nicht leeren Thinking-Blöcke, um sie wiederherzustellen.
Zwei Defaults verschieben sich ebenfalls. Der Standard-effort ist medium, wo Opus 5 mit high lief; eine Anfrage ohne effort leistet jetzt weniger Arbeit. Und die Sicherheitsklassifikatoren decken mehr Kategorien ab: Erwarten Sie stop_details.category-Werte wie bio und reasoning_extraction neben cyber, und beachten Sie, dass der serverseitige Fallback reasoning_extraction-Ablehnungen nicht wiederholt.

Wie sich das Opus-5.2-Gerücht auflöste

Zwischen dem 14. und 21. September beschrieben Community-Posts, Claude Code leite einige Opus-5-Anfragen unauffällig an einen neueren Build weiter, den sie „Opus 5.2“ nannten; Drittseiten verbreiteten drei Kandidatennamen und einen internen Codenamen. Unser Opus-5.2-Release-Tracker hielt am 18. September fest, dass Anthropic kein solches Modell, keine ID und keinen Preis dokumentierte.
Das Release klärt die Identitätsfrage so, wie unser Tracker es angekündigt hatte: mit einer datierten Release Note, einer Modellseite, einer aufrufbaren ID, dokumentierten Preisen und einem Migrationsleitfaden, alles unter dem Namen Claude Opus 5.5. Was es nicht klärt, ist, ob die Routing-Berichte vom September früher Traffic auf diesem Modell waren. Anthropic hat das nicht gesagt, ein Produkt „Opus 5.2“ wurde nie angekündigt, und beide Namen bleiben auf dieser Seite getrennte Entitäten. Behandeln Sie „Opus 5.2“ als Community-Etikett, dessen Geschichte zu Ende ist, nicht als Alias für claude-opus-5-5.
Dieselbe Disziplin gilt für den nächsten Namen im Umlauf. Anthropic hat Claude Opus 6 nicht angekündigt; unsere Opus-6-Release-Watch verfolgt es weiter als unbestätigte künftige Generation, und Opus 5.5 ist ein Punkt-Release innerhalb der aktuellen.

Opus 5.5, Opus 5, Sonnet 5 und Fable 5.1 sind vier Routing-Entscheidungen

ModellAktuelle RolleRouting-Konsequenz
Claude Opus 5Aktiver Vorgänger, 5 $ / 25 $, Retirement nicht vor dem 24. Juli 2027Als gemessener Rollback behalten, während 5.5 im Canary läuft; vor der Annahme der Redundanz erneut testen
Claude Opus 5.5Neuestes Opus, 4 $ / 20 $, Anthropics empfohlener DefaultZuerst für agentisches Coding, lange Dokumente und visuelle Analyse evaluieren
Claude Sonnet 5Ausgewogene Stufe, 2 $ / 10 $Weiterhin Default für Alltags-Coding, hochvolumige Agents und latenzsensitiven Chat
Claude Fable 5.1Spitzenstufe, 10 $ / 50 $Eskalieren, wenn Opus 5.5 bei hohem Effort die Messlatte noch reißt

Anthropics eigene Empfehlung lautet, die meisten Workloads mit Opus 5.5 zu beginnen und erst dann zu Fable 5.1 zu wechseln, wenn Opus-Evaluationen mit höherem Effort noch nicht reichen. Das macht Opus 5 am ersten Tag nicht überflüssig: Ein Workload, der bereits darauf validiert ist und noch nicht erneut getestet wurde, hat bislang keinen Beleg, dass die neuere Route für diese Aufgabe besser ist.

Ein Release garantiert keine identische Verfügbarkeit auf jedem Kanal

Anthropic führt Opus 5.5 ab dem ersten Tag auf der Claude API sowie auf AWS, Google Cloud und Microsoft Foundry. Drei Details unterscheiden sich weiterhin je Kanal. Fast Mode, bepreist mit 8 $ / 40 $ pro Million Tokens, ist eine Research Preview nur auf der Claude API. Das ältere Computer-Use-Tool funktioniert auf Bedrock weiter, nicht aber auf der Claude API oder Google Cloud. Und die Kontingente der Verbraucherpläne in den Claude-Apps sind eine getrennte Sache von der API-Token-Abrechnung; ein Modell im Chat-Picker sagt nichts über das Rate-Limit eines API-Keys.

Auf EvoLink akzeptiert die Claude Opus 5.5 Route dieselbe ID claude-opus-5-5 sowohl am OpenAI-kompatiblen Chat-Completions-Endpunkt als auch am Anthropic-Messages-Endpunkt, mit dem API-Key, den Sie bereits verwenden. Die Modellseite dokumentiert, welche Einstellungen das Gateway aus Kompatibilitätsgründen umwandelt und welche es ablehnt. Bestätigen Sie zurückgegebenes Modell, Usage und abgerechnete Dimensionen auf Ihrem eigenen Konto vor Produktions-Traffic; ein veröffentlichtes Modell ist kein bestandenes Produktions-Gate.

Was Entwickler wollten und was weiterhin gemessen werden muss

Das Release beantwortet die Fragen, die vor einer Woche offen waren: Der öffentliche Name, die API-ID, Kontext- und Ausgabelimits, Token-Preise, Cache-Ökonomie, Plattformliste und Migrationsrisiken sind dokumentiert. Es beantwortet nicht, ob Opus 5.5 die richtige Route für Ihr Produkt ist.

Die 40 % Kosten, die 30 % Geschwindigkeit, das FrontierCode-Ergebnis und „Fable-5.1-Niveau bei den meisten Arbeiten“ sind Hypothesen, bis sie auf Ihren Traces halten. Weil der Standard-Effort von high auf medium gesunken ist und das Modell auf einer gegebenen Stufe pro Turn mehr denkt, brauchen Sie einen frischen Effort-Sweep, bevor irgendein Kostenvergleich etwas bedeutet. Anthropics Migrationsleitfaden sagt dasselbe: Sweep neu fahren, modellspezifische Prompt-Anweisungen neu bewerten und in der Entwicklung testen, bevor Produktions-Traffic wechselt.

Sieben Produktionssignale, die sich zu beobachten lohnen

SignalAufzubewahrender BelegWarum es auf Opus 5.5 wichtig ist
Routen-IdentitätAngefragte und zurückgegebene Modell-IDsFallback auf ein Nicht-Fable-Modell verwirft Thinking-Blöcke stillschweigend
EffortDie tatsächlich gesendete Stufe pro AnfrageWeglassen bedeutet jetzt medium, nicht high
Tool-VerhaltenGewähltes Tool, Argumente, strict-Validierung, RetriesErzwungene Tool-Wahl ist weg; auto garantiert keinen Aufruf
KonversationsintegritätAppend-only-Historie, unverändert zurückgegebene Thinking-BlöckeBearbeitete Historie liefert auf neueren Konten 400
FortschrittsausgabeNicht leere thinking-Blöcke zwischen Tool-AufrufenStreaming-UIs werden bei der Standardanzeige still
KostenInput, Cache-Writes, Cache-Reads, Output, Tool-Gebühren pro akzeptierter AufgabeDie 60 % beim Cache-Read erreichen nur cache-lastige Workloads
Safeguardsstop_reason, stop_details.category, genutzter FallbackNeue Ablehnungskategorien, eine davon ohne Retry

Speichern Sie diese Felder in einem Evaluationsdatensatz. Ein Qualitätsgewinn ohne Routen-Identität oder Abrechnungsbeleg ist unvollständig, und ein günstigerer Trace, der mehr Retries oder menschliche Nacharbeit braucht, kann pro akzeptierter Aufgabe trotzdem mehr kosten.

Wer sollte Opus 5.5 jetzt testen?

Priorisieren Sie eine Evaluation, wenn Ihr Workload lange agentische Coding-Sitzungen in einem echten Repository fährt, Dokumente auf Analystenniveau aus großen Belegsammlungen erzeugt oder dichte Diagramme und Screenshots liest, für die frühere Modelle Crop-Tools brauchten. Die Cache-Read-Senkung zählt am meisten, wenn ein großer stabiler Prefix in den meisten Turns aus dem Cache bedient wird.

Wechseln Sie nicht, weil es neuer ist. Alltags-Coding, hochvolumige Agents und latenzsensitiver Chat gehören meist auf Sonnet 5, und ein bereits auf Opus 5 validierter Workload verdient einen gepaarten Replay, bevor er wechselt. Teams, die Thinking auf Opus 5 aus Latenzgründen deaktiviert hatten, sollten neben der Codeänderung auch eine Prompt-Überprüfung einplanen, denn der einzige verbleibende Hebel ist Effort.

GateWas zu prüfen istRollback-Bedingung
IdentitätAngefragtes und zurückgegebenes Modell lauten beide claude-opus-5-5Unerwartetes Modell oder intransparenter Fallback
AnfrageformKein thinking: disabled, kein budget_tokens, kein erzwungenes tool_choice, explizites effortIrgendein 400 bei einer wiederholten Produktionsanfrage
QualitätRate akzeptierter Aufgaben hält oder steigt beim gewählten EffortRückschritt in einer kritischen Aufgabenklasse
HistorieThinking-Blöcke überstehen den unterstützten Konversationsfluss und jeden Fallback-PfadUngültige Historie nach Bearbeitungen oder Downgrade
KostenKosten pro akzeptierter Aufgabe sinken nach dem Effort-SweepToken- oder Review-Kosten über der Opus-5-Basis
ZuverlässigkeitFehlerrate und p95-Latenz bleiben im Service-ZielKapazität oder Latenz reißen das Gate

Beginnen Sie mit Replay, dann Shadow-Traffic, dann einem schmalen Canary. Halten Sie die Modellauswahl in der Konfiguration, damit eine gescheiterte Promotion eine Konfigurationsänderung ist, kein Rewrite.

Claude Opus 5.5 auf EvoLink evaluieren Zur Upgrade-Entscheidung Opus 5.5 vs Opus 5

FAQ

Wann wurde Claude Opus 5.5 veröffentlicht?

Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht und führt es als aktiv mit einer Retirement-Untergrenze vom 22. September 2027 auf den von Anthropic betriebenen Plattformen.

Ist Claude Opus 5.5 über eine API verfügbar?

Ja. Anthropic dokumentiert es auf der Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry. Auf EvoLink ist es eine Live-Produktionsroute; die Modellseite zeigt die aktuellen Preise und Einstellungen.

Wie lautet die Modell-ID von Claude Opus 5.5?

claude-opus-5-5, eine feste ID ohne Datumssuffix. EvoLink verwendet denselben String am Chat-Completions- und am Messages-Endpunkt. Auf Bedrock lautet die ID anthropic.claude-opus-5-5.

Was kostet Claude Opus 5.5 im Vergleich zu Opus 5?

Anthropics Listenpreis liegt bei 4 $ / 20 $ pro Million Input- / Output-Tokens gegenüber 5 $ / 25 $ bei Opus 5, ein Minus von 20 %. Cache-Reads fallen von 0,50 $ auf 0,20 $, ein Minus von 60 %. Anthropics „40 % günstiger im Betrieb“ ist eine Gesamtkostenschätzung auf seiner eigenen Aufgabenmischung, kein Listenpreis.

Kann ich das Thinking auf Claude Opus 5.5 abschalten?

Auf keinem der beiden Wege. Auf Anthropics nativer API liefern thinking: disabled und budget_tokens beide 400. Auf EvoLink wandelt das Gateway diese Alt-Einstellungen in adaptives Thinking um, statt sie abzulehnen; abschalten lässt sich das Thinking damit trotzdem nicht. Lassen Sie das Feld weg oder senden Sie adaptive, und steuern Sie die Tiefe mit effort (low bis max, Standard medium).

Ist Opus 5.2 dasselbe wie Opus 5.5?

Anthropic hat nie ein „Opus 5.2“ angekündigt; der Name stammt aus Community-Routing-Berichten von Mitte September. Opus 5.5 ist das Modell, das Anthropic tatsächlich veröffentlicht hat. Ob die früheren Berichte frühen Traffic auf diesem Modell beschrieben, ist unbestätigt, daher halten wir beide Namen getrennt.

Ersetzt Opus 5.5 Claude Opus 5?

Nicht automatisch. Opus 5 bleibt aktiv mit einer Retirement-Untergrenze vom 24. Juli 2027. Anthropic empfiehlt, neue Workloads auf Opus 5.5 zu starten, aber ein bereits auf Opus 5 validierter Workload sollte vor dem Wechsel erneut getestet werden.

Wo kann ich Opus 5.5 vor dem Wechsel mit Opus 5 vergleichen?

Im Upgrade-Leitfaden Claude Opus 5.5 vs Claude Opus 5 mit Kostenmodell, Kompatibilitätsrisiken und Canary-Plan.

Quellen

Fakten zuletzt geprüft am 22. September 2026. Aussagen zu Leistung, Geschwindigkeit und Gesamtkosten stammen von Anthropic; EvoLink-Nutzer sollten ihre eigene Route und ihren eigenen Workload messen.

Bereit, Ihre KI-Kosten um 89 % zu senken?

Starten Sie noch heute mit EvoLink und erleben Sie die Vorteile intelligenter API-Routing.