
Claude Opus 5.5 Release: Was sich am 22. September geändert hat
claude-opus-5-5, das 1M-Token-Kontextfenster und die 128K maximale Ausgabe bleiben wie bei Opus 5, und das Thinking ist jetzt immer aktiv. Vier dokumentierte Breaking Changes betreffen Code, der bereits auf Opus 5 läuft.Release-Status von Claude Opus 5.5
| Punkt | Bestätigter Status |
|---|---|
| Release-Datum | 22. September 2026 |
| Anthropic-Lebenszyklus | Aktiv; empfohlener Ausgangspunkt für die meisten Workloads |
| Offizielle Modell-ID | claude-opus-5-5 (ohne Datumssuffix, gleiches Schema wie claude-opus-5) |
| Standardpreis | 4 $ / MTok Input, 20 $ / MTok Output |
| Prompt-Caching | 5-Minuten-Write 5 $, 1-Stunden-Write 8 $, Cache-Read 0,20 $ pro MTok (5 % des Inputs) |
| Batch API | 2 $ / MTok Input, 10 $ / MTok Output |
| Kontextfenster | 1 Million Tokens |
| Maximale Ausgabe | 128.000 Tokens (300K in der Batch API mit Beta-Header) |
| Ein- und Ausgabe | Text und Bilder zu Text |
| Thinking | Adaptiv, immer aktiv; Standard-Effort medium |
| Wissensstand | Juni 2026 |
| Veröffentlichte Retirement-Untergrenze | Nicht vor dem 22. September 2027 auf Anthropic-betriebenen Plattformen |
| Offizielle Verfügbarkeit | Claude API, Amazon Bedrock (anthropic.claude-opus-5-5), Claude Platform on AWS, Google Cloud, Microsoft Foundry |
Das sind vom Anbieter veröffentlichte Fakten aus Anthropics Release Notes, Modellübersicht und Preisseite, geprüft am 22. September 2026. Gateway-Verfügbarkeit, regionale Bedingungen, Durchsatz und Abrechnung unterscheiden sich weiterhin je Kanal und Konto; prüfen Sie den Vertrag, den Sie tatsächlich nutzen.
Was sich mit dem Release vom 22. September geändert hat
effort-Einstellung unverändert übernimmt, sieht die beschriebene Ersparnis möglicherweise nicht.Bei den Fähigkeiten positioniert Anthropic Opus 5.5 für langlaufendes agentisches Coding, Wissensarbeit auf Analystenniveau und das Lesen dichter Diagramme, Schaubilder und Screenshots. Die Ankündigung nennt einen FrontierCode-Wert von 54,6 %, beschreibt es als besser als GPT-6 Astra bei etwa 20 % der Kosten bei Standard-Effort und sagt, es „performs at the level of Claude Fable 5.1 on most work“. Wir haben die Evaluationskonfigurationen hinter diesen Aussagen nicht geprüft; dieser Artikel behandelt sie als Behauptungen, die auf Ihren eigenen Traces zu reproduzieren sind, nicht als Ergebnisse.
Vier Breaking Changes, die bestehende Integrationen testen müssen
400-Fehler zurückgeben oder das Verhalten stillschweigend ändern.400-Fehler unten sind das Verhalten der Anthropic API. Auf EvoLink wandelt das Gateway die Alt-Einstellungen thinking: disabled und budget_tokens in adaptives Thinking um, statt sie abzulehnen; erzwungene Tool-Wahl wird dagegen sowohl am Chat-Completions- als auch am Messages-Endpunkt abgelehnt. Das Gateway-Verhalten ist auf der Claude Opus 5.5 Modellseite dokumentiert.- Thinking lässt sich nicht deaktivieren.
thinking: {"type": "disabled"}und die manuellebudget_tokens-Form liefern beide400 invalid_request_error. Lassen Sie dasthinking-Feld weg oder senden Sieadaptive, und steuern Sie die Tiefe miteffort. Wer Thinking abgeschaltet hatte, um Tokens zu sparen, nutzt stattdessen eine niedrigere Effort-Stufe. - Erzwungene Tool-Nutzung wird abgelehnt.
tool_choicevom Typanyundtoolliefert400, auch am Token-Counting-Endpunkt. Behalten Sieauto, setzen Siestrict: trueam Tool für schemakonforme Argumente oder verschieben Sie das Schema in Structured Outputs, und sagen Sie im Prompt, wann das Tool gilt. - Thinking-Blöcke sind an Modell und Konversation gebunden. Opus 5.5 liest Thinking-Blöcke von Opus 5 und früheren Opus-, Sonnet- und Haiku-Modellen, aber nicht von Fable oder Mythos. In der Gegenrichtung lesen nur Claude Fable 5.1 und Mythos 5.1 Opus-5.5-Blöcke; ein Fallback auf ein anderes Modell läuft ohne sie. Das Bearbeiten von System-Prompt, Tools oder früheren Turns mitten in der Konversation macht die Blöcke ungültig, und Konten, die am oder nach dem 31. August 2026 angelegt wurden, erhalten standardmäßig
400, wenn sie nach einer solchen Änderung einen Block erneut senden. - Das Tool
computer_20251124wird auf der Claude API und Google Cloud nicht akzeptiert. Deklarieren Sie stattdessencomputer_toolset_20260801und stellen Sie die Agent-Schleife auf Member-Tool-Use-Blöcke um. Auf Amazon Bedrock funktioniert das ältere Tool weiter.
thinking-Blöcke statt als text-Blöcke zurück. Beim Standard display: "omitted" ist ihr Text leer; eine Anwendung, die diese Notizen als Fortschritt gestreamt hat, wird zwischen Tool-Aufrufen still. Setzen Sie display auf "updates" (Beta, Header thinking-display-updates-2026-08-18) oder "summarized" und rendern Sie die nicht leeren Thinking-Blöcke, um sie wiederherzustellen.effort ist medium, wo Opus 5 mit high lief; eine Anfrage ohne effort leistet jetzt weniger Arbeit. Und die Sicherheitsklassifikatoren decken mehr Kategorien ab: Erwarten Sie stop_details.category-Werte wie bio und reasoning_extraction neben cyber, und beachten Sie, dass der serverseitige Fallback reasoning_extraction-Ablehnungen nicht wiederholt.Wie sich das Opus-5.2-Gerücht auflöste
claude-opus-5-5.Opus 5.5, Opus 5, Sonnet 5 und Fable 5.1 sind vier Routing-Entscheidungen
| Modell | Aktuelle Rolle | Routing-Konsequenz |
|---|---|---|
| Claude Opus 5 | Aktiver Vorgänger, 5 $ / 25 $, Retirement nicht vor dem 24. Juli 2027 | Als gemessener Rollback behalten, während 5.5 im Canary läuft; vor der Annahme der Redundanz erneut testen |
| Claude Opus 5.5 | Neuestes Opus, 4 $ / 20 $, Anthropics empfohlener Default | Zuerst für agentisches Coding, lange Dokumente und visuelle Analyse evaluieren |
| Claude Sonnet 5 | Ausgewogene Stufe, 2 $ / 10 $ | Weiterhin Default für Alltags-Coding, hochvolumige Agents und latenzsensitiven Chat |
| Claude Fable 5.1 | Spitzenstufe, 10 $ / 50 $ | Eskalieren, wenn Opus 5.5 bei hohem Effort die Messlatte noch reißt |
Anthropics eigene Empfehlung lautet, die meisten Workloads mit Opus 5.5 zu beginnen und erst dann zu Fable 5.1 zu wechseln, wenn Opus-Evaluationen mit höherem Effort noch nicht reichen. Das macht Opus 5 am ersten Tag nicht überflüssig: Ein Workload, der bereits darauf validiert ist und noch nicht erneut getestet wurde, hat bislang keinen Beleg, dass die neuere Route für diese Aufgabe besser ist.
Ein Release garantiert keine identische Verfügbarkeit auf jedem Kanal
Anthropic führt Opus 5.5 ab dem ersten Tag auf der Claude API sowie auf AWS, Google Cloud und Microsoft Foundry. Drei Details unterscheiden sich weiterhin je Kanal. Fast Mode, bepreist mit 8 $ / 40 $ pro Million Tokens, ist eine Research Preview nur auf der Claude API. Das ältere Computer-Use-Tool funktioniert auf Bedrock weiter, nicht aber auf der Claude API oder Google Cloud. Und die Kontingente der Verbraucherpläne in den Claude-Apps sind eine getrennte Sache von der API-Token-Abrechnung; ein Modell im Chat-Picker sagt nichts über das Rate-Limit eines API-Keys.
claude-opus-5-5 sowohl am OpenAI-kompatiblen Chat-Completions-Endpunkt als auch am Anthropic-Messages-Endpunkt, mit dem API-Key, den Sie bereits verwenden. Die Modellseite dokumentiert, welche Einstellungen das Gateway aus Kompatibilitätsgründen umwandelt und welche es ablehnt. Bestätigen Sie zurückgegebenes Modell, Usage und abgerechnete Dimensionen auf Ihrem eigenen Konto vor Produktions-Traffic; ein veröffentlichtes Modell ist kein bestandenes Produktions-Gate.Was Entwickler wollten und was weiterhin gemessen werden muss
Das Release beantwortet die Fragen, die vor einer Woche offen waren: Der öffentliche Name, die API-ID, Kontext- und Ausgabelimits, Token-Preise, Cache-Ökonomie, Plattformliste und Migrationsrisiken sind dokumentiert. Es beantwortet nicht, ob Opus 5.5 die richtige Route für Ihr Produkt ist.
high auf medium gesunken ist und das Modell auf einer gegebenen Stufe pro Turn mehr denkt, brauchen Sie einen frischen Effort-Sweep, bevor irgendein Kostenvergleich etwas bedeutet. Anthropics Migrationsleitfaden sagt dasselbe: Sweep neu fahren, modellspezifische Prompt-Anweisungen neu bewerten und in der Entwicklung testen, bevor Produktions-Traffic wechselt.Sieben Produktionssignale, die sich zu beobachten lohnen
| Signal | Aufzubewahrender Beleg | Warum es auf Opus 5.5 wichtig ist |
|---|---|---|
| Routen-Identität | Angefragte und zurückgegebene Modell-IDs | Fallback auf ein Nicht-Fable-Modell verwirft Thinking-Blöcke stillschweigend |
| Effort | Die tatsächlich gesendete Stufe pro Anfrage | Weglassen bedeutet jetzt medium, nicht high |
| Tool-Verhalten | Gewähltes Tool, Argumente, strict-Validierung, Retries | Erzwungene Tool-Wahl ist weg; auto garantiert keinen Aufruf |
| Konversationsintegrität | Append-only-Historie, unverändert zurückgegebene Thinking-Blöcke | Bearbeitete Historie liefert auf neueren Konten 400 |
| Fortschrittsausgabe | Nicht leere thinking-Blöcke zwischen Tool-Aufrufen | Streaming-UIs werden bei der Standardanzeige still |
| Kosten | Input, Cache-Writes, Cache-Reads, Output, Tool-Gebühren pro akzeptierter Aufgabe | Die 60 % beim Cache-Read erreichen nur cache-lastige Workloads |
| Safeguards | stop_reason, stop_details.category, genutzter Fallback | Neue Ablehnungskategorien, eine davon ohne Retry |
Speichern Sie diese Felder in einem Evaluationsdatensatz. Ein Qualitätsgewinn ohne Routen-Identität oder Abrechnungsbeleg ist unvollständig, und ein günstigerer Trace, der mehr Retries oder menschliche Nacharbeit braucht, kann pro akzeptierter Aufgabe trotzdem mehr kosten.
Wer sollte Opus 5.5 jetzt testen?
Priorisieren Sie eine Evaluation, wenn Ihr Workload lange agentische Coding-Sitzungen in einem echten Repository fährt, Dokumente auf Analystenniveau aus großen Belegsammlungen erzeugt oder dichte Diagramme und Screenshots liest, für die frühere Modelle Crop-Tools brauchten. Die Cache-Read-Senkung zählt am meisten, wenn ein großer stabiler Prefix in den meisten Turns aus dem Cache bedient wird.
Wechseln Sie nicht, weil es neuer ist. Alltags-Coding, hochvolumige Agents und latenzsensitiver Chat gehören meist auf Sonnet 5, und ein bereits auf Opus 5 validierter Workload verdient einen gepaarten Replay, bevor er wechselt. Teams, die Thinking auf Opus 5 aus Latenzgründen deaktiviert hatten, sollten neben der Codeänderung auch eine Prompt-Überprüfung einplanen, denn der einzige verbleibende Hebel ist Effort.
Produktions-Rollout-Checkliste auf EvoLink
| Gate | Was zu prüfen ist | Rollback-Bedingung |
|---|---|---|
| Identität | Angefragtes und zurückgegebenes Modell lauten beide claude-opus-5-5 | Unerwartetes Modell oder intransparenter Fallback |
| Anfrageform | Kein thinking: disabled, kein budget_tokens, kein erzwungenes tool_choice, explizites effort | Irgendein 400 bei einer wiederholten Produktionsanfrage |
| Qualität | Rate akzeptierter Aufgaben hält oder steigt beim gewählten Effort | Rückschritt in einer kritischen Aufgabenklasse |
| Historie | Thinking-Blöcke überstehen den unterstützten Konversationsfluss und jeden Fallback-Pfad | Ungültige Historie nach Bearbeitungen oder Downgrade |
| Kosten | Kosten pro akzeptierter Aufgabe sinken nach dem Effort-Sweep | Token- oder Review-Kosten über der Opus-5-Basis |
| Zuverlässigkeit | Fehlerrate und p95-Latenz bleiben im Service-Ziel | Kapazität oder Latenz reißen das Gate |
Beginnen Sie mit Replay, dann Shadow-Traffic, dann einem schmalen Canary. Halten Sie die Modellauswahl in der Konfiguration, damit eine gescheiterte Promotion eine Konfigurationsänderung ist, kein Rewrite.
Claude Opus 5.5 auf EvoLink evaluieren Zur Upgrade-Entscheidung Opus 5.5 vs Opus 5FAQ
Wann wurde Claude Opus 5.5 veröffentlicht?
Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht und führt es als aktiv mit einer Retirement-Untergrenze vom 22. September 2027 auf den von Anthropic betriebenen Plattformen.
Ist Claude Opus 5.5 über eine API verfügbar?
Wie lautet die Modell-ID von Claude Opus 5.5?
claude-opus-5-5, eine feste ID ohne Datumssuffix. EvoLink verwendet denselben String am Chat-Completions- und am Messages-Endpunkt. Auf Bedrock lautet die ID anthropic.claude-opus-5-5.Was kostet Claude Opus 5.5 im Vergleich zu Opus 5?
Anthropics Listenpreis liegt bei 4 $ / 20 $ pro Million Input- / Output-Tokens gegenüber 5 $ / 25 $ bei Opus 5, ein Minus von 20 %. Cache-Reads fallen von 0,50 $ auf 0,20 $, ein Minus von 60 %. Anthropics „40 % günstiger im Betrieb“ ist eine Gesamtkostenschätzung auf seiner eigenen Aufgabenmischung, kein Listenpreis.
Kann ich das Thinking auf Claude Opus 5.5 abschalten?
thinking: disabled und budget_tokens beide 400. Auf EvoLink wandelt das Gateway diese Alt-Einstellungen in adaptives Thinking um, statt sie abzulehnen; abschalten lässt sich das Thinking damit trotzdem nicht. Lassen Sie das Feld weg oder senden Sie adaptive, und steuern Sie die Tiefe mit effort (low bis max, Standard medium).Ist Opus 5.2 dasselbe wie Opus 5.5?
Anthropic hat nie ein „Opus 5.2“ angekündigt; der Name stammt aus Community-Routing-Berichten von Mitte September. Opus 5.5 ist das Modell, das Anthropic tatsächlich veröffentlicht hat. Ob die früheren Berichte frühen Traffic auf diesem Modell beschrieben, ist unbestätigt, daher halten wir beide Namen getrennt.
Ersetzt Opus 5.5 Claude Opus 5?
Nicht automatisch. Opus 5 bleibt aktiv mit einer Retirement-Untergrenze vom 24. Juli 2027. Anthropic empfiehlt, neue Workloads auf Opus 5.5 zu starten, aber ein bereits auf Opus 5 validierter Workload sollte vor dem Wechsel erneut getestet werden.
Wo kann ich Opus 5.5 vor dem Wechsel mit Opus 5 vergleichen?
Quellen
- Anthropic: Platform Release Notes, Eintrag vom 22. September 2026
- Anthropic: Models overview
- Anthropic: Pricing
- Anthropic: What's new in Claude Opus 5.5
- Anthropic: Migrating to Claude Opus 5.5
- Anthropic: Introducing Claude Opus 5.5


