Claude Opus 5 API
Claude Opus 5 auswählen
Anthropics neuestes Opus-Flaggschiff für die schwierigsten Coding-Aufgaben, lang laufende Agenten und urteilsintensive Reviews. Fünf Abrechnungsdimensionen – Eingabe, Cache-Schreiben, Cache-Lesen, Ausgabe und das Web-Search-Tool – werden getrennt gemessen; die Token-Preise liegen 5 % unter den offiziellen Tarifen.
Claude Opus 5
Anthropics Flaggschiff der Opus-Klasse
claude-opus-5Software-Engineering auf Repository-Ebene, lange Agentenläufe mit intensivem Tool-Einsatz, kritische Code-Reviews sowie Recherche- und Analysearbeit, bei der eine falsche Antwort mehr kostet als ein Premium-Tokenpreis.
Claude Opus 5 Preise
Schätzen Sie eine Anfrage mit dem interaktiven Preisrechner. Die EvoLink Token-Preise liegen 5 % unter Anthropics offiziellen Tarifen.
Token-Rechner
Geben Sie Token-Mix und Websuchen für eine Anfrage ein.Geschätzte Anfragekosten
Claude Opus 5Mindestbetrag: 0,01 Credits pro Anfrage.
EvoLink vs. Anthropic direkt
Gleicher Token-Mix mit den angezeigten EvoLink-Tarifen.Budget-Leitfaden
Ungefähre Anfragen mit dem aktuellen Token-Mix.Für schnelle Tests
Für die reguläre Entwicklung
Für die Produktionsbewertung
Modellpreise
| Modell | Kontext | Eingabe-Token | Cache-Schreib-Token | Cache-Lese-Token | Ausgabe-Token | Websuchen |
|---|---|---|---|---|---|---|
Claude Opus 5claude-opus-5 | Alle Kontextgrößen | $4.750 / 1M-5% 323 cr / 1M$5.000offizieller Preis | $5.939 / 1M-5% 403.8 cr / 1M$6.250offizieller Preis | $0.475 / 1M-5% 32.3 cr / 1M$0.500offizieller Preis | $23.750 / 1M-5% 1615 cr / 1M$25.000offizieller Preis | $0.010 / Suche0.68 cr / Suche |
Claude Opus 5
Alle KontextgrößenUSD und Credits werden je 1 Mio. Token angezeigt. Prüfen Sie vor dem Produktionseinsatz die aktuell in der Preistabelle ausgewiesenen Tarife.
Das Web-Search-Tool wird pro Suche zum offiziellen Tarif abgerechnet – zusätzlich zu den Token, die die Suchergebnisse der Anfrage hinzufügen.
Claude Opus 5 API für anspruchsvolle Coding- und Agenten-Workloads
Nutzen Sie Anthropics neuestes Opus-Flaggschiff über EvoLinks einheitliche API für 4,75 $ je 1 Mio. Eingabe-Token und 23,75 $ je 1 Mio. Ausgabe-Token — 5 % unter dem offiziellen Preis. Mit 1.000.000-Token-Kontextfenster, 128K maximaler Ausgabe, getrennten Schreib- und Leseraten für Prompt-Caching und einem pro Suche abgerechneten Web-Search-Tool.

Prompt-Caching als zwei getrennte Dimensionen abgerechnet
Claude berechnet beim Speichern eines Präfixes eine Schreibgebühr und bei der Wiederverwendung eine deutlich niedrigere Lesegebühr. Für stabile System-Prompts, Repository-Anweisungen und Tool-Schemas fällt die Schreibgebühr nur einmal an; danach können sie während langer Agentenläufe günstig aus dem Cache gelesen werden.
1M-Token-Kontext mit 128K maximaler Ausgabe
Halten Sie zusammengehörigen Code, Spezifikationen, Dokumente und Agentenzustand in einem Arbeitskontext. Behandeln Sie das Limit als Kapazität, nicht als Ziel: relevante Belege abrufen, das stabile Präfix cachen und aufgabengerechte Ausgabebudgets setzen.
Thinking und Effort verändern Latenz und Token-Verbrauch
Anthropic aktiviert adaptives Denken bei Opus 5 standardmäßig; in der Claude API ist effort standardmäßig high. Prüfen Sie vor dem Produktionseinsatz, ob der gewählte EvoLink-Endpunkt die benötigten Parameter unterstützt, und messen Sie Antwort, Ausgabe-Token und Latenz. max_tokens ist kein Thinking-Budget.
Reale Workloads vor der Umstellung des Produktionsverkehrs erneut ausführen
Gleiche Tokenpreise bedeuten nicht automatisch gleiche Kosten pro erledigter Aufgabe. Modellverhalten und Tokenisierung können abgerechnete Token, Wiederholungen und Tool-Pfade verändern. Vergleichen Sie daher Erfolgsquote, Gesamtkosten und Korrekturaufwand an realen Produktionsbeispielen.
Wo Claude Opus 5 seinen Premium-Tarif verdient
Opus-Preise zahlen sich nur aus, wenn eine Aufgabe schwer genug ist, dass eine bessere Antwort nachgelagerte Arbeit einspart. Routen Sie nach den Kosten eines Fehlers, nicht nach den Kosten pro Token.
Software-Engineering auf Repository-Ebene
Große Codebasen prüfen, Abhängigkeiten über Services hinweg verfolgen und Änderungen über mehrere Dateien planen, während architektonische Randbedingungen in einem Kontext bleiben. Messen Sie akzeptierte Patches und Review-Zeit statt isolierter Snippet-Qualität.
Langlaufende Agenten mit intensivem Tool-Einsatz
Mehrstufige Orchestrierung, Tool-Auswahl und Code-Ausführung über lange Läufe, bei denen ein einziger falscher Zweig weit mehr kostet als die Token-Differenz. Vollständige Assistant-Nachrichten, Tool-Call-IDs, Argumente und Tool-Ergebnisse über alle Turns hinweg wiedergeben.
Kritische Reviews und Analysen
Security-Review, Migrationsplanung, Vertrags- und Rechercheanalyse – überall dort, wo eine selbstbewusst falsche Antwort teuer ist. Das 1M-Token-Fenster hält die vollständige Beweislage an einem Ort.
Wann eine andere Route besser ist
Alltägliches Coding, Agenten mit hohem Volumen, Klassifikation und latenzkritischer Chat gehören meist auf Claude Sonnet 5. Claude Opus 4.8 hat auf EvoLink den tieferen Rabatt und bleibt die günstigere Opus-Route, solange seine Antworten ausreichen.
Fünf Abrechnungsdimensionen, getrennt gemessen
Claude Opus 5 rechnet nicht als einheitlicher Mischtarif ab. Zu verstehen, welche Dimension ein Workload tatsächlich verbraucht, macht ein Opus-Budget planbar.
Eingabe- und Ausgabe-Token
Die beiden Dimensionen, die jede Anfrage berührt: 4,75 $ pro 1M Eingabe-Token und 23,75 $ pro 1M Ausgabe-Token auf EvoLink, 5 % unter Anthropics 5,00 $ und 25,00 $. Bei generierungsintensiver Arbeit dominiert die Ausgabe – begrenzen Sie max_tokens nach Aufgabenkomplexität.
Cache-Schreiben und Cache-Lesen
Das Speichern eines Präfixes kostet 5,939 $ je 1 Mio. Token, die Wiederverwendung 0,475 $ je 1 Mio. Token. Bei stabilen System-Prompts, Repository-Anweisungen und Tool-Schemas fällt die Schreibgebühr einmal an; danach wird der Präfix für etwa ein Zehntel des Eingabetarifs gelesen.
Web-Search-Tool
Die Abrechnung erfolgt pro Suche zu 0,01 $ — zum offiziellen Tarif ohne Rabatt. Suchergebnisse fließen zusätzlich als gewöhnliche Eingabe-Token in die Anfrage ein; bei einem rechercheintensiven Durchlauf fallen daher beide Kosten an.
Claude Opus 5 einführen, ohne den Modell-Stack zu ersetzen
Behalten Sie einen EvoLink-Client und API-Schlüssel, leiten Sie die schwierigsten Workloads an Opus 5 und behalten Sie getestete Alternativen für einfacheren oder latenzkritischen Verkehr.
Bestehenden kompatiblen Client-Flow nutzen
Richten Sie den Client auf EvoLink aus, authentifizieren Sie ihn mit demselben API-Schlüssel und wählen Sie claude-opus-5. Sowohl der OpenAI-kompatible Chat-Completions-Endpunkt als auch der Anthropic-Messages-Endpunkt funktionieren.
Die dokumentierte API-Modell-ID verwenden
Die API-Route lautet auf beiden Protokollen claude-opus-5. Seiten-URL und Modellparameter sind bei diesem Modell identisch.
Prompts für Cache-Wiederverwendung strukturieren
Stabilen System-Prompt, Repository-Anweisungen und Tool-Schemas an den Anfang der Anfrage setzen, damit das teure Präfix einmal geschrieben und danach günstig gelesen wird.
Nach dem Wert des fertigen Ergebnisses routen
Vergleichen Sie Erfolgsquote, Wiederholungen, Ausgabe-Token, Cache-Treffer, Laufzeit und Korrekturaufwand auf Ihren Aufgaben — nicht nur den Token-Preis.
Modell-ID kopieren und erste Anfrage senden
Diese Produktseite zeigt nur eine überprüfbare minimale Anfrage. Thinking, effort, Tool-Aufrufe, Fehlerbehandlung und Produktionsmigration werden im vollständigen API-Leitfaden erklärt.
curl https://direct.evolink.ai/v1/messages \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{"role": "user", "content": "Review this pull request and list the blocking issues."}
]
}'Claude-Routen nach dem Workload-Test vergleichen
EvoLinkPrüfen Sie zuerst, ob Opus 5 Retries und Review-Aufwand reduziert. Vergleichen Sie anschließend Preis, Kontext, Caching und Workload-Eignung.
| Modell | Claude Opus 5 | Claude Opus 4.8 | Claude Sonnet 5 |
|---|---|---|---|
| Eingabe / Ausgabe | $4.75 / $23.75 | $4.5 / $22.5 | $1.8 / $9 |
| Kontext | 1M | 1M | 1M |
| Caching | Lesen + Schreiben | Lesen + Schreiben | Lesen + Schreiben |
| Geeignet für | Software-Engineering auf Repository-Ebene, lange Agentenläufe mit intensivem Tool-Einsatz, kritische Code-Reviews sowie Recherche- und Analysearbeit, bei der eine falsche Antwort mehr kostet als ein Premium-Tokenpreis. | Das vorherige Opus-Flaggschiff — auf EvoLink weiterhin die günstigere Opus-Route für Premium-Coding und Agenten-Workloads. | Coding- und Agentenleistung nahe der Opus-Klasse zum ausgewogenen Sonnet-Tarif für den täglichen Produktionsverkehr. |
Weitere Claude-Modelle auf EvoLink

Claude Opus 4.8
Das vorherige Opus-Flaggschiff mit höherem EvoLink-Rabatt für Workloads, die es weiterhin zuverlässig erledigt.
Modell ansehen
Claude Sonnet 5
Die ausgewogenere Route für tägliches Coding, Agenten mit hohem Volumen und latenzkritischen Produktionsverkehr.
Modell ansehen
Claude Fable 5
Eine leistungsstärkere Claude-Route für besonders lange und anspruchsvolle Agenten-Workloads, bei denen Qualität wichtiger als Kosten ist.
Modell ansehen
Claude Haiku 4.5
Die schnellste und günstigste Claude-Route für Sub-Agenten, Klassifikation mit hohem Volumen und latenzarmen Chat.
Modell ansehenWeitere Textmodelle

GPT-5.6
OpenAIs gestaffelte Frontier-Familie für Routing nach Leistung, Latenz und Kosten.
Modell ansehen
Grok 4.5
xAIs Reasoning- und Tool-Route mit 500K Kontextfenster und serverseitigen Suchtools.
Modell ansehen
Kimi K3
Ein Long-Context-Reasoning-Modell für Coding auf Repository-Ebene und Arbeit mit mehreren Dokumenten.
Modell ansehen
Gemini 3.6 Flash
Eine schnelle, günstige Route für Produktionsverkehr ohne Bedarf an Opus-Urteilsvermögen.
Modell ansehenWeiterführende Artikel

Claude Opus 6: Release-Watch
Die nächste Opus-Generation verfolgen, ohne Release-Datum, API-Zugang, Modell-ID, Preis oder Spezifikationen als bestätigt darzustellen.
Leitfaden lesen
Claude Opus 5 vs Claude Opus 4.8
Welche Opus-Route sich für den Produktionseinsatz eignet und was sich verbessern muss, damit Opus 5 den geringeren Rabatt wert ist.
Leitfaden lesen
Claude Opus 5 vs Claude Fable 5
Wann Opus 5 der Premium-Default sein sollte und wann Fable 5 den doppelten offiziellen Tokenpreis rechtfertigt.
Leitfaden lesen
Claude Opus 5 vs GPT-5.6
Wie sich die beiden Frontier-Routen bei Preisdimensionen, Kontext und Agenten-Workloads vergleichen.
Leitfaden lesen
GPT-6 vs Claude Opus 5 nach Astra
Aufrufbare Opus-5-Fakten mit offenen Astra- und GPT-6-Behauptungen vergleichen, ohne Spezifikationen zu erfinden.
Leitfaden lesen
Claude Opus 5 API-Leitfaden
Sende den ersten Request, konfiguriere Thinking und Effort und nutze die Checkliste für Migration und Produktion.
Leitfaden lesenClaude Opus 5 API – Häufige Fragen
Ist die Claude Opus 5 API über EvoLink verfügbar?
Ja. Claude Opus 5 ist bei EvoLink unter der Modell-ID "claude-opus-5" als Produktionsroute verfügbar.
Welche Modell-ID sollte ich für die Claude Opus 5 API verwenden?
Senden Sie das Modell "claude-opus-5". Dieselbe ID funktioniert für den OpenAI-kompatiblen Chat-Completions-Endpunkt und den Anthropic-Messages-Endpunkt.
Was kostet die Claude Opus 5 API auf EvoLink?
Die EvoLink-Preise liegen 5 % unter dem offiziellen Tarif: 4,75 $ pro 1M Eingabe-Token und 23,75 $ pro 1M Ausgabe-Token gegenüber 5,00 $ und 25,00 $ bei Anthropic.
Wie wird das Prompt-Caching von Claude Opus 5 abgerechnet?
Cache-Schreiben und Cache-Lesen sind getrennte Dimensionen: 5,939 $ pro 1M Cache-Schreib-Token und 0,475 $ pro 1M Cache-Lese-Token auf EvoLink gegenüber offiziell 6,25 $ und 0,50 $.
Wie wird das Web-Search-Tool von Claude Opus 5 abgerechnet?
Die Websuche kostet 0,01 $ pro Suche – der offizielle Tarif ohne Rabatt. Token, die die Suchergebnisse der Anfrage hinzufügen, werden normal abgerechnet.
Welche Protokolle und SDKs funktionieren mit Claude Opus 5?
Nutzen Sie den OpenAI-kompatiblen Chat-Completions-Endpunkt oder den Anthropic-Messages-Endpunkt mit demselben EvoLink API-Schlüssel. Claude Code und andere Anthropic-native Clients funktionieren, indem Sie die Base-URL auf EvoLink zeigen lassen.
Welches Kontextfenster und welche maximale Ausgabe unterstützt Claude Opus 5?
Die EvoLink-Route verzeichnet ein Kontextfenster von 1.000.000 Token mit bis zu 128K Ausgabe-Token pro Antwort.
Ist Thinking bei Claude Opus 5 standardmäßig aktiviert?
Anthropic aktiviert adaptives Denken bei Opus 5 standardmäßig; in der Claude API ist effort standardmäßig high. Prüfen Sie in der API-Dokumentation und mit einer echten Anfrage, ob die benötigten Parameter über den gewählten EvoLink-Endpunkt durchgereicht werden.
Für welche Workloads eignet sich Claude Opus 5?
Claude Opus 5 eignet sich für besonders anspruchsvolle Coding-Aufgaben, lang laufende Agenten mit intensivem Tool-Einsatz und kritische Prüfungen, bei denen Fehler hohe Folgekosten verursachen.
Kann ich Claude Opus 5 zusammen mit anderen Modellrouten verwenden?
Ja. Mit demselben EvoLink-Client und API-Schlüssel können Sie schwierige Aufgaben an Claude Opus 5 und einfachere oder latenzkritische Anfragen an andere getestete Routen senden.
Was sollte eine produktive Bewertung von Claude Opus 5 messen?
Erfassen Sie Erfolg im ersten Versuch, akzeptierte Ergebnisse, Retries, Ausgabe-Token, Cache-Trefferquote, gültige Tool-Aufrufe, Zeit bis zum akzeptierten Ergebnis, menschliche Korrektur und Fallback-Rate – nicht nur den Token-Preis.