Greifen Sie über die einheitliche Chat-API von EvoLink auf Claude Sonnet 5 von Anthropic zu – auch gesucht als Sonnet 5 / Claude 5 Sonnet –. Testen Sie Coding mit langem Kontext, Tool-Nutzung, Prompt-Caching vor der Integration.
Anthropic·Textgenerierung·Verfügbar
ab $1.800 / 1M Eingabe-Token$2.000 offizieller Preis-10%
Adaptives ThinkingAgentisches CodingTool-NutzungPrompt-CachingChat + Messages API
ProduktionsrouteDiese Rate zeigt die plattformseitige Verfügbarkeit — nur bestätigte Serverfehler (HTTP 500 / leere Antwort) zählen als Ausfälle. Nutzerseitige Probleme (Inhaltsmoderation, ungültige Parameter, Abbruch) sowie Rate-Limits, Timeouts und Auth-Fehler sind ausgenommen. Vor echtem Traffic können leere Zeitfenster als verfügbar erscheinen.Live
Anthropics vorheriges Sonnet für Coding und agentische Arbeit und ein Drop-in-Ersatz für Sonnet 4.6. Eingabe, Cache-Schreiben, Cache-Lesen, Ausgabe und das Web-Search-Tool werden als separate Abrechnungsdimensionen erfasst.
Claude Sonnet 5
Anthropic Sonnet-Modell für Coding und Agents
Ausgewählt
Modell-ID
claude-sonnet-5
Geeignet für
Alltägliches Produktions-Coding, Terminal- und Browser-Agents, langlaufende Tool-Nutzung und Analysen mit großem Kontext, bei denen ausgewogene Kosten wichtiger sind als eine Opus-Rate.
Eingabe
$1.800 / 1M-10%
122.4 cr / 1M$2.000offizieller Preis
Cache-Schreiben
$2.250 / 1M-10%
153 cr / 1M$2.500offizieller Preis
Cache-Lesen
$0.181 / 1M-10%
12.3 cr / 1M$0.200offizieller Preis
Ausgabe
$9.000 / 1M-10%
612 cr / 1M$10.000offizieller Preis
Alle Tarife gelten pro 1M Tokens, in USD und Credits, und entsprechen der aktuellen Preisgestaltung Ihres Kontos.
Claude Sonnet 5 Preise
Schätzen Sie vor der Integration die Kosten einer Claude Sonnet 5-Anfrage. Der Rechner verwendet die aktuellen Tarife Ihres Kontos; offizielle Preise dienen als Vergleich.
Anfragen-Rechner
Geben Sie den Token-Mix einer Anfrage und die Anzahl erfolgreicher Tool-Aufrufe ein.
Nur erfolgreiche serverseitige Aufrufe werden pro Aufruf berechnet; fehlgeschlagene Versuche kosten keine Tool-Gebühr, Tokens werden weiterhin berechnet.
Websuche$0.010/ Aufruf·0.68 cr / Aufruf
Claude Sonnet 5 API – Anthropics vorheriges Sonnet für Coding und Agents
Claude Sonnet 5 (Claude 5 Sonnet) liefert starke Coding- und agentische Performance über Terminals und Browser hinweg, mit einem 1M-Kontextfenster, bis zu 128K Output-Token und standardmäßig aktiviertem adaptivem Thinking.
Claude Sonnet 5 wird auf EvoLink unter der Modell-ID claude-sonnet-5 über Chat Completions · Anthropic Messages bereitgestellt – mit demselben API-Key und Guthaben wie jedes andere Modell. Es bietet ein Kontextfenster von 1M, dazu Coding mit langem Kontext, Tool-Nutzung, Prompt-Caching.
Claude Sonnet 5 Spezifikationen und Fähigkeiten
Die Zahlen stammen aus der EvoLink-Routenkonfiguration; die Fähigkeiten entsprechen dem, was die API heute bereitstellt.
Kontextfenster
1M Tokens
Eingabe
Text + Bilder
Ausgabe
Text · JSON (strukturierte Ausgabe) · Tool-Aufrufe
Reasoning
Thinking-Modus (standardmäßig an)
Tool-Nutzung
Function Calling mit mehrstufigen Tool-Sequenzen
Prompt-Caching
Tarife für Cache-Schreiben + Cache-Lesen
Serverseitige Tools
Websuche, abgerechnet pro erfolgreichem Aufruf
Protokolle
Chat Completions · Anthropic Messages
Modell-ID
claude-sonnet-5
Was können Sie mit der Claude Sonnet 5 API bauen?
Agentischer Coding-Assistent
Sonnet 5 erzielt seine größten Zugewinne gegenüber Sonnet 4.6 beim Coding – es plant mehrstufige Änderungen, führt Terminals aus und iteriert über Ergebnisse. Mit bis zu 128K Output und einem 1M-Kontextfenster verarbeitet es große Codebasen und generiert umfassende Diffs, Test-Suites und Implementierungspläne in einem einzigen Request.
Autonome Agents
Bauen Sie Agents, die eine Abfolge von Schritten planen, Tools aufrufen, das Ergebnis lesen und weitermachen – ohne menschlichen Anstoß bei jedem Schritt. Sonnet 5 ist für Terminal- und Browser-Nutzung sowie Long-Horizon-Läufe gebaut und liefert zuverlässige Tool-Nutzung über mehrstufige Workflows hinweg.
Large-Context-Analyse
Lesen Sie sehr große Dokumente, Codebasen oder lange Agent-Traces in einem einzigen Request mit dem 1M-Kontextfenster und lassen Sie adaptives Thinking tieferes Reasoning nur dann anwenden, wenn eine Aufgabe es erfordert – so bleiben die Kosten für Research, Planung und technische Strategie vorhersehbar.
Zwei Wege, Claude Sonnet 5 zu nutzen: EvoLink API oder Agent
Nutzen Sie die EvoLink API für Produkt-Backends und Batch-Jobs oder rufen Sie Claude Sonnet 5 aus Codex, Claude oder Gemini für Coding- und Analyse-Workflows auf. Beide Wege teilen denselben EvoLink API-Key, das Guthaben, die Modell-ID und die Anfragehistorie.
Senden Sie OpenAI-kompatible Chat-Completions- (oder Anthropic-Messages-) Anfragen an EvoLink und steuern Sie Modell-ID, System-Prompt, Ausgabebudget, Tools und strukturierte Ausgabe.
1Erstellen Sie einen EvoLink API-Key in der Konsole
2Richten Sie Ihr OpenAI- oder Anthropic-SDK auf die EvoLink-Basis-URL und wählen Sie die oben gezeigte Modell-ID
3Senden Sie eine repräsentative Anfrage und lesen Sie im Feld usage Eingabe-, Cache- und Ausgabe-Tokens ab
4Setzen Sie max_tokens und Wiederholungen pro Aufgabe; behalten Sie Tool-Call-IDs und -Ergebnisse über Runden hinweg
Ideal für: Coding-, Review- und Analyseaufgaben in Codex, Claude und Gemini
Geben Sie dem Agenten Aufgabe, Eingaben und Abnahmekriterien. Er baut die Anfrage, ruft Claude Sonnet 5 über EvoLink auf und liefert die Antwort samt Token-Verbrauch.
1Setzen Sie EVOLINK_API_KEY in Ihrer lokalen Umgebung; nie in Code oder Prompt
2Beschreiben Sie Aufgabe, einzubeziehende Eingaben und das erwartete Ausgabeformat
3Lassen Sie den Agenten Claude Sonnet 5 über EvoLink aufrufen und die Anfrage vor dem Senden zeigen
4Lassen Sie den Agenten Antwort, Token-Verbrauch und etwaige Fehlermeldungen berichten
Claude Sonnet 5 API-Codebeispiel und Fehlerbehandlung
Dieses Beispiel zeigt die kürzeste lauffähige Anfrage: ein OpenAI-kompatibler Chat-Completions-Aufruf mit System-Prompt, Nutzernachricht und Ausgabebudget. Die vollständige Parameter- und Antwortreferenz finden Sie im API-Tab.
curl -X POST https://api.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [
{ "role": "system", "content": "You are a senior engineer. Produce clean, well-tested code." },
{ "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
],
"max_tokens": 8192
}'
# Anthropic Messages API is also available at /v1/messages with the same model ID.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).
Ungültige Anfrage oder nicht unterstützter Parameter
Prüfen Sie Modell-ID, messages-Array und Parameterbereiche anhand der API-Referenz; entfernen Sie Felder, die diese Route nicht unterstützt.
Authentifizierungs- oder Guthabenproblem
Prüfen Sie das Authorization-Bearer-Token und bestätigen Sie das verfügbare Guthaben in der Konsole.
Kontextlänge überschritten
Die Prompt-Tokens übersteigen das Kontextfenster von Claude Sonnet 5. Kürzen Sie oder rufen Sie nur relevante Belege ab und nutzen Sie gecachte Präfixe wieder.
Ratenlimit (429)
Mit Backoff und Jitter erneut versuchen; Anfragen bündeln oder in eine Warteschlange stellen statt parallel zu senden.
Inhalt oder Tool-Aufruf abgelehnt
Prüfen Sie sensible Inhalte, fehlerhafte Tool-Call-Argumente und JSON-Schema-Abweichungen vor dem erneuten Versuch.
So integrieren Sie die Claude Sonnet 5 API
Verbinden Sie sich über EvoLink, wählen Sie Ihre Model-ID und starten Sie in Minuten.
1
Schritt 1 — EvoLink API-Key erstellen
Registrieren Sie sich bei EvoLink, um einen einzigen API-Key zu erhalten, der zu Anthropic, Bedrock oder Google Cloud routet.
2
Schritt 2 — Model-ID auswählen
Nutzen Sie `claude-sonnet-5`, um das Sonnet 5 Modell über EvoLinks einheitliche API zu nutzen. Es ist ein Drop-in-Ersatz für `claude-sonnet-4-6`.
3
Schritt 3 — Qualität und Kosten optimieren
Adaptives Thinking ist standardmäßig aktiviert und kann mit dem effort-Parameter angepasst werden; nutzen Sie Prompt Caching für stabile System-Prompts und wiederholten langen Kontext, um Wiederholungskosten zu senken.
Prompt-Caching als zwei separate Dimensionen abgerechnet
Cache-Schreiben und Cache-Lesen werden separat erfasst, Cache-Hits mit 0,1x der Basis-Eingaberate abgerechnet. Stabile System-Prompts, Repository-Anweisungen und Tool-Schemas zahlen das Schreiben einmal und lesen danach über einen langen Agent-Lauf hinweg günstig.
1M-Token-Kontext mit 128K Max Output
1M ist sowohl Standard als auch Maximum, ohne kleinere Variante. Halten Sie zusammenhängenden Code, Spezifikationen und Agent-State in einem Arbeitskontext, betrachten Sie das Limit aber als Kapazität statt als Ziel: relevante Belege abrufen, stabiles Prefix cachen und aufgabengerechte Output-Budgets setzen.
Adaptives Thinking ist standardmäßig aktiv und ersetzt manuelle Budgets
Sonnet 5 skaliert das Reasoning automatisch mit der Aufgabenschwierigkeit. `budget_tokens` für manuelles Extended Thinking gibt einen 400-Fehler zurück – steuern Sie die Tiefe über den effort-Parameter oder deaktivieren Sie es mit `thinking: {type: "disabled"}`. Auch nicht-standardmäßige `temperature`, `top_p` und `top_k` geben einen 400-Fehler zurück und müssen bei der Migration entfernt werden.
Token vor der Umstellung von Produktions-Traffic neu zählen
Sonnet 5 nutzt einen neuen Tokenizer, der für denselben Text rund 30 % mehr Token erzeugt. Der Preis pro Token bleibt unverändert, abgerechnete Kosten und Kontextkapazität einer äquivalenten Anfrage können jedoch abweichen – zählen Sie Prompts neu, prüfen Sie `max_tokens`-Limits nahe der erwarteten Ausgabe und vergleichen Sie Erfolgsrate und Gesamtkosten an Produktionsstichproben.
Claude Sonnet 5 API Fähigkeiten
Wichtige Spezifikationen und Modellfeatures für den Produktionseinsatz
1M Kontextfenster
Lesen Sie sehr große Dokumente oder Codebasen in einem einzigen Request. 1M ist sowohl der Default als auch der maximale Kontext.
128K Max Output
Generieren Sie Long-Form-Antworten, Pläne und Code ohne frühe Kürzung.
Adaptives Thinking
Das Reasoning skaliert automatisch zur Aufgabenschwierigkeit, standardmäßig aktiviert – stellen Sie es mit dem effort-Parameter statt mit manuellen Thinking-Budgets ein.
Agentisches Coding & Tool-Nutzung
Gebaut für Terminal- und Browser-Agents, zuverlässiges Function Calling und Long-Horizon-Multi-Step-Läufe.
Vision + Multilingual Input
Akzeptiert Text- und Bildinputs mit starker multilingualer Verständigung.
Prompt-Caching-Raten
Cache-Writes und -Reads werden separat bepreist; Cache-Hits werden mit 0.1x des Basis-Input-Preises abgerechnet.
Claude-Routen nach Workload-Tests vergleichen
EvoLink
Prüfen Sie zuerst an Ihren eigenen Aufgaben, ob Sonnet 5 die Qualitätsanforderung bereits erfüllt. Vergleichen Sie dann Preis, Kontext, Caching und Workload-Eignung, um die Produktionsroute zu wählen.
Alltägliches Produktions-Coding, Terminal- und Browser-Agents, langlaufende Tool-Nutzung und Analysen mit großem Kontext, bei denen ausgewogene Kosten wichtiger sind als eine Opus-Rate.
Die vorherige Sonnet-Generation, für bereits dagegen validierte Workloads und kostensensitiven Traffic.
Das Opus-Flaggschiff für die schwierigsten Reasoning-, Review- und Agent-Aufgaben, bei denen Qualität wichtiger ist als Kosten.
Claude Sonnet 5
Eingabe / Ausgabe$1.8 / $9
Kontext1M
CachingLesen + Schreiben
Geeignet fürAlltägliches Produktions-Coding, Terminal- und Browser-Agents, langlaufende Tool-Nutzung und Analysen mit großem Kontext, bei denen ausgewogene Kosten wichtiger sind als eine Opus-Rate.
Wie groß sind Kontextfenster und Max-Output bei Claude Sonnet 5?
Claude Sonnet 5 unterstützt ein 1M-Token-Kontextfenster – sowohl Default als auch Maximum, ohne kleinere Variante – und bis zu 128K Output-Token in einem einzigen Request, was es für große Codebasen, lange Dokumente und umfassende Generierungsaufgaben geeignet macht.
Welche Model-ID sollte ich nutzen und wie greife ich über EvoLink darauf zu?
Nutzen Sie `claude-sonnet-5` über EvoLinks einheitliche, OpenAI-kompatible API, um mit einem einzigen API-Key auf das Sonnet 5 Modell zuzugreifen. Es ist ein Drop-in-Ersatz für `claude-sonnet-4-6` – aktualisieren Sie die Model-ID und prüfen Sie bei Bedarf Token-Budgets und Thinking-Einstellungen.
Wie handhabt Claude Sonnet 5 Extended Thinking?
Sonnet 5 nutzt adaptives Thinking, standardmäßig aktiviert, das das Reasoning zur Aufgabenschwierigkeit skaliert. Manuelles Extended Thinking (Setzen von `budget_tokens`) wird nicht mehr unterstützt und gibt einen 400-Fehler zurück – nutzen Sie stattdessen den effort-Parameter, um die Reasoning-Tiefe zu steuern. Um Thinking auszuschalten, übergeben Sie `thinking: {type: "disabled"}`.
Was ändert sich bei der Migration von Sonnet 4.6 zu Sonnet 5?
Sonnet 5 ist ein Drop-in-Ersatz, beachten Sie aber drei Dinge: adaptives Thinking ist standardmäßig aktiviert, manuelles Extended Thinking gibt einen 400-Fehler zurück, und nicht-standardmäßige Sampling-Parameter (`temperature`, `top_p`, `top_k`) geben einen 400-Fehler zurück – entfernen Sie diese bei der Migration. Tool-Definitionen und Response-Formen bleiben unverändert.
Warum ändern sich meine Token-Zahlen bei Claude Sonnet 5?
Sonnet 5 nutzt einen neuen Tokenizer, der für denselben Text rund 30% mehr Token erzeugt. Der Preis pro Token bleibt unverändert, aber Kosten und Kontextkapazität eines äquivalenten Requests können abweichen – zählen Sie Ihre Prompts neu und überprüfen Sie `max_tokens`-Limits, die eng an Ihrem erwarteten Output bemessen sind.
Wie ist Claude Sonnet 5 bepreist?
EvoLink-Preise: $1.800 pro 1M Input-Token und $9.000 pro 1M Output-Token, gegenüber Anthropics $2.000 und $10.000. Prompt Caching wird separat abgerechnet – $2.250 pro 1M Cache-Write-Token und $0.181 pro 1M Cache-Read-Token bei EvoLink, gegenüber $2.500 und $0.200 offiziell.
Wie wird das Web-Search-Tool von Claude Sonnet 5 abgerechnet?
Die Websuche wird pro Suche mit $0.010 berechnet. Token, die die Suchergebnisse der Anfrage hinzufügen, werden normal abgerechnet.
Wie vergleicht sich Sonnet 5 mit Opus 4.8?
Sonnet 5 liefert Opus-Klasse-Coding und agentische Performance und ist der richtige Default für die meisten Produktions-Workloads. Opus 4.8 ist das Flaggschiff für die schwersten Reasoning- und Agent-Tasks, bei denen Top-Qualität am wichtigsten ist.
Wo ist Claude Sonnet 5 verfügbar?
Claude Sonnet 5 ist über die Anthropic API, AWS Bedrock, Google Cloud (Vertex AI) und Microsoft Foundry (Preview) verfügbar. EvoLink kann zum gewünschten Provider routen.
Unterstützt Claude Sonnet 5 Vision und multimodalen Input?
Ja. Sonnet 5 unterstützt Text- und Bildinput mit starken multilingualen Fähigkeiten, sodass Sie Dokumente, Screenshots und Visuals in einem Request kombinieren können.