GPT Image 2.5 Flare & Sunburst sind jetzt auf EvoLink verfügbarGPT Image 2.5 testen

Claude Sonnet 5 API

Greifen Sie über die einheitliche Chat-API von EvoLink auf Claude Sonnet 5 von Anthropic zu – auch gesucht als Sonnet 5 / Claude 5 Sonnet –. Testen Sie Coding mit langem Kontext, Tool-Nutzung, Prompt-Caching vor der Integration.

AnthropicTextgenerierungVerfügbar
ab $1.800 / 1M Eingabe-Token$2.000 offizieller Preis-10%
API-Dokumentation
Adaptives ThinkingAgentisches CodingTool-NutzungPrompt-CachingChat + Messages API
ProduktionsrouteLive
Kontext
1M Kontext
Geeignet für
Agentisches Codieren, autonome Agents, Großkontext-Analyse
Eingabe
Text + Bilder
Ausgabe
Text · JSON (strukturierte Ausgabe) · Tool-Aufrufe

Claude Sonnet 5 auswählen

Anthropics vorheriges Sonnet für Coding und agentische Arbeit und ein Drop-in-Ersatz für Sonnet 4.6. Eingabe, Cache-Schreiben, Cache-Lesen, Ausgabe und das Web-Search-Tool werden als separate Abrechnungsdimensionen erfasst.

Claude Sonnet 5

Anthropic Sonnet-Modell für Coding und Agents

Ausgewählt
Modell-ID
claude-sonnet-5
Geeignet für

Alltägliches Produktions-Coding, Terminal- und Browser-Agents, langlaufende Tool-Nutzung und Analysen mit großem Kontext, bei denen ausgewogene Kosten wichtiger sind als eine Opus-Rate.

Eingabe
$1.800 / 1M-10%
122.4 cr / 1M$2.000offizieller Preis
Cache-Schreiben
$2.250 / 1M-10%
153 cr / 1M$2.500offizieller Preis
Cache-Lesen
$0.181 / 1M-10%
12.3 cr / 1M$0.200offizieller Preis
Ausgabe
$9.000 / 1M-10%
612 cr / 1M$10.000offizieller Preis

Alle Tarife gelten pro 1M Tokens, in USD und Credits, und entsprechen der aktuellen Preisgestaltung Ihres Kontos.

Claude Sonnet 5 Preise

Schätzen Sie vor der Integration die Kosten einer Claude Sonnet 5-Anfrage. Der Rechner verwendet die aktuellen Tarife Ihres Kontos; offizielle Preise dienen als Vergleich.

Anfragen-Rechner

Geben Sie den Token-Mix einer Anfrage und die Anzahl erfolgreicher Tool-Aufrufe ein.

Geschätzte Kosten pro Anfrage

Claude Sonnet 5
USD$0.0046
Credits0.3085

Offizielle Schätzung $0.0051 · $0.0006 gespart (10%)

Eingabe-Tokens0.1224 cr
Cache-Schreib-Tokens0 cr
Cache-Lese-Tokens0.0025 cr
Ausgabe-Tokens0.1836 cr

Mindestgebühr: 0.01 Credits pro Anfrage.

Budget-Leitfaden

Ungefähre Anfragen mit dem aktuellen Token-Mix.
Credits aufladen
$10
Etwa 2106 Anfragen

Für schnelle Tests

$50
Etwa 11021 Anfragen

Für die laufende Entwicklung

$100
Etwa 22042 Anfragen

Für die Produktionsbewertung

Tarife serverseitiger Tools

Nur erfolgreiche serverseitige Aufrufe werden pro Aufruf berechnet; fehlgeschlagene Versuche kosten keine Tool-Gebühr, Tokens werden weiterhin berechnet.
  • Websuche$0.010/ Aufruf0.68 cr / Aufruf

Claude Sonnet 5 API – Anthropics vorheriges Sonnet für Coding und Agents

Claude Sonnet 5 (Claude 5 Sonnet) liefert starke Coding- und agentische Performance über Terminals und Browser hinweg, mit einem 1M-Kontextfenster, bis zu 128K Output-Token und standardmäßig aktiviertem adaptivem Thinking.

Claude Sonnet 5 wird auf EvoLink unter der Modell-ID claude-sonnet-5 über Chat Completions · Anthropic Messages bereitgestellt – mit demselben API-Key und Guthaben wie jedes andere Modell. Es bietet ein Kontextfenster von 1M, dazu Coding mit langem Kontext, Tool-Nutzung, Prompt-Caching.

Claude Sonnet 5

Claude Sonnet 5 Spezifikationen und Fähigkeiten

Die Zahlen stammen aus der EvoLink-Routenkonfiguration; die Fähigkeiten entsprechen dem, was die API heute bereitstellt.

Kontextfenster
1M Tokens
Eingabe
Text + Bilder
Ausgabe
Text · JSON (strukturierte Ausgabe) · Tool-Aufrufe
Reasoning
Thinking-Modus (standardmäßig an)
Tool-Nutzung
Function Calling mit mehrstufigen Tool-Sequenzen
Prompt-Caching
Tarife für Cache-Schreiben + Cache-Lesen
Serverseitige Tools
Websuche, abgerechnet pro erfolgreichem Aufruf
Protokolle
Chat Completions · Anthropic Messages
Modell-ID
claude-sonnet-5

Was können Sie mit der Claude Sonnet 5 API bauen?

Agentischer Coding-Assistent

Sonnet 5 erzielt seine größten Zugewinne gegenüber Sonnet 4.6 beim Coding – es plant mehrstufige Änderungen, führt Terminals aus und iteriert über Ergebnisse. Mit bis zu 128K Output und einem 1M-Kontextfenster verarbeitet es große Codebasen und generiert umfassende Diffs, Test-Suites und Implementierungspläne in einem einzigen Request.

Autonome Agents

Bauen Sie Agents, die eine Abfolge von Schritten planen, Tools aufrufen, das Ergebnis lesen und weitermachen – ohne menschlichen Anstoß bei jedem Schritt. Sonnet 5 ist für Terminal- und Browser-Nutzung sowie Long-Horizon-Läufe gebaut und liefert zuverlässige Tool-Nutzung über mehrstufige Workflows hinweg.

Large-Context-Analyse

Lesen Sie sehr große Dokumente, Codebasen oder lange Agent-Traces in einem einzigen Request mit dem 1M-Kontextfenster und lassen Sie adaptives Thinking tieferes Reasoning nur dann anwenden, wenn eine Aufgabe es erfordert – so bleiben die Kosten für Research, Planung und technische Strategie vorhersehbar.

Zwei Wege, Claude Sonnet 5 zu nutzen: EvoLink API oder Agent

Nutzen Sie die EvoLink API für Produkt-Backends und Batch-Jobs oder rufen Sie Claude Sonnet 5 aus Codex, Claude oder Gemini für Coding- und Analyse-Workflows auf. Beide Wege teilen denselben EvoLink API-Key, das Guthaben, die Modell-ID und die Anfragehistorie.

Option 1

Mit der EvoLink API integrieren

Ideal für: Produkt-Backends, Batch-Jobs, automatisierte Pipelines

Senden Sie OpenAI-kompatible Chat-Completions- (oder Anthropic-Messages-) Anfragen an EvoLink und steuern Sie Modell-ID, System-Prompt, Ausgabebudget, Tools und strukturierte Ausgabe.

  1. 1Erstellen Sie einen EvoLink API-Key in der Konsole
  2. 2Richten Sie Ihr OpenAI- oder Anthropic-SDK auf die EvoLink-Basis-URL und wählen Sie die oben gezeigte Modell-ID
  3. 3Senden Sie eine repräsentative Anfrage und lesen Sie im Feld usage Eingabe-, Cache- und Ausgabe-Tokens ab
  4. 4Setzen Sie max_tokens und Wiederholungen pro Aufgabe; behalten Sie Tool-Call-IDs und -Ergebnisse über Runden hinweg
Option 2

Mit einem Agenten aufrufen

Ideal für: Coding-, Review- und Analyseaufgaben in Codex, Claude und Gemini

Geben Sie dem Agenten Aufgabe, Eingaben und Abnahmekriterien. Er baut die Anfrage, ruft Claude Sonnet 5 über EvoLink auf und liefert die Antwort samt Token-Verbrauch.

  1. 1Setzen Sie EVOLINK_API_KEY in Ihrer lokalen Umgebung; nie in Code oder Prompt
  2. 2Beschreiben Sie Aufgabe, einzubeziehende Eingaben und das erwartete Ausgabeformat
  3. 3Lassen Sie den Agenten Claude Sonnet 5 über EvoLink aufrufen und die Anfrage vor dem Senden zeigen
  4. 4Lassen Sie den Agenten Antwort, Token-Verbrauch und etwaige Fehlermeldungen berichten

Claude Sonnet 5 API-Codebeispiel und Fehlerbehandlung

Dieses Beispiel zeigt die kürzeste lauffähige Anfrage: ein OpenAI-kompatibler Chat-Completions-Aufruf mit System-Prompt, Nutzernachricht und Ausgabebudget. Die vollständige Parameter- und Antwortreferenz finden Sie im API-Tab.

Vollständige API-Doku ansehen
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [
      { "role": "system", "content": "You are a senior engineer. Produce clean, well-tested code." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 8192
  }'

# Anthropic Messages API is also available at /v1/messages with the same model ID.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).

Ungültige Anfrage oder nicht unterstützter Parameter

Prüfen Sie Modell-ID, messages-Array und Parameterbereiche anhand der API-Referenz; entfernen Sie Felder, die diese Route nicht unterstützt.

Authentifizierungs- oder Guthabenproblem

Prüfen Sie das Authorization-Bearer-Token und bestätigen Sie das verfügbare Guthaben in der Konsole.

Kontextlänge überschritten

Die Prompt-Tokens übersteigen das Kontextfenster von Claude Sonnet 5. Kürzen Sie oder rufen Sie nur relevante Belege ab und nutzen Sie gecachte Präfixe wieder.

Ratenlimit (429)

Mit Backoff und Jitter erneut versuchen; Anfragen bündeln oder in eine Warteschlange stellen statt parallel zu senden.

Inhalt oder Tool-Aufruf abgelehnt

Prüfen Sie sensible Inhalte, fehlerhafte Tool-Call-Argumente und JSON-Schema-Abweichungen vor dem erneuten Versuch.

So integrieren Sie die Claude Sonnet 5 API

Verbinden Sie sich über EvoLink, wählen Sie Ihre Model-ID und starten Sie in Minuten.

1

Schritt 1 — EvoLink API-Key erstellen

Registrieren Sie sich bei EvoLink, um einen einzigen API-Key zu erhalten, der zu Anthropic, Bedrock oder Google Cloud routet.

2

Schritt 2 — Model-ID auswählen

Nutzen Sie `claude-sonnet-5`, um das Sonnet 5 Modell über EvoLinks einheitliche API zu nutzen. Es ist ein Drop-in-Ersatz für `claude-sonnet-4-6`.

3

Schritt 3 — Qualität und Kosten optimieren

Adaptives Thinking ist standardmäßig aktiviert und kann mit dem effort-Parameter angepasst werden; nutzen Sie Prompt Caching für stabile System-Prompts und wiederholten langen Kontext, um Wiederholungskosten zu senken.

Prompt-Caching als zwei separate Dimensionen abgerechnet

Cache-Schreiben und Cache-Lesen werden separat erfasst, Cache-Hits mit 0,1x der Basis-Eingaberate abgerechnet. Stabile System-Prompts, Repository-Anweisungen und Tool-Schemas zahlen das Schreiben einmal und lesen danach über einen langen Agent-Lauf hinweg günstig.

1M-Token-Kontext mit 128K Max Output

1M ist sowohl Standard als auch Maximum, ohne kleinere Variante. Halten Sie zusammenhängenden Code, Spezifikationen und Agent-State in einem Arbeitskontext, betrachten Sie das Limit aber als Kapazität statt als Ziel: relevante Belege abrufen, stabiles Prefix cachen und aufgabengerechte Output-Budgets setzen.

Adaptives Thinking ist standardmäßig aktiv und ersetzt manuelle Budgets

Sonnet 5 skaliert das Reasoning automatisch mit der Aufgabenschwierigkeit. `budget_tokens` für manuelles Extended Thinking gibt einen 400-Fehler zurück – steuern Sie die Tiefe über den effort-Parameter oder deaktivieren Sie es mit `thinking: {type: "disabled"}`. Auch nicht-standardmäßige `temperature`, `top_p` und `top_k` geben einen 400-Fehler zurück und müssen bei der Migration entfernt werden.

Token vor der Umstellung von Produktions-Traffic neu zählen

Sonnet 5 nutzt einen neuen Tokenizer, der für denselben Text rund 30 % mehr Token erzeugt. Der Preis pro Token bleibt unverändert, abgerechnete Kosten und Kontextkapazität einer äquivalenten Anfrage können jedoch abweichen – zählen Sie Prompts neu, prüfen Sie `max_tokens`-Limits nahe der erwarteten Ausgabe und vergleichen Sie Erfolgsrate und Gesamtkosten an Produktionsstichproben.

Claude Sonnet 5 API Fähigkeiten

Wichtige Spezifikationen und Modellfeatures für den Produktionseinsatz

1M Kontextfenster

Lesen Sie sehr große Dokumente oder Codebasen in einem einzigen Request. 1M ist sowohl der Default als auch der maximale Kontext.

128K Max Output

Generieren Sie Long-Form-Antworten, Pläne und Code ohne frühe Kürzung.

Adaptives Thinking

Das Reasoning skaliert automatisch zur Aufgabenschwierigkeit, standardmäßig aktiviert – stellen Sie es mit dem effort-Parameter statt mit manuellen Thinking-Budgets ein.

Agentisches Coding & Tool-Nutzung

Gebaut für Terminal- und Browser-Agents, zuverlässiges Function Calling und Long-Horizon-Multi-Step-Läufe.

Vision + Multilingual Input

Akzeptiert Text- und Bildinputs mit starker multilingualer Verständigung.

Prompt-Caching-Raten

Cache-Writes und -Reads werden separat bepreist; Cache-Hits werden mit 0.1x des Basis-Input-Preises abgerechnet.

Claude-Routen nach Workload-Tests vergleichen

EvoLink

Prüfen Sie zuerst an Ihren eigenen Aufgaben, ob Sonnet 5 die Qualitätsanforderung bereits erfüllt. Vergleichen Sie dann Preis, Kontext, Caching und Workload-Eignung, um die Produktionsroute zu wählen.

Claude Sonnet 5
Eingabe / Ausgabe$1.8 / $9
Kontext1M
CachingLesen + Schreiben
Geeignet fürAlltägliches Produktions-Coding, Terminal- und Browser-Agents, langlaufende Tool-Nutzung und Analysen mit großem Kontext, bei denen ausgewogene Kosten wichtiger sind als eine Opus-Rate.
Claude Sonnet 4.6
Eingabe / Ausgabe$2.7 / $13.5
Kontext1M
CachingLesen + Schreiben
Geeignet fürDie vorherige Sonnet-Generation, für bereits dagegen validierte Workloads und kostensensitiven Traffic.
Claude Opus 5
Eingabe / Ausgabe$4.75 / $23.75
Kontext1M
CachingLesen + Schreiben
Geeignet fürDas Opus-Flaggschiff für die schwierigsten Reasoning-, Review- und Agent-Aufgaben, bei denen Qualität wichtiger ist als Kosten.

Claude-Modellfamilie

Gleicher API-Key, gleiches Guthaben – Stufe wechseln, ohne die Integration zu ändern.

Alle Claude-Modelle vergleichen
Claude Sonnet API (Sonnet 5.5)

Claude Sonnet API (Sonnet 5.5)

Das neuere Sonnet zum gleichen offiziellen Listenpreis; testen Sie Ihre Workload darauf neu, bevor Sie Traffic von Sonnet 5 verlagern.

Modell ansehen
Claude Opus 5.5

Claude Opus 5.5

Anthropics neuestes Opus für das anspruchsvollste langlaufende Coding, Wissensarbeit und visuelle Analyse.

Modell ansehen
Claude Fable 5.1

Claude Fable 5.1

Eine leistungsfähigere Claude-Route über Opus für die längsten und anspruchsvollsten Agent-Workloads.

Modell ansehen

Weitere Textmodelle auf EvoLink neben Claude Sonnet 5

GPT-5.6

GPT-5.6

OpenAIs gestufte Frontier-Familie für Routing über Fähigkeit, Latenz und Kosten.

Modell ansehen
Grok 4.5

Grok 4.5

xAIs Reasoning- und Tool-Use-Route mit 500K-Kontextfenster und serverseitigen Suchtools.

Modell ansehen
Kimi K3

Kimi K3

Ein Long-Context-Reasoning-Modell für Coding auf Repository-Ebene und Multi-Dokument-Arbeit.

Modell ansehen
Gemini 3.6 Flash

Gemini 3.6 Flash

Eine schnelle, günstige Route für hohen Traffic, der kein Opus-Urteilsvermögen benötigt.

Modell ansehen

Claude Sonnet 5 API – FAQ

Wie groß sind Kontextfenster und Max-Output bei Claude Sonnet 5?

Claude Sonnet 5 unterstützt ein 1M-Token-Kontextfenster – sowohl Default als auch Maximum, ohne kleinere Variante – und bis zu 128K Output-Token in einem einzigen Request, was es für große Codebasen, lange Dokumente und umfassende Generierungsaufgaben geeignet macht.

Welche Model-ID sollte ich nutzen und wie greife ich über EvoLink darauf zu?

Nutzen Sie `claude-sonnet-5` über EvoLinks einheitliche, OpenAI-kompatible API, um mit einem einzigen API-Key auf das Sonnet 5 Modell zuzugreifen. Es ist ein Drop-in-Ersatz für `claude-sonnet-4-6` – aktualisieren Sie die Model-ID und prüfen Sie bei Bedarf Token-Budgets und Thinking-Einstellungen.

Wie handhabt Claude Sonnet 5 Extended Thinking?

Sonnet 5 nutzt adaptives Thinking, standardmäßig aktiviert, das das Reasoning zur Aufgabenschwierigkeit skaliert. Manuelles Extended Thinking (Setzen von `budget_tokens`) wird nicht mehr unterstützt und gibt einen 400-Fehler zurück – nutzen Sie stattdessen den effort-Parameter, um die Reasoning-Tiefe zu steuern. Um Thinking auszuschalten, übergeben Sie `thinking: {type: "disabled"}`.

Was ändert sich bei der Migration von Sonnet 4.6 zu Sonnet 5?

Sonnet 5 ist ein Drop-in-Ersatz, beachten Sie aber drei Dinge: adaptives Thinking ist standardmäßig aktiviert, manuelles Extended Thinking gibt einen 400-Fehler zurück, und nicht-standardmäßige Sampling-Parameter (`temperature`, `top_p`, `top_k`) geben einen 400-Fehler zurück – entfernen Sie diese bei der Migration. Tool-Definitionen und Response-Formen bleiben unverändert.

Warum ändern sich meine Token-Zahlen bei Claude Sonnet 5?

Sonnet 5 nutzt einen neuen Tokenizer, der für denselben Text rund 30% mehr Token erzeugt. Der Preis pro Token bleibt unverändert, aber Kosten und Kontextkapazität eines äquivalenten Requests können abweichen – zählen Sie Ihre Prompts neu und überprüfen Sie `max_tokens`-Limits, die eng an Ihrem erwarteten Output bemessen sind.

Wie ist Claude Sonnet 5 bepreist?

EvoLink-Preise: $1.800 pro 1M Input-Token und $9.000 pro 1M Output-Token, gegenüber Anthropics $2.000 und $10.000. Prompt Caching wird separat abgerechnet – $2.250 pro 1M Cache-Write-Token und $0.181 pro 1M Cache-Read-Token bei EvoLink, gegenüber $2.500 und $0.200 offiziell.

Wie wird das Web-Search-Tool von Claude Sonnet 5 abgerechnet?

Die Websuche wird pro Suche mit $0.010 berechnet. Token, die die Suchergebnisse der Anfrage hinzufügen, werden normal abgerechnet.

Wie vergleicht sich Sonnet 5 mit Opus 4.8?

Sonnet 5 liefert Opus-Klasse-Coding und agentische Performance und ist der richtige Default für die meisten Produktions-Workloads. Opus 4.8 ist das Flaggschiff für die schwersten Reasoning- und Agent-Tasks, bei denen Top-Qualität am wichtigsten ist.

Wo ist Claude Sonnet 5 verfügbar?

Claude Sonnet 5 ist über die Anthropic API, AWS Bedrock, Google Cloud (Vertex AI) und Microsoft Foundry (Preview) verfügbar. EvoLink kann zum gewünschten Provider routen.

Unterstützt Claude Sonnet 5 Vision und multimodalen Input?

Ja. Sonnet 5 unterstützt Text- und Bildinput mit starken multilingualen Fähigkeiten, sodass Sie Dokumente, Screenshots und Visuals in einem Request kombinieren können.