Greifen Sie über die einheitliche Chat-API von EvoLink auf Claude Haiku 5.5 von Anthropic zu – auch gesucht als Haiku 5.5 –. Testen Sie Tool-Nutzung, strukturierte Ausgabe, Prompt-Caching vor der Integration.
Anthropic·Textgenerierung·Verfügbar
ab $0.096 / 1M Eingabe-Token$0.100 offizieller Preis-4%
Adaptives DenkenEffort-SteuerungTool-NutzungStrukturierte AusgabePrompt-CachingChat + Messages API
ProduktionsrouteDiese Rate zeigt die plattformseitige Verfügbarkeit — nur bestätigte Serverfehler (HTTP 500 / leere Antwort) zählen als Ausfälle. Nutzerseitige Probleme (Inhaltsmoderation, ungültige Parameter, Abbruch) sowie Rate-Limits, Timeouts und Auth-Fehler sind ausgenommen. Vor echtem Traffic können leere Zeitfenster als verfügbar erscheinen.Live
Live
Kontext
1M Kontext · max. 128K Ausgabe
Geeignet für
Klassifizierung und Extraktion in hohem Volumen, Routing, Sub-Agent-Aufgaben
Eingabe
Text + Bilder
Ausgabe
Text · JSON (strukturierte Ausgabe) · Tool-Aufrufe
Anthropics neuestes Haiku-Modell für Klassifizierung, Extraktion, Routing und Sub-Agent-Arbeit mit hohem Volumen. Die Prompt-Länge bestimmt, welcher von zwei Tarifen gilt, und fünf Abrechnungsdimensionen — Eingabe, Cache-Schreiben, Cache-Lesen, Ausgabe und das Web-Search-Tool — werden getrennt gemessen.
Claude Haiku 5.5
Anthropics neuestes Haiku-Modell
Ausgewählt
Modell-ID
claude-haiku-5-5
Geeignet für
Klassifizierung von Tickets und Absichten, Feldextraktion in JSON, Routing von Anfragen und Sub-Agent-Schritte unter einem größeren Modell — latenzkritische Arbeit mit hohem Volumen, bei der eine Route zum Haiku-Preis die Aufgabe erledigen sollte, ohne zu Sonnet eskalieren zu müssen.
≤ 100K
Eingabe
$0.096 / 1M-4%
6.5 cr / 1M$0.100offizieller Preis
Cache-Schreiben
$0.120 / 1M-5%
8.1 cr / 1M$0.125offizieller Preis
Cache-Lesen
$0.011 / 1M
0.7 cr / 1M
Ausgabe
$0.475 / 1M-5%
32.3 cr / 1M$0.500offizieller Preis
> 100K
Eingabe
$0.478 / 1M-4%
32.5 cr / 1M$0.500offizieller Preis
Cache-Schreiben
$0.596 / 1M-5%
40.5 cr / 1M$0.625offizieller Preis
Cache-Lesen
$0.052 / 1M
3.5 cr / 1M
Ausgabe
$2.375 / 1M-5%
161.5 cr / 1M$2.500offizieller Preis
Alle Tarife gelten pro 1M Tokens, in USD und Credits, und entsprechen der aktuellen Preisgestaltung Ihres Kontos. Ab 100K Prompt-Tokens gilt die Langkontext-Stufe (×5) für jede Token-Rolle.
Claude Haiku 5.5 Preise
Schätzen Sie vor der Integration die Kosten einer Claude Haiku 5.5-Anfrage. Der Rechner verwendet die aktuellen Tarife Ihres Kontos; offizielle Preise dienen als Vergleich.
Anfragen-Rechner
Geben Sie den Token-Mix einer Anfrage und die Anzahl erfolgreicher Tool-Aufrufe ein.
Die Websuche hängt von der gewählten Route ab und ist auf manchen Routen nicht verfügbar. Prüfen Sie die Unterstützung vor dem Senden von web_search; die folgenden Preise gelten nur dort, wo sie unterstützt wird.
Websuche$0.010/ Aufruf·0.68 cr / Aufruf
Claude Haiku 5.5 API
Nutzen Sie die Claude Haiku 5.5 API über das einheitliche Gateway von EvoLink. Führen Sie Klassifizierung, Extraktion, Routing und Sub-Agent-Aufrufe mit hohem Volumen über EvoLinks einheitliche API aus, mit einem Kontextfenster von 1M Token und bis zu 128K Ausgabe-Token. Vergleichen Sie $0.096 für Eingaben und $0.475 für Ausgaben je Million Token bei Prompts bis 100K Token. Nutzen Sie einen API-Schlüssel für mehrere Modelle und prüfen Sie vor der ersten Anfrage die Einstellungen für thinking und max_tokens.
Claude Haiku 5.5 wird auf EvoLink unter der Modell-ID claude-haiku-5-5 über Chat Completions · Anthropic Messages bereitgestellt – mit demselben API-Key und Guthaben wie jedes andere Modell. Es bietet ein Kontextfenster von 1M und bis zu 128K Ausgabe-Tokens, dazu Tool-Nutzung, strukturierte Ausgabe, Prompt-Caching.
Claude Haiku 5.5 Spezifikationen und Fähigkeiten
Die Zahlen stammen aus der EvoLink-Routenkonfiguration; die Fähigkeiten entsprechen dem, was die API heute bereitstellt.
Kontextfenster
1M Tokens
Max. Ausgabe
128K Tokens
Eingabe
Text + Bilder
Ausgabe
Text · JSON (strukturierte Ausgabe) · Tool-Aufrufe
Reasoning
Thinking-Modus (standardmäßig an)
Tool-Nutzung
Function Calling mit mehrstufigen Tool-Sequenzen
Prompt-Caching
Tarife für Cache-Schreiben + Cache-Lesen
Langkontext-Stufe
×5 ab 100K Prompt-Tokens
Protokolle
Chat Completions · Anthropic Messages
Modell-ID
claude-haiku-5-5
Wann Claude Haiku 5.5 die richtige Standardroute ist
Haiku 5.5 ist Anthropics schnelles, kostengünstiges Claude-Modell für Arbeit mit hohem Volumen und latenzkritische Aufgaben. Wählen Sie die Route nach den Kosten einer erledigten Aufgabe und justieren Sie Effort, bevor Sie den Prompt anfassen.
Klassifizierung, Routing und Extraktion mit hohem Volumen
Tickets kennzeichnen, Absichten erkennen, Anfragen routen und Felder aus Dokumenten in JSON überführen. Halten Sie jeden Prompt kompakt und begrenzen Sie die Antwort mit strukturierter Ausgabe oder einem Tool mit Enum-Werten, damit die Antwort kurz bleibt und die Anfrage im Basistarif bleibt.
Sub-Agents unter einem größeren Modell
Lassen Sie Suche, das Lesen von Dateien und andere eng umrissene Schritte auf Haiku 5.5 laufen, während ein Opus- oder Sonnet-Modell die Aufgabe plant. Anthropic beschreibt Haiku 5.5 als deutlich besser als Haiku 4.5 beim Befolgen von Anweisungen und im Einsatz als Sub-Agent. Messen Sie abgeschlossene Schritte, nicht einzelne Antworten.
Chat- und Support-Assistenten mit niedriger Latenz
Routinefragen beantworten und mit einem kurzen System-Prompt eine kleine Auswahl an Tools aufrufen. Starten Sie für Chat und kurze Tool-Aufgaben mit Effort low und erhöhen Sie die Stufe dort, wo der Assistent über ein langes Gespräch hinweg strenge Regeln einhalten muss.
Wann eine andere Route besser passt
Coding über mehrere Dateien, langlaufende Agents und Texte auf Analystenniveau gehören zu Claude Sonnet 5.5; Claude Opus 5.5 ist die Stufe darüber. Bleiben Sie bei Claude Haiku 4.5, wo ein Workload von Sampling-Parametern, einem Thinking-Budget oder Assistant-Prefill abhängt und noch nicht neu getestet wurde.
Zwei Wege, Claude Haiku 5.5 zu nutzen: EvoLink API oder Agent
Nutzen Sie die EvoLink API für Produkt-Backends und Batch-Jobs oder rufen Sie Claude Haiku 5.5 aus Codex, Claude oder Gemini für Coding- und Analyse-Workflows auf. Beide Wege teilen denselben EvoLink API-Key, das Guthaben, die Modell-ID und die Anfragehistorie.
Senden Sie OpenAI-kompatible Chat-Completions- (oder Anthropic-Messages-) Anfragen an EvoLink und steuern Sie Modell-ID, System-Prompt, Ausgabebudget, Tools und strukturierte Ausgabe.
1Erstellen Sie einen EvoLink API-Key in der Konsole
2Richten Sie Ihr OpenAI- oder Anthropic-SDK auf die EvoLink-Basis-URL und wählen Sie die oben gezeigte Modell-ID
3Senden Sie eine repräsentative Anfrage und lesen Sie im Feld usage Eingabe-, Cache- und Ausgabe-Tokens ab
4Setzen Sie max_tokens und Wiederholungen pro Aufgabe; behalten Sie Tool-Call-IDs und -Ergebnisse über Runden hinweg
Ideal für: Coding-, Review- und Analyseaufgaben in Codex, Claude und Gemini
Geben Sie dem Agenten Aufgabe, Eingaben und Abnahmekriterien. Er baut die Anfrage, ruft Claude Haiku 5.5 über EvoLink auf und liefert die Antwort samt Token-Verbrauch.
1Setzen Sie EVOLINK_API_KEY in Ihrer lokalen Umgebung; nie in Code oder Prompt
2Beschreiben Sie Aufgabe, einzubeziehende Eingaben und das erwartete Ausgabeformat
3Lassen Sie den Agenten Claude Haiku 5.5 über EvoLink aufrufen und die Anfrage vor dem Senden zeigen
4Lassen Sie den Agenten Antwort, Token-Verbrauch und etwaige Fehlermeldungen berichten
Claude Haiku 5.5 API-Codebeispiel und Fehlerbehandlung
Dieses Beispiel zeigt die kürzeste lauffähige Anfrage: ein OpenAI-kompatibler Chat-Completions-Aufruf mit System-Prompt, Nutzernachricht und Ausgabebudget. Die vollständige Parameter- und Antwortreferenz finden Sie im API-Tab.
curl -X POST https://direct.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{ "role": "system", "content": "Classify each support ticket as billing, bug, or how-to. Reply with one word." },
{ "role": "user", "content": "I was charged twice for my subscription." }
],
"max_tokens": 4096
}'
# Thinking is on by default and counts toward max_tokens, so leave room for
# it. This Chat Completions request returns choices[0].message and usage
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).
# For the Anthropic Messages format at /v1/messages, follow the linked
# Claude reference; its request fields and response format are different.
Ungültige Anfrage oder nicht unterstützter Parameter
Prüfen Sie Modell-ID, messages-Array und Parameterbereiche anhand der API-Referenz; entfernen Sie Felder, die diese Route nicht unterstützt.
Authentifizierungs- oder Guthabenproblem
Prüfen Sie das Authorization-Bearer-Token und bestätigen Sie das verfügbare Guthaben in der Konsole.
Kontextlänge überschritten
Die Prompt-Tokens übersteigen das Kontextfenster von Claude Haiku 5.5. Kürzen Sie oder rufen Sie nur relevante Belege ab und nutzen Sie gecachte Präfixe wieder.
Ratenlimit (429)
Mit Backoff und Jitter erneut versuchen; Anfragen bündeln oder in eine Warteschlange stellen statt parallel zu senden.
Inhalt oder Tool-Aufruf abgelehnt
Prüfen Sie sensible Inhalte, fehlerhafte Tool-Call-Argumente und JSON-Schema-Abweichungen vor dem erneuten Versuch.
Integrationsprüfung für die Claude Haiku 5.5 API
Behalten Sie einen EvoLink-Client und einen API-Schlüssel. Die meisten Anfragen laufen unverändert weiter; die vier Schritte unten decken die Einstellungen ab, die sich anders verhalten als bei Claude Haiku 4.5.
01
Modell-ID umstellen
Richten Sie den Client auf EvoLink aus, behalten Sie denselben API-Schlüssel und wählen Sie claude-haiku-5-5. Sowohl der OpenAI-kompatible Chat-Completions-Endpunkt als auch der Anthropic-Messages-Endpunkt akzeptieren die ID.
Geringer Aufwand
02
Platz für das Denken lassen
Denken ist standardmäßig aktiv und zählt zu max_tokens; ein Limit, das für eine Ein-Wort-Antwort bemessen ist, kann daher aufgebraucht sein, bevor überhaupt Text geschrieben wird. Erhöhen Sie max_tokens oder senken Sie Effort, und lesen Sie Inhalte nach Blocktyp, denn eine Antwort kann mit einem thinking-Block beginnen.
Verhaltensänderung
03
Einstellungen entfernen, die nur für Haiku 4.5 gelten
Anthropic lehnt bei Haiku 5.5 Thinking-Budgets, vom Standard abweichende Sampling-Werte und Assistant-Prefill ab. EvoLink wandelt ein Thinking-Budget in adaptives Denken mit einer Effort-Stufe um und entfernt temperature, top_p und top_k; ersetzen Sie Prefill durch strukturierte Ausgabe oder eine Anweisung im System-Prompt.
Breaking Change
04
Die 100K-Prompt-Grenze im Blick behalten
Eingabe, Cache-Schreiben und Cache-Lesen bestimmen zusammen den Tarif. Kürzen Sie den Verlauf, rufen Sie weniger Kontext ab oder teilen Sie die Aufgabe auf, damit Anfragen mit hohem Volumen bei höchstens 100K Prompt-Token bleiben, und planen Sie den höheren Tarif für die Anfragen ein, die mehr Kontext brauchen.
Kostenkontrolle
Prompt-Caching für wiederkehrenden Kontext
Cachen Sie stabile System-Prompts, Tool-Schemata und Referenzdokumente, um sie über mehrere Anfragen hinweg wiederzuverwenden. Schreiben und Lesen werden separat berechnet. Anthropic hat die Mindestlänge cachebarer Prompts gegenüber Haiku 4.5 gesenkt, sodass sich jetzt auch kürzere Prompts cachen lassen. Gecachte Token zählen weiterhin zur Prompt-Länge, die den Tarif bestimmt.
1M Token Kontext mit Tarifwechsel bei 100K
Die Route verzeichnet ein Kontextfenster von 1M Token und bis zu 128K Ausgabe-Token. Für Prompts bis 100K Token — Eingabe, Cache-Schreiben und Cache-Lesen zusammen — gelten die Basispreise; oberhalb von 100K wird die gesamte Anfrage einschließlich der Ausgabe zum 5×-Preis abgerechnet. Denken zählt zu max_tokens, also lassen Sie Platz dafür.
Denken ist standardmäßig aktiv — gesteuert wird über Effort
Eine Anfrage, die thinking nicht setzt, läuft mit adaptivem Denken — mit Effort medium, sofern Sie keine Stufe wählen. Denken wird als Ausgabe abgerechnet, und sein Text wird weggelassen, sofern Sie keine Zusammenfassungen anfordern. thinking: disabled wird bei Effort high oder darunter weiterhin akzeptiert; Anthropic empfiehlt, stattdessen Effort zu senken.
Haiku-4.5-Parameter, die nicht mehr gelten
Anthropic lehnt bei Haiku 5.5 Thinking-Budgets, vom Standard abweichende Sampling-Werte und Assistant-Prefill ab. Zur Kompatibilität wandelt EvoLink ein Budget in adaptives Denken mit einer Effort-Stufe um und entfernt temperature, top_p und top_k. Erzwungene Tool-Auswahl wird akzeptiert, die Antwort beginnt dann aber mit dem Tool-Aufruf und ohne Denken.
Claude Haiku 5.5: zwei Tarife und fünf Abrechnungsdimensionen
Claude Haiku 5.5 rechnet nicht mit einem einzigen Mischpreis ab. Die Prompt-Länge bestimmt den Tarif, jede Dimension wird getrennt gemessen, und Denken wird als Ausgabe abgerechnet.
Eingabe- und Ausgabe-Token nach Prompt-Länge
Für Prompts bis 100K Token: $0.096 je 1M Eingabe-Token und $0.475 je 1M Ausgabe-Token bei EvoLink, gegenüber Anthropics $0.100 und $0.500. Oberhalb von 100K Prompt-Token wechselt die gesamte Anfrage in den höheren Tarif: $0.478 für Eingabe und $2.375 für Ausgabe. Denken wird als Ausgabe abgerechnet, auch wenn sein Text nicht zurückgegeben wird.
5-Minuten-Cache-Schreiben und Cache-Lesen
Das Speichern eines Präfixes für 5 Minuten kostet $0.120 je 1M Token, die Wiederverwendung $0.011 je 1M Token. Gecachte Token zählen weiterhin zur Prompt-Länge, die den Tarif bestimmt. EvoLink-Preise werden auf eine ganze Abrechnungseinheit aufgerundet, daher kann der Preis für Cache-Lesen leicht über dem offiziellen Listenpreis liegen; kalkulieren Sie Einsparungen mit den angezeigten Preisen.
Web-Search-Tool
Auf Routen mit web_search-Unterstützung kostet jede Suche $0.010 und wird durch den höheren Tarif nicht vervielfacht. Token aus Suchergebnissen werden als normale Eingabe abgerechnet. Prüfen Sie die Unterstützung vor der Integration; ein konfigurierter Preis bedeutet nicht, dass jede Route das Tool unterstützt.
Claude-Routen nach dem Workload-Test vergleichen
EvoLink
Prüfen Sie zuerst auf der geplanten Effort-Stufe, ob Haiku 5.5 bei Ihren eigenen Aufgaben die Qualität hält. Vergleichen Sie danach Preis, Kontext, Caching und Workload-Eignung, um die Produktionsroute zu wählen.
Klassifizierung von Tickets und Absichten, Feldextraktion in JSON, Routing von Anfragen und Sub-Agent-Schritte unter einem größeren Modell — latenzkritische Arbeit mit hohem Volumen, bei der eine Route zum Haiku-Preis die Aufgabe erledigen sollte, ohne zu Sonnet eskalieren zu müssen.
Das vorherige Haiku, bei jeder Prompt-Länge zu einem einzigen Preis abgerechnet; sinnvoll dort, wo ein Workload noch Sampling-Parameter oder ein Thinking-Budget braucht.
Anthropics neuestes Sonnet, die nächste Stufe für Coding über mehrere Dateien, toollastige Agents und Arbeit, die Haiku 5.5 nicht abschließt.
Claude Haiku 5.5
Eingabe / Ausgabe$0.096 / $0.475
Kontext1M
CachingLesen + Schreiben
Ideal fürKlassifizierung von Tickets und Absichten, Feldextraktion in JSON, Routing von Anfragen und Sub-Agent-Schritte unter einem größeren Modell — latenzkritische Arbeit mit hohem Volumen, bei der eine Route zum Haiku-Preis die Aufgabe erledigen sollte, ohne zu Sonnet eskalieren zu müssen.
Ideal fürDas vorherige Haiku, bei jeder Prompt-Länge zu einem einzigen Preis abgerechnet; sinnvoll dort, wo ein Workload noch Sampling-Parameter oder ein Thinking-Budget braucht.
Diese Seite behandelt Claude Haiku 5.5, auf EvoLink unter der Modell-ID "claude-haiku-5-5" verfügbar. Haiku bezeichnet eine Modellfamilie: Geben Sie im Request die genaue Version an, nicht "haiku" als Modell-ID. Claude Haiku 4.5 hat eine eigene Modellseite und eigene Preise.
Welche Modell-ID nutze ich für die Claude Haiku 5.5 API?
Senden Sie model "claude-haiku-5-5". Dieselbe ID funktioniert für den OpenAI-kompatiblen Chat-Completions-Endpunkt und den Anthropic-Messages-Endpunkt.
Was kostet die Claude Haiku 5.5 API bei EvoLink?
Für Prompts bis 100K Token berechnet EvoLink $0.096 je 1M Eingabe-Token und $0.475 je 1M Ausgabe-Token, gegenüber Anthropics $0.100 und $0.500. Oberhalb von 100K Prompt-Token betragen die Preise $0.478 und $2.375.
Wie funktioniert die Tarifgrenze bei 100K Token?
Die Prompt-Länge ergibt sich aus den Eingabe-Token plus den Token für Cache-Schreiben und Cache-Lesen. Bis einschließlich 100K gelten die Basispreise. Oberhalb von 100K wird die gesamte Anfrage zum 5×-Preis abgerechnet — Eingabe, Ausgabe, Cache-Schreiben und Cache-Lesen —, nicht nur die Token jenseits der Grenze. Websuch-Aufrufe werden nicht vervielfacht.
Ist Claude Haiku 5.5 günstiger als Claude Haiku 4.5?
Anthropic listet Haiku 5.5 für Prompts bis 100K Token zu einem Zehntel des Haiku-4.5-Preises und darüber zur Hälfte davon. Haiku 5.5 nutzt einen neueren Tokenizer, der für denselben Text rund 30 % mehr Token zählt, und Denken ist standardmäßig aktiv. Vergleichen Sie daher die Kosten einer erledigten Aufgabe auf Ihrem eigenen Workload, nicht nur den Preis pro Token.
Wie wird das Prompt-Caching von Claude Haiku 5.5 abgerechnet?
Im Basistarif kostet 5-Minuten-Cache-Schreiben bei EvoLink $0.120 je 1M Token, Cache-Lesen $0.011; Anthropic listet $0.125 und $0.010. Beide werden separat erfasst und oberhalb von 100K Prompt-Token zum 5×-Preis abgerechnet. Kalkulieren Sie Ihren Workload mit den angezeigten Preisen einschließlich Rundung.
Wie wird das Web-Search-Tool von Claude Haiku 5.5 abgerechnet?
Auf Routen mit web_search-Unterstützung kostet jede Suche $0.010. Token aus Suchergebnissen werden als normale Eingabe abgerechnet. Prüfen Sie die Unterstützung vor der Integration; ein konfigurierter Preis bedeutet nicht, dass jede Route das Tool unterstützt.
Kann ich das Denken bei Claude Haiku 5.5 abschalten?
Ja, bei Effort high oder darunter: Senden Sie thinking: disabled. Bei xhigh oder max lehnt Anthropic das ab; senken Sie dann die Effort-Stufe oder nutzen Sie adaptives Denken. Anthropic empfiehlt, Effort zu senken, statt das Denken abzuschalten, weil das Modell bei Effort low das Denken bei einfachen Anfragen überspringen kann.
Welche Effort-Stufe sollte ich bei Claude Haiku 5.5 nutzen?
Der Standard ist medium. Anthropic schlägt low für Chat, kurze Tool-Aufgaben und einfache Anfragen mit hohem Volumen vor, medium für die meiste Arbeit einschließlich agentischem Coding und high für Wissensarbeit und das strikte Befolgen von Anweisungen. Vergleichen Sie xhigh und max mit Claude Sonnet 5.5, bevor Sie sich darauf festlegen.
Was ändert sich beim Umstieg von Claude Haiku 4.5?
Ändern Sie die Modell-ID, ersetzen Sie Thinking-Budgets durch adaptives Denken mit einer Effort-Stufe, entfernen Sie temperature, top_p und top_k und ersetzen Sie Assistant-Prefill. Denken ist standardmäßig aktiv; lesen Sie Inhalte daher nach Blocktyp und überprüfen Sie kleine max_tokens-Werte. Der Tokenizer zählt für denselben Text mehr Token, der Kontext wächst auf 1M Token, die maximale Ausgabe auf 128K, und auf der Claude API erfordert computer use das computer toolset.
Warum endet eine kurze Klassifizierungsanfrage bei max_tokens ohne Text?
Denken zählt zu max_tokens. Ein Limit, das für eine Ein-Wort-Antwort bemessen ist, kann vom Denken aufgebraucht werden; die Antwort endet dann nach einem thinking-Block und vor jeglichem Text. Erhöhen Sie max_tokens, um Platz für das Denken zu lassen, oder senken Sie die Effort-Stufe.
Wie sieht eine Ablehnung durch Claude Haiku 5.5 aus?
Sicherheitsklassifikatoren können eine Anfrage ablehnen. Die Antwort ist eine normale Erfolgsantwort mit stop_reason "refusal" und einer Kategorie; prüfen Sie also stop_reason, bevor Sie den Inhalt lesen. Anthropic führt eine abgelehnte Haiku-5.5-Anfrage nicht erneut auf einem anderen Modell aus; behandeln Sie die Ablehnung in Ihrem Client und versuchen Sie es mit einem anderen Prompt.
Welche Protokolle und SDKs funktionieren mit Claude Haiku 5.5?
Nutzen Sie den OpenAI-kompatiblen Chat-Completions-Endpunkt oder den Anthropic-Messages-Endpunkt mit demselben EvoLink-API-Schlüssel. Claude Code und andere Anthropic-native Clients funktionieren, wenn die Base-URL auf EvoLink zeigt.
Gelten die Nutzungslimits des Claude-Code-Abos für die Claude Haiku 5.5 API auf EvoLink?
Claude-Abokontingente sind von der EvoLink-API-Abrechnung getrennt. Anfragen über EvoLink verbrauchen Ihr EvoLink-Guthaben zu den angezeigten Preisen; Konto- und Routenlimits gelten weiterhin. Konfigurieren Sie einen EvoLink-API-Schlüssel und den dokumentierten Endpunkt in einem kompatiblen Client.
Welches Kontextfenster und welche maximale Ausgabe unterstützt Claude Haiku 5.5?
Die EvoLink-Route verzeichnet ein Kontextfenster von 1.000.000 Token und bis zu 128K Ausgabe-Token pro Antwort. Denken zählt zu max_tokens, und Prompts über 100K Token werden im höheren Tarif abgerechnet.
Was sollte eine Produktionsbewertung von Claude Haiku 5.5 messen?
Erfassen Sie den Erfolg im ersten Durchlauf, gültige strukturierte Ausgaben, Wiederholungen, Modellanfragen pro Aufgabe, Ausgabe-Token auf der gewählten Effort-Stufe, die Cache-Trefferquote, den Anteil der Anfragen über 100K Prompt-Token, die Zeit bis zum akzeptierten Ergebnis und manuelle Korrekturen — nicht nur den Preis pro Token.