GPT Image 2.5 Flare & Sunburst sind jetzt auf EvoLink verfügbarGPT Image 2.5 testen

GPT-5.6 API

Greifen Sie über die einheitliche Chat-API von EvoLink auf GPT-5.6 von OpenAI zu – auch gesucht als GPT 5.6 / gpt-5.6-sol / terra / luna –. Testen Sie Reasoning, Tool-Nutzung, strukturierte Ausgabe vor der Integration.

OpenAITextgenerierungVerfügbar
ab $0.181 / 1M Input-Tokens$0.200 offizieller Preis-10%
API-Dokumentation
Chat CompletionsResponses APIReasoning-EffortPrompt-CachingTool-Nutzung
ProduktionsrouteLive
Kontext
1.05M Kontext · max. 128K Ausgabe
Geeignet für
Coding, Produktions-Agents, komplexes Reasoning
Eingabe
Text
Ausgabe
Text · JSON (strukturierte Ausgabe) · Tool-Aufrufe

GPT-5.6 auswählen

Alle drei Varianten nutzen dieselbe OpenAI-kompatible Integration. Wechseln Sie Leistung und Kosten mit einer exakten Modell-ID.

GPT-5.6 Sol

Flaggschiff-Stufe für maximale Reasoning-Tiefe und Agent-Fähigkeiten.

Ausgewählt
Modell-ID
gpt-5.6-sol
Geeignet für

Anspruchsvolles Reasoning, Coding-Agents und hochwertige Workflows

< 272K
Eingabe
$3.600 / 1M-10%
244.8 cr / 1M$4.000offizieller Preis
Cache-Lesen
$0.361 / 1M-10%
24.5 cr / 1M$0.400offizieller Preis
Cache-Schreiben
$4.500 / 1M-10%
306 cr / 1M$5.000offizieller Preis
Ausgabe
$18.000 / 1M-10%
1224 cr / 1M$20.000offizieller Preis
≥ 272K
Eingabe
$7.200 / 1M-10%
489.6 cr / 1M$8.000offizieller Preis
Cache-Lesen
$0.721 / 1M-10%
49 cr / 1M$0.800offizieller Preis
Cache-Schreiben
$9.000 / 1M-10%
612 cr / 1M$10.000offizieller Preis
Ausgabe
$27.000 / 1M-10%
1836 cr / 1M$30.000offizieller Preis

GPT-5.6 Terra

Ausgewogene Stufe für zuverlässiges Reasoning und Coding in der Produktion.

Modell-ID
gpt-5.6-terra
Geeignet für

Produktfunktionen, Analysen, Chat und alltägliche Agents

< 272K
Eingabe
$1.800 / 1M-10%
122.4 cr / 1M$2.000offizieller Preis
Cache-Lesen
$0.181 / 1M-10%
12.3 cr / 1M$0.200offizieller Preis
Cache-Schreiben
$2.250 / 1M-10%
153 cr / 1M$2.500offizieller Preis
Ausgabe
$10.800 / 1M-10%
734.4 cr / 1M$12.000offizieller Preis
≥ 272K
Eingabe
$3.600 / 1M-10%
244.8 cr / 1M$4.000offizieller Preis
Cache-Lesen
$0.362 / 1M-10%
24.6 cr / 1M$0.400offizieller Preis
Cache-Schreiben
$4.500 / 1M-10%
306 cr / 1M$5.000offizieller Preis
Ausgabe
$16.200 / 1M-10%
1101.6 cr / 1M$18.000offizieller Preis

GPT-5.6 Luna

Schnelle, kosteneffiziente Stufe für Anwendungen mit hohem Volumen.

Modell-ID
gpt-5.6-luna
Geeignet für

Latenzkritischer Chat, Extraktion und skalierte Automatisierung

< 272K
Eingabe
$0.181 / 1M-10%
12.3 cr / 1M$0.200offizieller Preis
Cache-Lesen
$0.020 / 1M-4%
1.3 cr / 1M$0.020offizieller Preis
Cache-Schreiben
$0.225 / 1M-10%
15.3 cr / 1M$0.250offizieller Preis
Ausgabe
$1.081 / 1M-10%
73.5 cr / 1M$1.200offizieller Preis
≥ 272K
Eingabe
$0.362 / 1M-10%
24.6 cr / 1M$0.400offizieller Preis
Cache-Lesen
$0.039 / 1M-4%
2.6 cr / 1M$0.040offizieller Preis
Cache-Schreiben
$0.450 / 1M-10%
30.6 cr / 1M$0.500offizieller Preis
Ausgabe
$1.622 / 1M-10%
110.25 cr / 1M$1.800offizieller Preis

Alle Tarife gelten pro 1M Tokens, in USD und Credits, und entsprechen der aktuellen Preisgestaltung Ihres Kontos. Ab 272K Prompt-Tokens gilt die Langkontext-Stufe: ×2 für Eingabe- und Cache-Rollen, ×1.5 für die Ausgabe.

GPT-5.6 Preise

Schätzen Sie vor der Integration die Kosten einer GPT-5.6-Anfrage. Der Rechner verwendet die aktuellen Tarife Ihres Kontos; offizielle Preise dienen als Vergleich.

Anfragen-Rechner

Geben Sie den Token-Mix einer Anfrage ein.

Geschätzte Kosten pro Anfrage

GPT-5.6 Sol
Kurzkontext-Tarif
USD$0.0091
Credits0.6169

Offizielle Schätzung $0.011 · $0.0011 gespart (10%)

Eingabe-Tokens0.2448 cr
Cache-Lese-Tokens0.0049 cr
Cache-Schreib-Tokens0 cr
Ausgabe-Tokens0.3672 cr

Mindestgebühr: 0.01 Credits pro Anfrage. Ab 272K Prompt-Tokens werden Eingabe- und Cache-Rollen mit ×2, die Ausgabe mit ×1.5 berechnet. Tool-Aufrufe werden nicht multipliziert.

Budget-Leitfaden

Ungefähre Anfragen mit dem aktuellen Token-Mix.
Credits aufladen
$10
Etwa 1053 Anfragen

Für schnelle Tests

$50
Etwa 5511 Anfragen

Für die laufende Entwicklung

$100
Etwa 11022 Anfragen

Für die Produktionsbewertung

GPT-5.6 API — Sol, Terra & Luna

Nutzen Sie alle drei GPT-5.6-Stufen mit einem EvoLink API-Key: Sol für maximale Leistung, Terra für ausgewogene Produktion und Luna für schnelle, kosteneffiziente Skalierung.

GPT-5.6 wird auf EvoLink unter der Modell-ID gpt-5.6-sol über Chat Completions · Responses bereitgestellt – mit demselben API-Key und Guthaben wie jedes andere Modell. Es bietet ein Kontextfenster von 1.05M und bis zu 128K Ausgabe-Tokens, dazu Reasoning, Tool-Nutzung, strukturierte Ausgabe.

GPT-5.6

GPT-5.6 Spezifikationen und Fähigkeiten

Die Zahlen stammen aus der EvoLink-Routenkonfiguration; die Fähigkeiten entsprechen dem, was die API heute bereitstellt.

Kontextfenster
1.05M Tokens
Max. Ausgabe
128K Tokens
Eingabe
Text
Ausgabe
Text · JSON (strukturierte Ausgabe) · Tool-Aufrufe
Tool-Nutzung
Function Calling mit mehrstufigen Tool-Sequenzen
Prompt-Caching
Tarife für Cache-Schreiben + Cache-Lesen
Langkontext-Stufe
×2 Eingabe / ×1.5 Ausgabe ab 272K Prompt-Tokens
Protokolle
Chat Completions · Responses
Modell-ID
gpt-5.6-sol

Wofür GPT-5.6 am besten geeignet ist

Stufe nach Workload wählen: Sol für Tiefe, Terra für den Produktionsalltag, Luna für Volumen.

Agentisches Coding und große Refactorings mit GPT-5.6 Sol

Änderungen über viele Dateien, Code-Reviews und tool-intensive Agent-Schleifen, bei denen sich Reasoning-Tiefe auszahlt.

Produktionsassistenten auf GPT-5.6 Terra

Kundenchat, Dokumenten-Q&A und strukturierte Extraktion mit ausgewogenem Preis-Leistungs-Verhältnis.

Klassifikation und Routing in großem Volumen mit GPT-5.6 Luna

Tagging, Triage und leichte Zusammenfassungen, bei denen die Token-Kosten dominieren.

Langkontext-Analyse bis 1M Token

Ganze Repositories oder Dokumentensätze laden und wiederholten Kontext per Prompt-Caching günstig halten.

Zwei Wege, GPT-5.6 zu nutzen: EvoLink API oder Agent

Nutzen Sie die EvoLink API für Produkt-Backends und Batch-Jobs oder rufen Sie GPT-5.6 aus Codex, Claude oder Gemini für Coding- und Analyse-Workflows auf. Beide Wege teilen denselben EvoLink API-Key, das Guthaben, die Modell-ID und die Anfragehistorie.

Option 1

Mit der EvoLink API integrieren

Ideal für: Produkt-Backends, Batch-Jobs, automatisierte Pipelines

Senden Sie OpenAI-kompatible Chat-Completions- (oder Anthropic-Messages-) Anfragen an EvoLink und steuern Sie Modell-ID, System-Prompt, Ausgabebudget, Tools und strukturierte Ausgabe.

  1. 1Erstellen Sie einen EvoLink API-Key in der Konsole
  2. 2Richten Sie Ihr OpenAI- oder Anthropic-SDK auf die EvoLink-Basis-URL und wählen Sie die oben gezeigte Modell-ID
  3. 3Senden Sie eine repräsentative Anfrage und lesen Sie im Feld usage Eingabe-, Cache- und Ausgabe-Tokens ab
  4. 4Setzen Sie max_tokens und Wiederholungen pro Aufgabe; behalten Sie Tool-Call-IDs und -Ergebnisse über Runden hinweg
Option 2

Mit einem Agenten aufrufen

Ideal für: Coding-, Review- und Analyseaufgaben in Codex, Claude und Gemini

Geben Sie dem Agenten Aufgabe, Eingaben und Abnahmekriterien. Er baut die Anfrage, ruft GPT-5.6 über EvoLink auf und liefert die Antwort samt Token-Verbrauch.

  1. 1Setzen Sie EVOLINK_API_KEY in Ihrer lokalen Umgebung; nie in Code oder Prompt
  2. 2Beschreiben Sie Aufgabe, einzubeziehende Eingaben und das erwartete Ausgabeformat
  3. 3Lassen Sie den Agenten GPT-5.6 über EvoLink aufrufen und die Anfrage vor dem Senden zeigen
  4. 4Lassen Sie den Agenten Antwort, Token-Verbrauch und etwaige Fehlermeldungen berichten

GPT-5.6 API-Codebeispiel und Fehlerbehandlung

Dieses Beispiel zeigt die kürzeste lauffähige Anfrage: ein OpenAI-kompatibler Chat-Completions-Aufruf mit System-Prompt, Nutzernachricht und Ausgabebudget. Die vollständige Parameter- und Antwortreferenz finden Sie im API-Tab.

Vollständige API-Doku ansehen
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Swap the model ID for gpt-5.6-terra or gpt-5.6-luna to change the tier.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cached tokens when a prefix is
# reused).

Ungültige Anfrage oder nicht unterstützter Parameter

Prüfen Sie Modell-ID, messages-Array und Parameterbereiche anhand der API-Referenz; entfernen Sie Felder, die diese Route nicht unterstützt.

Authentifizierungs- oder Guthabenproblem

Prüfen Sie das Authorization-Bearer-Token und bestätigen Sie das verfügbare Guthaben in der Konsole.

Kontextlänge überschritten

Die Prompt-Tokens übersteigen das Kontextfenster von GPT-5.6. Kürzen Sie oder rufen Sie nur relevante Belege ab und nutzen Sie gecachte Präfixe wieder.

Ratenlimit (429)

Mit Backoff und Jitter erneut versuchen; Anfragen bündeln oder in eine Warteschlange stellen statt parallel zu senden.

Inhalt oder Tool-Aufruf abgelehnt

Prüfen Sie sensible Inhalte, fehlerhafte Tool-Call-Argumente und JSON-Schema-Abweichungen vor dem erneuten Versuch.

Bevor Sie GPT-5.6 produktiv einsetzen

Vier Prüfungen, die Kosten und Stabilität entscheiden.

01

Die exakte GPT-5.6-Modell-ID wählen

Verwenden Sie gpt-5.6-sol, gpt-5.6-terra oder gpt-5.6-luna; einen generischen Alias gpt-5.6 gibt es nicht.

Erforderlich
02

Die 272K-Langkontext-Schwelle einplanen

Über 272K Prompt-Token wird der gesamte Request zum Langkontext-Tarif berechnet; bleiben Sie darunter, wenn möglich.

Empfohlen
03

Prompts für Cache-Lesezugriffe strukturieren

Stabile Anweisungen und Referenzmaterial zuerst, damit Cache-Reads bei Wiederholungen den vollen Eingabepreis ersetzen.

Empfohlen
04

Mit usage messen, nicht mit dem Listenpreis

Kosten vor der Skalierung über das usage-Objekt abgleichen (ungecachte Eingabe, Cache-Read, Cache-Write, Ausgabe).

Erforderlich

Vierteiliges Prompt-Caching

Ungecachter Input, Cache-Lesen, Cache-Schreiben und Output werden anhand des finalen Usage-Objekts separat abgerechnet. Cache-Schreibvorgänge werden nicht erneut als normaler Input berechnet.

Langkontext-Schwelle

Ab mehr als 272K Prompt-Tokens gelten für Input und beide Cache-Rollen 2x-Preise und für Output 1.5x-Preise – jeweils für den gesamten Request.

GPT-5.6 vs. andere Textmodelle

EvoLink

Vergleichen Sie die gewählte GPT-5.6-Stufe mit vergleichbaren Frontier-Textmodellen anhand der EvoLink-Preise pro 1M Tokens.

GPT-5.6 Sol
EvoLink-Preis / 1M (Input / Output)$3.6 / $18
Kontextfenster1.05M
Prompt-CachingCache-Lesen + Cache-Schreiben
Ideal fürAnspruchsvolles Reasoning, Coding-Agents und hochwertige Workflows
Claude Opus 4.8
EvoLink-Preis / 1M (Input / Output)$4.5 / $22.5
Kontextfenster1M
Prompt-CachingCache-Lesen + Cache-Schreiben
Ideal fürAnthropic-Flaggschiff für tiefes Reasoning, Coding und langlaufende Agents.
Gemini 3.1 Pro
EvoLink-Preis / 1M (Input / Output)$1.865 / $11.183
Kontextfenster1M
Prompt-CachingKontext-Caching
Ideal fürGoogle-Flaggschiff für multimodales Reasoning und Workloads mit großem Kontext.

Die Basiskontextpreise verwenden die aktuelle EvoLink-Benutzergruppe. Angemeldete Nutzer sehen ihre Gruppentarife, abgemeldete Nutzer die Default-Tarife. Langkontext-Multiplikatoren bleiben im Pricing des jeweiligen Modells.

GPT-Modellfamilie

Gleicher API-Key, gleiches Guthaben – Stufe wechseln, ohne die Integration zu ändern.

Alle GPT-Modelle vergleichen
GPT-6.1 Sol

GPT-6.1 Sol

Neues Sol für Mehrdatei-Coding und Agents auf Responses

Modell ansehen
GPT-6 Astra

GPT-6 Astra

Aufrufbare GPT-5.6-Routen mit den veröffentlichten Spezifikationen von GPT-6 Astra vergleichen und vor dem Upgrade Kosten-, Evaluierungs- und Rollout-Gates definieren

Modell ansehen
GPT-6 Sol

GPT-6 Sol

GPT-6-Modell, entwickelt für komplexes Coding und agentische Workflows

Modell ansehen

Weitere Textmodelle auf EvoLink neben GPT-5.6

Claude Opus 4.8

Claude Opus 4.8

Anthropic-Flaggschiff für tiefes Reasoning, Coding und langlaufende Agents.

Modell ansehen
Gemini 3.1 Pro

Gemini 3.1 Pro

Google-Flaggschiff für multimodales Reasoning und Workloads mit großem Kontext.

Modell ansehen
Grok 4.5

Grok 4.5

xAIs Reasoning- und Tool-Route mit 500K Kontextfenster und serverseitigen Suchtools.

Modell ansehen
Kimi K3

Kimi K3

Moonshots Langkontext-Reasoning-Route für Coding im Repository-Maßstab und Arbeit mit vielen Dokumenten.

Modell ansehen

GPT-5.6 API - FAQ

Welche Modell-IDs sind verfügbar?

Verwenden Sie gpt-5.6-sol, gpt-5.6-terra oder gpt-5.6-luna. Einen generischen gpt-5.6-Alias gibt es nicht.

Wie wird gecachter Input abgerechnet?

Cache-Lesen und Cache-Schreiben sind separate Token-Segmente. Keines der beiden Segmente wird erneut als normaler Input berechnet.

Wann gelten Langkontext-Preise?

Sobald die gesamten Prompt-Tokens 272.000 überschreiten, nutzt der gesamte Request die Langkontext-Multiplikatoren aus der Preistabelle.

Kann ich das OpenAI SDK mit GPT-5.6 auf EvoLink nutzen?

Ja. Richten Sie das SDK auf die EvoLink-Basis-URL mit Ihrem EvoLink-API-Key und wählen Sie eine der drei GPT-5.6-Modell-IDs.

Mit welcher GPT-5.6-Stufe sollte ich starten?

Für die meiste Produktionsarbeit mit Terra; Sol bei Aufgaben mit tieferem Reasoning; Luna für kostensensible Anfragen in hohem Volumen.

Unterstützt GPT-5.6 Tool-Aufrufe und strukturierte Ausgabe?

Ja. Alle drei Stufen unterstützen Function Calling und JSON-strukturierte Ausgabe über die Standardfelder von Chat Completions.