GPT Image 2.5 Flare & Sunburst sind jetzt auf EvoLink verfügbarGPT Image 2.5 testen

API-Updates

Bleiben Sie über die neuesten Änderungen und Verbesserungen in all unseren APIs informiert.

September 2026

2026-09-30

Neue Modelle | Suno V6, Suno V6 Mini und Suno V6 Wild

models

Suno V6, Suno V6 Mini und Suno V6 Wild sind ab sofort auf EvoLink verfügbar; Suno V6 ist jetzt die standardmäßig empfohlene Version auf der Suno-Seite. Alle drei kosten so viel wie die bisherigen Suno-Musikmodelle, werden pro Generierung abgerechnet und liefern 2 Tracks pro Generierung.

Suno V6

  • Modell-ID: suno-v6-beta
  • Highlights: natürlicherer Gesang, mehr Details und stärkerer musikalischer Ausdruck
  • Unterstützt: Persona und benutzerdefinierte duration (empfohlen: 60 Sekunden oder mehr)

Suno V6 Mini

  • Modell-ID: suno-v6-mini-beta
  • Highlights: leicht und schnell, ausgewogen zwischen Qualität und Tempo
  • Unterstützt: Persona; eine benutzerdefinierte duration wird noch nicht unterstützt
  • Testen: in der Modellauswahl zu Suno V6 Mini wechseln

Suno V6 Wild

  • Modell-ID: suno-v6-wild-beta
  • Highlights: kühnerer, markanterer musikalischer Ausdruck
  • Unterstützt: Persona und benutzerdefinierte duration
  • Testen: in der Modellauswahl zu Suno V6 Wild wechseln

Gilt für alle drei Modelle

  • Preis: wie bei den bisherigen Suno-Musikmodellen, pro Generierung abgerechnet — unabhängig von der Tracklänge. Siehe Preise
  • Längenlimits: im benutzerdefinierten Modus (custom_mode=true) Songtext bis 5000 Zeichen und Stil bis 1000 Zeichen
  • Persona und Dauer: nur im benutzerdefinierten Modus verfügbar
  • Asynchrone Aufgaben: absenden, dann Status abfragen oder callback_url verwenden

Alle Suno-Versionen

  • Das Prompt-Limit im einfachen Modus (custom_mode=false) steigt von 500 auf 3000 Zeichen
2026-09-29

Neues Modell | GPT-6.1 Sol

models

GPT-6.1 Sol ist ab sofort auf EvoLink verfügbar. OpenAI positioniert das Modell als nahezu Astra-Leistung für komplexe Aufgaben zu geringeren Kosten: komplexes Coding, Computer Use und professionelle Arbeit.

GPT-6.1 Sol

  • Modell-ID: gpt-6.1-sol — mit Punkt geschrieben; GPT-6 Sol bleibt unter seiner eigenen ID verfügbar
  • Gebaut für: komplexes Coding und Debugging, Computer Use und mehrstufige professionelle Arbeit
  • Kontextfenster: 1.050.000 Tokens, bis zu 128K maximale Ausgabe
  • Abrechnung: nicht gecachter Input, Cache-Lesezugriffe, Cache-Schreibzugriffe und Output werden getrennt erfasst; OpenAIs Preis für Cache-Lesezugriffe ist halb so hoch wie bei GPT-6 Sol. Aktuelle Preise stehen auf der GPT-6.1-Sol-Modellseite
  • Langer Kontext: Anfragen mit mehr als 272K Prompt-Tokens werden vollständig zu Langkontext-Preisen abgerechnet — 2x für Input und beide Cache-Rollen, 1,5x für Output
  • Protokolle: OpenAI-kompatible Chat Completions und Responses mit demselben EvoLink-API-Key

Änderungen gegenüber GPT-6 Sol

  • Reasoning: reasoning_effort (Chat) bzw. reasoning.effort (Responses) akzeptiert low, medium (Standard), high und xhigh, dazu max bei Responses; none wird nicht unterstützt, stellen Sie none daher auf low um
  • Tool Calling: Chat Completions akzeptiert nur Anfragen ohne Tools; Function Calling und integrierte Tools laufen über Responses
  • Parameter: entfernen Sie temperature, top_p, logprobs und top_logprobs aus den Anfragen
2026-09-29

Claude Sonnet 5.5 | Das neueste Sonnet von Anthropic für Coding und Agenten

models

Claude Sonnet 5.5 von Anthropic ist jetzt auf EvoLink verfügbar — der Nachfolger von Claude Sonnet 5 zum gleichen Listenpreis, für alltägliches Coding, werkzeugnutzende Agents und Produktionsverkehr mit hohem Volumen, mit einem Kontextfenster von 1M Tokens und bis zu 128K maximaler Ausgabe.

Claude Sonnet 5.5

  • Modell-ID: claude-sonnet-5-5
  • Kontextfenster: 1M Tokens
  • Maximale Ausgabe: 128K Tokens
  • Fähigkeiten: agentisches Coding in echten Repositorys, zuverlässige Tool-Nutzung, adaptives Thinking (standardmäßig aktiv), Bildeingabe, Prompt Caching
  • Empfohlene Workloads: alltägliches Coding, werkzeugnutzende Agents und Produktionsverkehr mit hohem Volumen
  • Abrechnung: token-basiert — Input, Output, Cache Write, Cache Hit; das Web-Search-Tool wird auf Routen, die es unterstützen, pro Suche abgerechnet. Aktuelle Preise im Preisbereich
  • API: OpenAI-kompatible Chat Completions und Anthropic Messages mit demselben EvoLink-API-Key
2026-09-29

GLM, DeepSeek & Kimi K3 | Günstigere Preise

pricing

GLM, DeepSeek und Kimi K3 werden bei EvoLink günstiger, gültig ab 30. September 2026 (UTC+8). Betroffen sind GLM-5.3, GLM-5.3 Flash, GLM-5.3 FlashX, GLM-5.2, DeepSeek V4 Pro, DeepSeek V4 Flash, DeepSeek V4.1 Flash und Kimi K3: Eingabe und Ausgabe sind bei all diesen Modellen günstiger, der Cache-Lesezugriff ist bei den meisten günstiger oder unverändert. Die neuen Preise gelten automatisch, an Ihren API-Aufrufen ändert sich nichts.

  • Der Cache-Lesezugriff bei GLM-5.3 und GLM-5.3 FlashX wird mit den neuen Preisen leicht teurer
  • deepseek-v4-flash-vision-exp wird jetzt von DeepSeek V4.1 Flash bedient und zu den Preisen von DeepSeek V4.1 Flash abgerechnet
2026-09-24

Neue Modelle | Seedream 5.0 Flash und Seedream 5.0 Flash Layerize

models

Seedream 5.0 Flash und Seedream 5.0 Flash Layerize sind ab sofort auf EvoLink verfügbar. Flash ist das schnellere Seedream-5.0-Modell für Bildgenerierung und -bearbeitung; Flash Layerize zerlegt ein Bild in bearbeitbare Ebenen. Beide berechnen einen Festpreis pro Ausgabebild, 10 % unter dem offiziellen Preis.

Seedream 5.0 Flash

  • Modell-ID: doubao-seedream-5.0-flash
  • Generierung und Bearbeitung: Text-zu-Bild, Bild-zu-Bild und Bearbeitung mit bis zu 10 Referenzen; size akzeptiert auto, ein Seitenverhältnis oder eigene Pixelmaße; quality ist 1K, 1.5K oder 2K. Transparente Ausgabe erhält vorhandenes Alpha aus genau einer Referenz und erfordert PNG; sie entfernt keinen Hintergrund
  • Preis: ein Festpreis pro Ausgabebild — 1K, 1.5K und 2K kosten gleich viel, Referenzbilder werden nicht berechnet. Siehe Preise

Seedream 5.0 Flash Layerize

  • Modell-ID: doubao-seedream-5.0-flash-layerize
  • Eingabe: genau ein PNG- oder JPEG-Bild; prompt ist optional
  • Ausgabe: ein Basisbild plus bis zu 16 transparente PNG-Ebenen, jeweils mit Stapelreihenfolge und Begrenzungsrahmen
  • Preis: jedes Ausgabebild — das Basisbild und jede Ebene — wird zum selben Festpreis wie Flash berechnet. Beim Start werden bis zu 17 Bilder reserviert, der ungenutzte Teil wird erstattet

Gemeinsam für beide Modelle

  • Gleiche Anfrage wie Seedream 5.0 Pro: quality ist 1K, 1.5K oder 2K (Layerize akzeptiert zusätzlich auto)
  • Prompt-Modus: prompt_priority akzeptiert nur standard — Anfragen mit fast werden abgelehnt und nicht berechnet
  • Asynchrone Aufgaben: absenden, dann Status abfragen oder callback_url verwenden
2026-09-23

Neue Modelle | GPT-6 Sol und GPT-6 Luna

models

GPT-6 Sol und GPT-6 Luna ergänzen GPT-6 Astra auf EvoLink. Sol ist für komplexes Coding und agentische Workflows gebaut; Luna ist das effizienteste GPT-6-Modell von OpenAI für fokussierte Aufgaben in großem Volumen.

GPT-6 Sol

  • Modell-ID: gpt-6-sol — es gibt keinen allgemeinen Alias gpt-6
  • Gebaut für: komplexes Coding, Änderungen über mehrere Dateien und toolgesteuerte Agents
  • Abrechnung: nicht gecachter Input, Cache-Lesezugriffe, Cache-Schreibzugriffe und Output werden getrennt erfasst. Aktuelle Preise stehen auf der GPT-6-Sol-Modellseite

GPT-6 Luna

  • Modell-ID: gpt-6-luna
  • Gebaut für: Klassifikation, Extraktion, Routing und Subagent-Aufrufe in großem Volumen
  • Abrechnung: dieselben vier getrennt erfassten Posten. Aktuelle Preise stehen auf der GPT-6-Luna-Modellseite

Gemeinsam für beide Modelle

  • Kontextfenster: 1.050.000 Token, bis zu 128K maximale Ausgabe
  • Langer Kontext: Bei mehr als 272K Prompt-Token wird die gesamte Anfrage zu Long-Context-Tarifen abgerechnet — 2x für Input und beide Cache-Rollen, 1,5x für Output
  • Protokolle: OpenAI-kompatible Chat Completions und Responses mit demselben EvoLink-API-Key
  • Reasoning: reasoning_effort (Chat) bzw. reasoning.effort (Responses) akzeptiert none, low, medium (Standard), high, xhigh und max — none ist gegenüber GPT-6 Astra neu
  • Tool-Aufrufe: Für integrierte Tools und Function Calling Responses nutzen; auf Chat Completions funktioniert Function Calling nur mit reasoning_effort auf none
2026-09-23

GPT-5.6 Sol | Günstigere Preise

pricing

GPT-5.6 Sol wird bei EvoLink auf ganzer Linie günstiger und folgt damit dem neuen Listenpreis von OpenAI für das Modell, gültig ab 23. September 2026 (UTC+8). Eingabe, Cache-Lesezugriff, Cache-Schreibzugriff und Ausgabe sind günstiger, einschließlich der Long-Context-Tarife. Die neuen Preise gelten automatisch — rufen Sie weiter gpt-5.6-sol auf, an Ihren API-Aufrufen ändert sich nichts.

  • Die Preise von GPT-5.6 Terra und GPT-5.6 Luna bleiben unverändert
2026-09-22

Neues Modell | Claude Opus 5.5

models

Claude Opus 5.5 — Anthropics neuestes Opus-Modell, Nachfolger von Claude Opus 5 zu einem niedrigeren Listenpreis — ist jetzt auf EvoLink verfügbar.

Verfügbarkeit

Claude Opus 5.5 lässt sich über die EvoLink-Produktions-API mit demselben EvoLink-API-Key aufrufen. Die Modellseite von Claude Opus 5.5 ist die maßgebliche Quelle für aktuelle Preise und Parameter.

Modell-ID

  • claude-opus-5-5 — 1.000.000-Token-Kontextfenster, bis zu 128K maximale Ausgabe

Abrechnungsdimensionen

Fünf Dimensionen werden getrennt gemessen: Eingabe, Cache-Schreiben, Cache-Lesen, Ausgabe und das Web-Search-Tool. Das Web-Search-Tool wird pro Suche abgerechnet, und Suchergebnisse zählen zusätzlich als normale Eingabe-Token. Aktuelle Preise finden Sie im Preisbereich.

Umstieg von Claude Opus 5

Anthropic listet Opus 5.5 bei jedem Tokenpreis unter Opus 5, und Cache-Lesen sinkt von einem Zehntel auf ein Zwanzigstel des Eingabepreises. Drei Anfrage-Einstellungen verhalten sich anders: Das Denken lässt sich nicht abschalten — senden Sie thinking: {type: "adaptive"} oder lassen Sie den Parameter weg und steuern Sie die Tiefe über effort; der Standardwert von effort ist medium statt high; und eine erzwungene Tool-Auswahl (any oder tool) wird abgelehnt, nutzen Sie daher auto.

Protokolle

OpenAI-kompatible Chat Completions und Anthropic Messages mit demselben EvoLink-API-Key.

Claude Opus 5.5 testen | Preise ansehen

2026-09-22

Grok 4.7 | Das neueste Reasoning-Modell von xAI, zu Grok-4.6-Preisen

models

Grok 4.7 ist auf EvoLink verfügbar, mit 500.000 Token Kontext und sowohl über Chat Completions als auch über Responses erreichbar.

Preise — Position für Position identisch mit Grok 4.6

  • Eingabe: 2,00 $ je 1 Mio. Token (Listenpreis)
  • Cache-Eingabe: 0,50 $ je 1 Mio. Token
  • Ausgabe: 6,00 $ je 1 Mio. Token, Reasoning-Token inbegriffen
  • Ab 200.000 Prompt-Token wandern alle Token der Anfrage in die Langkontext-Stufe zum 2-fachen Satz
  • Die Modellseite zeigt den Satz, den Ihr Konto tatsächlich zahlt

Was sich gegenüber Grok 4.6 ändert

  • Die Modell-ID für Anfragen lautet grok-4.7. Der Seiten-Slug grok-4-7 ist kein gültiger Anfragewert
  • reasoning_effort akzeptiert low, medium, high (Standard) und xhigh
  • Auf Responses kommt verschlüsseltes Reasoning bei jeder Antwort zurück, ohne Eintrag in include
  • Der Wissensstand reicht jetzt bis Mai 2026
2026-09-22

Grok X-Suche | Abrechnung nach abgerufenen Beiträgen und Profilen

modelspricing

Die X-Suche bei Grok wird jetzt nach dem abgerechnet, was eine Suche zurückgibt, nicht mehr danach, wie oft sie ausgeführt wird. xAI hat dies am 21. September 2026 um 12:00 Uhr PT umgestellt; es gilt für grok-4.5, grok-4.6 und grok-4.7.

Sätze — gültig ab 21. September 2026

  • Abgerufene Beiträge: 5 $ je 1.000 Beiträge, zuvor 5 $ je 1.000 Aufrufe
  • Abgerufene Nutzerprofile: 10 $ je 1.000 Profile, ein neuer Abrechnungsposten
  • Jeder Beitrag, den eine Suche oder ein Thread-Abruf zurückgibt, zählt — einschließlich Eltern- und Zitat-Beiträgen, ohne Deduplizierung
  • Die übrigen serverseitigen Tools bleiben unverändert: Websuche und Code-Ausführung je 5 $ pro 1.000 Aufrufe, Anhangsuche 10 $ pro 1.000, Sammlungssuche 2,50 $ pro 1.000

Was sich für Ihre Rechnung ändert

  • Bisher kostete ein x_search-Aufruf gleich viel, ob er 1 oder 30 Beiträge zurückgab. Jetzt wird pro Element gezählt
  • Suchen, die lange Threads ziehen, werden spürbar teurer; begrenzen Sie die Menge mit search_parameters.max_search_results
  • Token-Kosten bleiben unberührt und werden weiterhin getrennt von den Tool-Gebühren berechnet
2026-09-22

Seedance 2.5 Update | Entwurfsmodus und Draft-to-Video

models

Seedance 2.5 unterstützt jetzt einen zweistufigen Entwurfs-Workflow: erst schnell vorschauen, dann das Finale erzeugen.

Neu

  • Entwurfsmodus: Mit draft: true (oder dem Entwurfsmodus im Playground) liefert jedes der fünf Seedance-2.5-Generierungsmodelle eine schnelle 480p-Vorschau von Szene, Kamera und Bewegung. Abrechnung wie ein normales 480p-Video
  • seedance-2.5-draft-to-video: Wandelt einen fertigen Entwurf nur mit source_task_id und optionalem output_format in ein 1080p-Finalvideo um. Prompt, Materialien, Dauer, Seitenverhältnis, Seed und Audio werden übernommen

Hinweise

  • Entwurf und Finale werden separat abgerechnet, das Finale zum 1080p-Tarif; der Inhaltsfilter wird vom Entwurf übernommen und ist bei der Umwandlung nicht änderbar
  • Ein fertiger Entwurf liefert draft_expires_at; danach antwortet die Umwandlung mit 410 draft_task_expired
2026-09-21

GLM-5.3 FlashX | Neue Durchsatzstufe der 5.3-Familie

models

GLM-5.3 FlashX ist verfügbar. Das Modell liegt zwischen GLM-5.3 Flash und dem GLM-5.3-Flaggschiff: derselbe nativ multimodale 1-Mio.-Token-Kontext und durchgehendes Reasoning, zu rund einem Viertel des Flaggschiff-Preises.

  • Modell-ID glm-5.3-flashx, verfügbar über Chat Completions, Responses und Anthropic Messages
  • Text-, Bild-, Video- und Datei-Eingabe; Cache-Reads werden zu einem eigenen, günstigeren Satz abgerechnet
  • Websuche wird pro Aufruf getrennt von der Token-Nutzung abgerechnet
  • Reasoning-Stufen sind low, high und max; andere Werte werden auf die nächstliegende Stufe abgebildet

Die Modellseite zeigt den aktuellen Token-Satz für Ihr Konto. Die konkreten Zahlen stehen auf der Preisseite.

2026-09-17

Neues Modell | MiniMax H3 Max Reference-to-Video

models

MiniMax H3 Max nimmt jetzt über eine neue Route Referenzmedien entgegen — Bilder, Video und Audio. Die Ausgabe wird pro Sekunde abgerechnet; Referenzvideo hat einen eigenen, höheren Satz.

MiniMax H3 Max Reference-to-Video

  • Modell-ID: minimax-h3-max-reference-to-video
  • Referenzmedien: bis zu 9 Bilder, 3 Videos und 3 Audioclips, insgesamt 12 Elemente. Mindestens ein Referenzbild oder ein Referenzvideo ist erforderlich — Audio allein wird abgelehnt
  • Ausgabe: 768p oder 480p MP4, 5–15 Sekunden, das Seitenverhältnis folgt standardmäßig dem Referenzmaterial. H3 Max hat keine 2K-Stufe
  • Preis: drei Bestandteile — Ausgabesekunden, Referenzvideosekunden zu einem eigenen, höheren Sekundensatz und Referenzbilder über dem Freikontingent. Referenzaudio ist kostenlos. Siehe Preise
  • Freikontingent für Bilder: die ersten 2 Referenzbilder sind kostenlos. MiniMax H3 gewährt 5 — derselbe Auftrag kann hier also teurer werden; prüfen Sie vorher die Schätzung
  • Nicht unterstützt: image_start / image_end
  • Asynchrone Tasks: absenden, dann Status abfragen oder callback_url nutzen
2026-09-17

Neues Modell | MiniMax H3 Max Turbo

models

MiniMax H3 Max Turbo — die Schnellstufe von MiniMax H3 Max — ist ab sofort auf EvoLink verfügbar: zwei Routen, Ausgabe in 768p / 480p, Abrechnung pro Sekunde.

MiniMax H3 Max Turbo

  • Modell-IDs: minimax-h3-max-turbo-text-to-video, minimax-h3-max-turbo-image-to-video
  • Ausgabe: MP4 in 768p oder 480p, 5–15 Sekunden. Seitenverhältnis 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 — Text-zu-Video benötigt ein konkretes Verhältnis (Standard 16:9)
  • Preis: pro Ausgabesekunde, bei gleicher Auflösung 5% unter dem offiziellen Turbo-Preis; die Mindestabrechnung entspricht der günstigsten gültigen Anfrage (480p × 5 s). Siehe Preise
  • Bild-zu-Video: image_start (Startbild) ist erforderlich, image_end (Endbild) optional. Ein Endbild allein wird nicht unterstützt. Diese Route nimmt kein Seitenverhältnis entgegen — die Ausgabe folgt den Proportionen des Eingabebilds
  • Standardauflösung: Anfragen ohne quality erzeugen 768p. Für die günstigste Stufe "quality": "480p" senden
  • Nicht in Turbo enthalten: 2K-Ausgabe, 4-Sekunden-Clips sowie jede Form referenzgesteuerter Generierung — keine Referenzbilder, -videos oder -audios. Nutzen Sie MiniMax H3 oder MiniMax H3 Max, wenn Referenzmedien nötig sind
  • Asynchrone Aufgaben: absenden, dann Status abfragen oder callback_url verwenden
2026-09-17

Seedance 2.5 | 1080p wieder zum regulären Preis

pricing

Der zeitlich begrenzte Rabatt von 28 % auf die 1080p-Ausgabe von Seedance 2.5 ist wie angekündigt am 17. September 2026 (UTC+8) ausgelaufen. Für alle fünf Modelle gilt bei 1080p wieder der reguläre Preis. Ihre API-Aufrufe müssen nicht angepasst werden.

  • Die Preise für 480p und 720p bleiben unverändert
  • Gilt für seedance-2.5-text-to-video, seedance-2.5-image-to-video, seedance-2.5-reference-to-video, seedance-2.5-video-edit und seedance-2.5-video-extend

Die Schätzung im Playground und die Preisseite zeigen bereits den regulären Preis. Den aktuellen Sekundenpreis finden Sie auf der Preisseite.

2026-09-16

MiniMax H3 Max | 5 % Preissenkung für beide Auflösungen

modelspricing

MiniMax H3 Max wird bei der Videoerstellung aus Text und Bildern für beide Ausgabeauflösungen um 5 % günstiger.

Preise — 5 % Rabatt ab 16. September 2026

  • 768p: $0,076 pro Ausgabesekunde, zuvor $0,080
  • 480p: $0,0475 pro Ausgabesekunde, zuvor $0,050
  • Mindestgebühr: $0,2375 pro Task, zuvor $0,250 (480p × 5 Sekunden)
  • Für beide Routen gelten dieselben Preise: minimax-h3-max-text-to-video und minimax-h3-max-image-to-video

Ausgabeauflösung wählen

  • Anfragen ohne quality erzeugen Videos in 768p. Für den niedrigsten Preis geben Sie "quality": "480p" ausdrücklich an
  • Beide Auflösungen unterstützen 5–15 Sekunden Ausgabe, abgerechnet pro Ausgabesekunde
2026-09-10

Neues Modell | DeepSeek V4.1 Flash

models

DeepSeek V4.1 Flash ergänzt natives Bildverständnis für Coding-, Dokument- und Screenshot-Workflows. Prüfen Sie vor dem Rollout die aktuellen Preise auf der Modellseite.

DeepSeek V4.1 Flash

  • Modell-ID: deepseek-v4.1-flash auf EvoLink; die Seiten-URL lautet /deepseek-v4-1-flash
  • Kontextfenster: 1.000.000 Token, bis zu 384.000 Token Ausgabe; legen Sie je Aufgabe ein passendes Ausgabebudget fest
  • Abrechnung: Input, Cache-Treffer und Output haben getrennte Tarife. Prüfen Sie den Preisbereich der Modellseite und die abgerechneten Endkosten Ihres Kontos; Tarife pro Token allein bestimmen die Aufgabenkosten nicht
  • Bildeingabe: PNG, JPEG, WebP und GIF. Messen Sie die Nutzung mit repräsentativen Bildern, bevor Sie skalieren
  • Protokolle: Chat Completions, Messages und Responses nehmen dieselbe Modell-ID an; die Bildfelder unterscheiden sich: image_url, ein image-Block und input_image
  • Thinking und Caching: Thinking ist standardmäßig aktiviert und Präfix-Caching läuft automatisch; protokollieren Sie die gesendete Thinking-Einstellung, prüfen Sie die Dokumentation Ihres Protokolls und lesen Sie gecachte Token aus der Usage
  • Bisherige Routen: Auf EvoLink sind deepseek-v4-flash und deepseek-v4-pro nicht betroffen und liefern weiterhin V4 Flash und V4 Pro; deepseek-v4-flash-vision-exp leitet jetzt an V4.1 Flash weiter. Siehe den Migrationsleitfaden
2026-09-09

Neues Modell | GPT Image 2.5 Sunburst & Flare

models

GPT Image 2.5 Sunburst und GPT Image 2.5 Flare sind jetzt auf EvoLink verfügbar – die beiden GPT Image 2.5-Modelle, die OpenAI am 8. September 2026 veröffentlicht hat, zu denselben Token-Preisen wie GPT Image 2.

GPT Image 2.5 Sunburst

  • Modell-ID: gpt-image-2.5-sunburst (kein Alias; exakte ID verwenden)
  • Positionierung: OpenAIs Wahl für Workflows, in denen Bearbeitungspräzision am wichtigsten ist – engere Kontrolle über mehrstufige Bearbeitungen, längere Generierungszeiten
  • Eingabe: Text-Prompt, bis zu 16 Referenzbilder und eine optionale Inpainting-Maske; Ausgabe: Bild
  • Qualität: fünf Stufen low / medium / high / xhigh / max (Standard medium); Größe auto, 15 Seitenverhältnisse oder explizites WxH; Auflösung 1K / 2K / 4K
  • Abrechnung: tokenbasiert – Bild-Ausgabe-, Bild-Eingabe-, Cache- und Text-Eingabe-Token werden über das usage-Objekt des Upstreams abgerechnet; Preise im Preisbereich
  • Endpunkt: POST /v1/images/generations, asynchrone Aufgabe mit Polling oder callback_url

GPT Image 2.5 Flare

  • Modell-ID: gpt-image-2.5-flare (kein Alias; exakte ID verwenden)
  • Positionierung: OpenAIs schneller Standard für hochwertige Alltagsgenerierung – höhere Qualität als GPT Image 2 bei bis zu 50 % geringerer Latenz (Angabe von OpenAI)
  • Eingabe: Text-Prompt, bis zu 16 Referenzbilder und eine optionale Inpainting-Maske; Ausgabe: Bild
  • Qualität: fünf Stufen low / medium / high / xhigh / max (Standard medium); Größe auto, 15 Seitenverhältnisse oder explizites WxH; Auflösung 1K / 2K / 4K
  • Abrechnung: tokenbasiert – Bild-Ausgabe-, Bild-Eingabe-, Cache- und Text-Eingabe-Token werden über das usage-Objekt des Upstreams abgerechnet; Preise im Preisbereich
  • Endpunkt: POST /v1/images/generations, asynchrone Aufgabe mit Polling oder callback_url

Gleiche Token-Preise bedeuten nicht dieselbe Rechnung: Jede Qualitätsstufe verbraucht unterschiedlich viele Ausgabe-Token, und GPT Image 2.5 nutzt pro Stufe eine niedrigere Tile-Basis als GPT Image 2 (sein high kostet etwa so viel wie GPT Image 2 medium). Schätzen Sie eine Anfrage im Playground oder im Preisrechner, bevor Sie sich auf eine Stufe festlegen.

2026-09-07

Rabatt verlängert | Seedance 2.0 Mini & Fast

pricing

Die zeitlich begrenzte Preissenkung für Seedance 2.0 Mini und Seedance 2.0 Fast sollte heute enden und wird nun bis zum 6. Oktober 2026 (UTC+8) verlängert. Preise und Rabatthöhe bleiben unverändert, der Rabatt gilt weiterhin automatisch – Ihre API-Aufrufe müssen nicht angepasst werden. Seedance 2.0 Standard bleibt von dieser Aktion ausgenommen.

  • Seedance 2.0 Mini: 60 % Rabatt
  • Seedance 2.0 Fast: 25 % Rabatt

Die Senkung gilt weiterhin für alle Auflösungen und alle Generierungsmodi (Text-to-Video, Image-to-Video, Reference-to-Video). Aktuelle Preise finden Sie auf der jeweiligen Modellseite.

Die Aktion endet nun am 6. Oktober 2026 (UTC+8), danach gelten wieder die ursprünglichen Preise.

2026-09-04

Neues Modell | GPT-6 Astra

models

GPT-6 Astra — das leistungsfähigste Modell von OpenAI, gebaut für die schwierigsten End-to-End-Aufgaben in Reasoning, Coding, Computer Use und Recherche — ist jetzt auf EvoLink verfügbar, 10 % unter dem OpenAI-Listenpreis.

GPT-6 Astra

  • Modell-ID: gpt-6-astra — einen generischen gpt-6-Alias gibt es nicht
  • Kontextfenster: 1.050.000 Token, bis zu 128K maximale Ausgabe
  • Abrechnung: ungecachte Eingabe, Cache-Lesen, Cache-Schreiben und Ausgabe werden getrennt gemessen, jede Dimension 10 % unter dem OpenAI-Listenpreis. Aktuelle Tarife auf der GPT-6 Astra Modellseite
  • Long Context: Anfragen über 272K Prompt-Token werden vollständig zu Long-Context-Tarifen abgerechnet — 2x für Eingabe und beide Cache-Rollen, 1,5x für die Ausgabe
  • Protokolle: OpenAI-kompatible Chat Completions und Responses mit demselben EvoLink API-Key; OpenAI verlangt Responses für Tool Calling
  • Reasoning: reasoning_effort (Chat) oder reasoning.effort (Responses) auf low, medium, high, xhigh oder max setzen — none und minimal werden abgelehnt, temperature / top_p werden nicht akzeptiert
  • Ebenfalls unterstützt: Prompt-Caching und strukturierte Ausgaben auf beiden Oberflächen
2026-09-03

Neues Modell | MiniMax H3 Max

models

MiniMax H3 Max — die schnelle Generierungsvariante aus MiniMax' Hailuo-Familie — ist ab sofort auf EvoLink verfügbar: zwei Routen, Ausgabe in 768p / 480p, Abrechnung pro Sekunde.

MiniMax H3 Max

  • Modell-IDs: minimax-h3-max-text-to-video, minimax-h3-max-image-to-video
  • Ausgabe: MP4 in 768p oder 480p, 5–15 Sekunden. Seitenverhältnis 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 — Text-zu-Video braucht ein konkretes Verhältnis (Standard 16:9)
  • Preise: $0,080 pro Ausgabesekunde in 768p, $0,050 in 480p, gleicher Tarif auf beiden Routen; die Mindestgebühr entspricht der günstigsten gültigen Anfrage (480p × 5 s, $0,25 pro Aufgabe)
  • Bild-zu-Video: erstes Bild, letztes Bild oder beide senden. Diese Route bietet keine Wahl des Seitenverhältnisses — die Ausgabe folgt immer den Proportionen des Eingabebildes
  • Standardauflösung: Anfragen ohne quality laufen in 768p. Für die günstigste Stufe "quality": "480p" senden
  • Nicht bei H3 Max: 2K-Ausgabe, 4-Sekunden-Clips und referenzgesteuerte Generierung. Für 2K oder Referenzbilder, -videos und -audio MiniMax H3 verwenden
  • Asynchrone Aufgaben: absenden, dann Status pollen oder callback_url nutzen
2026-09-02

Neues Modell | Gemini 3.8 Flash

models

Gemini 3.8 Flash ist ab sofort auf EvoLink verfügbar – zum gleichen Preis wie Gemini 3.7 Flash.

Es ist Googles bislang leistungsfähigstes Flash-Modell und verbessert Software-Engineering, Computer-Use und mehrstufige agentische Arbeit deutlich gegenüber 3.7, bei gleichbleibendem Durchsatz und Kostenniveau der Flash-Klasse.

Gemini 3.8 Flash

  • Modell-ID: gemini-3.8-flash
  • Kontext: 1.048.576 Token; max. Ausgabe: 65.536 Token
  • Eingabe: Text, Bild, Audio, Video, PDF; Ausgabe: Text
  • Fähigkeiten: Thinking, System-Instructions, strukturierte Ausgabe, Context-Caching, Function Calling, Code-Ausführung, Google Search / Maps Grounding
  • Preise: Eingabe $0,675/Mio. Token, Ausgabe $3,375/Mio. Token, Cache-Hit $0,0676/Mio. Token (Aktionspreis, bis 31. Dezember 2026)
  • Endpunkte: sowohl /v1/chat/completions (OpenAI-Stil) als auch die native Gemini-API

Thinking-Stufen sind unverändert gegenüber 3.7

Gemini 3.8 Flash unterstützt die Stufe minimal nicht – genau wie 3.7. Verfügbar sind low / medium / high, Standard ist medium.

Wenn Ihr Code bei der Migration von 3.7 reasoning_effort: "none" oder "minimal" setzt (native API: thinkingLevel: "MINIMAL"), stuft EvoLink automatisch auf low herunter – Ihre Anfragen schlagen nicht fehl. Für explizite Kontrolle setzen Sie direkt low.

Neben der Modell-ID ist nichts weiter zu ändern: 3.8 entspricht 3.7 Feld für Feld bei Kontextfenster, maximaler Ausgabe, Modalitäten und offiziellen Preisen. Wenn Sie von 3.6 Flash oder älter kommen, verlangt Googles Migrations-Checkliste weiterhin, eigene temperature-, top_p-, top_k- und candidate_count-Werte zu entfernen, das numerische thinking_budget durch den thinking_level-String zu ersetzen und vorbefüllte model-Turns zu entfernen.

2026-09-02

Neues Modell | Claude Fable 5.1

models

Claude Fable 5.1 – Anthropics leistungsfähigstes Modell, die Fable-Stufe über Opus – ist jetzt auf EvoLink verfügbar, 5 % unter dem offiziellen Token-Preis.

Verfügbarkeit

Claude Fable 5.1 lässt sich über die EvoLink-Produktions-API mit demselben EvoLink-API-Key aufrufen. Die Claude Fable 5.1 Modellseite ist die maßgebliche Quelle für aktuelle Preise und Parameter.

Modell-ID

  • claude-fable-5-1 – Kontextfenster mit 1.000.000 Token, bis zu 128K maximale Ausgabe

Abrechnungsdimensionen

Fünf Dimensionen werden getrennt gemessen: Eingabe, Cache-Schreiben, Cache-Lesen, Ausgabe und das Web-Search-Tool. Die Token-Tarife liegen 5 % unter Anthropics offiziellen Preisen; die Websuche wird pro Suche zum offiziellen Tarif ohne Rabatt abgerechnet, und Suchergebnisse zählen zusätzlich als normale Eingabe-Token. Aktuelle Tarife im Preisbereich.

Umstieg von Claude Fable 5

Anthropics Listenpreise für Eingabe, Ausgabe und Cache-Schreiben bleiben unverändert. Der Unterschied: Anthropic hat den Cache-Lesetarif auf ein Viertel des Fable-5-Tarifs gesenkt – cache-intensive Agentenläufe und lange Coding-Sessions werden spürbar günstiger. Auf EvoLink liegen die drei übrigen Tarife rund 5,6 % über Fable 5, da Fable 5 mit 10 % und 5.1 mit 5 % Rabatt auf den Listenpreis läuft.

Protokolle

OpenAI-kompatible Chat Completions und Anthropic Messages mit demselben EvoLink-API-Key. Das Denken ist dauerhaft aktiv: Senden Sie thinking: {type: "adaptive"} oder lassen Sie den Parameter weg und steuern Sie die Tiefe über effort statt über Sampling-Parameter.

Claude Fable 5.1 testen | Preise ansehen

2026-09-01

Preisanpassung | Claude Sonnet 5

pricing

Anthropic hat die Preissenkung für Claude Sonnet 5 dauerhaft gemacht. EvoLink überführt das Launch-Angebot zugleich in den Dauerpreis: Der Betrag pro Token bleibt gleich und steigt nach Ablauf der Aktion nicht mehr an.

Was sich ändert

  • Der offizielle Listenpreis ist dauerhaft niedriger: Eingabe 3,00 $ → 2,00 $/1M Token, Ausgabe 15,00 $ → 10,00 $/1M Token, Cache-Schreiben 3,75 $ → 2,50 $/1M Token, Cache-Lesen 0,30 $ → 0,20 $/1M Token.
  • Ihr EvoLink-Tarif bleibt unverändert. Das befristete Launch-Angebot, das am 31. August enden sollte, ist jetzt der Standardtarif – eine Erhöhung nach Ablauf entfällt.
  • Der ausgewiesene Rabatt liest sich anders. Er wurde gegen den alten Listenpreis von 3,00 $ gemessen; da der offizielle Preis dauerhaft bei 2,00 $ liegt, erscheint derselbe EvoLink-Tarif nun als 10 % unter offiziell. Der abgerechnete Betrag ist identisch.

Was gleich bleibt

Die Modell-ID bleibt claude-sonnet-5, mit unverändertem Kontextfenster von 1M Token und 128K maximaler Ausgabe, über OpenAI-kompatible Chat Completions und Anthropic Messages. Ihre API-Aufrufe müssen nicht angepasst werden. Das Web-Search-Tool wird weiterhin pro Suche zum offiziellen Tarif abgerechnet.

Aktuelle Tarife stehen immer auf der Claude Sonnet 5 Modellseite.

Claude Sonnet 5 | Preise ansehen