Greifen Sie über die einheitliche Chat-API von EvoLink auf V4 Pro von DeepSeek zu – auch gesucht als DeepSeek V4 –. Testen Sie Reasoning, Coding mit langem Kontext, Prompt-Caching vor der Integration.
Coding mit langem KontextThinking-ModusPrompt-CachingChat + Messages + Responses
ProduktionsrouteDiese Rate zeigt die plattformseitige Verfügbarkeit — nur bestätigte Serverfehler (HTTP 500 / leere Antwort) zählen als Ausfälle. Nutzerseitige Probleme (Inhaltsmoderation, ungültige Parameter, Abbruch) sowie Rate-Limits, Timeouts und Auth-Fehler sind ausgenommen. Vor echtem Traffic können leere Zeitfenster als verfügbar erscheinen.Live
Live
Kontext
1M Kontext · max. 384K Ausgabe
Geeignet für
Tieferes Reasoning, komplexes Coding und Agent-Läufe, wo Flash nicht reicht
Eingabe
Text
Ausgabe
Text · JSON (strukturierte Ausgabe)
DeepSeek plant, deepseek-v4-pro am 14. September 2026 in seiner Direkt-API auf V4.1 Flash umzustellen; auf EvoLink ist deepseek-v4-pro nicht betroffen und liefert weiterhin V4 Pro. Siehe den Migrationsleitfaden zu V4.1 Flash.
Eine Evaluierungsroute für Coding, Reasoning und lange Kontexte – verfügbar über Chat Completions, Messages und Responses.
DeepSeek V4 Pro
DeepSeek-Modell für Reasoning und Tool-Nutzung
Ausgewählt
Modell-ID
deepseek-v4-pro
Geeignet für
Umfangreiche Coding-, Reasoning- und Agent-Workloads sowie Langdokument-Analyse mit günstiger Route und Cache-Eingabepreisen.
Eingabe
$1.324 / 1M
90 cr / 1M
Cache-Treffer
$0.045 / 1M
3 cr / 1M
Ausgabe
$3.971 / 1M
270 cr / 1M
Alle Tarife gelten pro 1M Tokens, in USD und Credits, und entsprechen der aktuellen Preisgestaltung Ihres Kontos.
DeepSeek V4 Pro Preise
Schätzen Sie vor der Integration die Kosten einer DeepSeek V4 Pro-Anfrage. Der Rechner verwendet die aktuellen Tarife Ihres Kontos; offizielle Preise dienen als Vergleich.
Anfragen-Rechner
Geben Sie den Token-Mix einer Anfrage und die Anzahl erfolgreicher Tool-Aufrufe ein.
Nur erfolgreiche serverseitige Aufrufe werden pro Aufruf berechnet; fehlgeschlagene Versuche kosten keine Tool-Gebühr, Tokens werden weiterhin berechnet.
Websuche$0.010/ Aufruf·0.68 cr / Aufruf
Was ist die DeepSeek V4 Pro API?
DeepSeek V4 Pro ist die stärkste Stufe von DeepSeek: ein Mixture-of-Experts-Design mit 1,6 Billionen Parametern und 49B aktiven Parametern pro Token, 1 Mio. Token Kontext, 384K maximale Ausgabe und standardmäßig aktiver Thinking-Modus. Bei EvoLink steht es über /v1/chat/completions (OpenAI-Stil) und /v1/messages (Anthropic-Stil) mit der Modell-ID deepseek-v4-pro bereit. Preisgrenzen, unterstützte Abläufe und Modellkonfiguration stehen in den Bereichen Pricing und API. DeepSeek plant, deepseek-v4-pro in seiner Direkt-API ab dem 14. September 2026 um 12:00 Uhr Pekinger Zeit (04:00 UTC) an V4.1 Flash weiterzuleiten; auf EvoLink ist deepseek-v4-pro nicht betroffen und liefert weiterhin V4 Pro.
DeepSeek V4 Pro wird auf EvoLink unter der Modell-ID deepseek-v4-pro über Chat Completions · Anthropic Messages · Responses bereitgestellt – mit demselben API-Key und Guthaben wie jedes andere Modell. Es bietet ein Kontextfenster von 1M und bis zu 384K Ausgabe-Tokens, dazu Reasoning, Coding mit langem Kontext, Prompt-Caching.
DeepSeek V4 Pro Spezifikationen und Fähigkeiten
Die Zahlen stammen aus der EvoLink-Routenkonfiguration; die Fähigkeiten entsprechen dem, was die API heute bereitstellt.
Kontextfenster
1M Tokens
Max. Ausgabe
384K Tokens
Eingabe
Text
Ausgabe
Text · JSON (strukturierte Ausgabe)
Reasoning
Thinking-Modus (standardmäßig an)
Prompt-Caching
Automatische Cache-Lesezugriffe zu niedrigerem Tarif
Serverseitige Tools
Websuche, abgerechnet pro erfolgreichem Aufruf
Protokolle
Chat Completions · Anthropic Messages · Responses
Modell-ID
deepseek-v4-pro
Anfragen über Chat Completions, Messages und Responses müssen die hier gezeigte exakte Modell-ID verwenden.
Für welche Aufgaben eignet sich die DeepSeek V4 Pro API?
DeepSeek V4 Pro kombiniert ein Kontextfenster mit 1.000.000 Token, konfigurierbares Reasoning und Tool Calling für Aufgaben, die Belege bewahren, externe Systeme aufrufen und überprüfbare Ergebnisse liefern müssen. Das Modell verarbeitet ausschließlich Text — Bildeingaben werden nicht akzeptiert. Die folgenden Anwendungsfälle zeigen, wo es Mehrwert bieten kann und was vor der Integration zu prüfen ist.
Repository-weites Coding und Code-Reviews
Quellcode, Issues, Testergebnisse und frühere Änderungen können in einer Aufgabe zusammengeführt werden, um Fehler über mehrere Dateien hinweg zu finden, Änderungen zu planen und Reviews zu erstellen. Prüfen Sie vor dem Einsatz mit festen Repository-Aufgaben Testquote, offene Schritte, strukturierte Ergebnisse und den nötigen manuellen Korrekturaufwand.
Lange Dokumente und Analyse mehrerer Quellen
Das Kontextfenster mit 1.000.000 Token kann Berichte, Verträge, Wissensdatenbank-Auszüge, Gesprächsverläufe und Suchergebnisse gemeinsam aufnehmen. Mehr Kontext verbessert die Antwort nicht automatisch. Prüfen Sie deshalb, ob wichtige Belege erhalten bleiben, und kalkulieren Sie mit den Live-Preisen und der Cache-Treffer-Mechanik aus Pricing die Kosten pro akzeptablem Ergebnis.
Langlaufende Agent- und Terminal-Workflows
Der 0813-GA-Build hat agentisches Coding und Terminal-Aufgaben deutlich verbessert — genau dort verorten Community-Berichte (ein Nachfragesignal, kein verifizierter Benchmark) am häufigsten den Wert von V4 Pro gegenüber geschlossenen Modellen. Binden Sie über Function Calling Ihre eigenen Such- und Ausführungstools an und validieren Sie die Abschlussquote mehrstufiger Aufgaben an realen Workloads, bevor Sie skalieren.
Strukturierte Ausgabe und Agent-Orchestrierung
Texteingaben lassen sich mit JSON Schema, Function Calling und mehrstufigen Agent-Abläufen für Extraktion, Prüfung und Automatisierung verbinden. Testen Sie vor dem Produktiveinsatz Schema-Gültigkeit, Funktionsargumente, das Ende von Streams und eine sichere Wiederherstellung nach Tool-Fehlern.
Was unterscheidet den Zugriff auf DeepSeek V4 Pro über verschiedene Plattformen?
Auch beim selben Modell können sich Kontextkonfiguration, Tool-Support, Nutzungsanzeige und Abrechnung unterscheiden. EvoLink bündelt Modellkonfiguration und Nutzung hinter einer API und hält spätere Modellwechsel einfach.
Die richtige API-Modell-ID verwenden
Seiten-URL und API-Modell-ID sind dieselbe Zeichenfolge: deepseek-v4-pro. Bestehende Anwendungen mit Chat Completions oder Responses tragen diese ID in der Modellkonfiguration ein. Die genauen Felder stehen im API-Bereich.
Die aktuelle Konfiguration des API-Routes beachten
DeepSeek dokumentiert ein Modellfenster mit 1.000.000 Token, Plattformen können aber andere Kontextoptionen, Tools und Limits anbieten. Bei EvoLink sind die angezeigte Modellkonfiguration, die verfügbaren Funktionen und die tatsächlichen usage-Daten des aktuellen Routes maßgeblich.
Chat oder Responses nach Workflow auswählen
Für normale Chats, Streaming und clientseitige Funktionen ist Chat Completions der passende Einstieg. Responses — neu im 0813-Build — eignet sich für langlaufende mehrstufige Agent-Workflows; die dokumentierten Server-Tools sind Function Calling, Web Search und apply_patch, während Code Interpreter auf diesem Route ignoriert wird. So bleibt die OpenAI-kompatible Integration vertraut, ohne unnötige Komplexität einzuführen.
Modellwahl in einem Gateway offenhalten
Grok, GPT, Claude und Kimi lassen sich mit einem EvoLink-Konto, Guthaben und API-Muster nutzen. Liegt die Modellwahl in der Konfiguration, kann nach Qualität, Kosten und Verfügbarkeit geroutet werden, ohne für jeden Anbieter den Anwendungscode neu zu bauen.
Wie lassen sich die Kosten der DeepSeek V4 Pro API genauer steuern?
Der bestehende Pricing-Bereich zeigt die aktuellen Token-Preise (Input, Cache-Hit, Output). Caching, Kontextverwaltung, Reasoning-Einstellungen und Modellrouting reduzieren unnötige Nutzung und ordnen Ausgaben erledigten Aufgaben zu.
Wiederholten Kontext cache-freundlich gestalten
Stabile System-Prompts, Tool-Schemas und gemeinsam genutzter Kontext lassen sich leichter aus dem Cache wiederverwenden. Konfigurieren Sie die unterstützte Cache- oder Konversationskennung des gewählten Protokolls und prüfen Sie cached tokens in usage, um den tatsächlichen Vorteil zu bestätigen.
Nur den benötigten Kontext senden
Ein Fenster mit 1.000.000 Token ist für große Repositories und Dokumente hilfreich, muss aber nicht bei jeder Anfrage gefüllt werden. Relevante Dateien, Nachrichten und Fundstellen zu wählen senkt Eingabekosten und lenkt das Modell auf entscheidende Belege.
Reasoning, Ausgabe und Tool-Aufrufe anpassen
Einfache Aufgaben können mit niedrigerem reasoning effort und kürzeren Ausgaben beginnen; für schwierige Analysen wird das Budget schrittweise erhöht. Bei Recherche und Agents sollte zusätzlich die Zahl der Tool-Aufrufe beobachtet werden, damit wiederholte Suchen oder Schleifen keine unnötigen Kosten erzeugen.
Modelle nach Gesamtkosten pro Aufgabe vergleichen
Token, Cache-Input, serverseitige Tools und notwendige Wiederholungen gehören in dieselbe Aufgabenrechnung. EvoLink zeigt Modelle und Nutzung zentral, sodass Teams die Gesamtkosten vergleichbarer Aufgaben mit DeepSeek V4 Pro und anderen Routes gegenüberstellen können.
Zwei Wege, DeepSeek V4 Pro zu nutzen: EvoLink API oder Agent
Nutzen Sie die EvoLink API für Produkt-Backends und Batch-Jobs oder rufen Sie DeepSeek V4 Pro aus Codex, Claude oder Gemini für Coding- und Analyse-Workflows auf. Beide Wege teilen denselben EvoLink API-Key, das Guthaben, die Modell-ID und die Anfragehistorie.
Senden Sie OpenAI-kompatible Chat-Completions- (oder Anthropic-Messages-) Anfragen an EvoLink und steuern Sie Modell-ID, System-Prompt, Ausgabebudget, Tools und strukturierte Ausgabe.
1Erstellen Sie einen EvoLink API-Key in der Konsole
2Richten Sie Ihr OpenAI- oder Anthropic-SDK auf die EvoLink-Basis-URL und wählen Sie die oben gezeigte Modell-ID
3Senden Sie eine repräsentative Anfrage und lesen Sie im Feld usage Eingabe-, Cache- und Ausgabe-Tokens ab
4Setzen Sie max_tokens und Wiederholungen pro Aufgabe; behalten Sie Tool-Call-IDs und -Ergebnisse über Runden hinweg
Ideal für: Coding-, Review- und Analyseaufgaben in Codex, Claude und Gemini
Geben Sie dem Agenten Aufgabe, Eingaben und Abnahmekriterien. Er baut die Anfrage, ruft DeepSeek V4 Pro über EvoLink auf und liefert die Antwort samt Token-Verbrauch.
1Setzen Sie EVOLINK_API_KEY in Ihrer lokalen Umgebung; nie in Code oder Prompt
2Beschreiben Sie Aufgabe, einzubeziehende Eingaben und das erwartete Ausgabeformat
3Lassen Sie den Agenten DeepSeek V4 Pro über EvoLink aufrufen und die Anfrage vor dem Senden zeigen
4Lassen Sie den Agenten Antwort, Token-Verbrauch und etwaige Fehlermeldungen berichten
DeepSeek V4 Pro API-Codebeispiel und Fehlerbehandlung
Dieses Beispiel zeigt die kürzeste lauffähige Anfrage: ein OpenAI-kompatibler Chat-Completions-Aufruf mit System-Prompt, Nutzernachricht und Ausgabebudget. Die vollständige Parameter- und Antwortreferenz finden Sie im API-Tab.
curl -X POST https://api.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{ "role": "system", "content": "You are a senior engineer reviewing a pull request." },
{ "role": "user", "content": "Review this diff and list every risky change with file and line:\n<diff>" }
],
"max_tokens": 4096,
"temperature": 0.2
}'
# Anthropic Messages (/v1/messages) and Responses (/v1/responses) accept the
# same model ID.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).
Ungültige Anfrage oder nicht unterstützter Parameter
Prüfen Sie Modell-ID, messages-Array und Parameterbereiche anhand der API-Referenz; entfernen Sie Felder, die diese Route nicht unterstützt.
Authentifizierungs- oder Guthabenproblem
Prüfen Sie das Authorization-Bearer-Token und bestätigen Sie das verfügbare Guthaben in der Konsole.
Kontextlänge überschritten
Die Prompt-Tokens übersteigen das Kontextfenster von DeepSeek V4 Pro. Kürzen Sie oder rufen Sie nur relevante Belege ab und nutzen Sie gecachte Präfixe wieder.
Ratenlimit (429)
Mit Backoff und Jitter erneut versuchen; Anfragen bündeln oder in eine Warteschlange stellen statt parallel zu senden.
Inhalt oder Tool-Aufruf abgelehnt
Prüfen Sie sensible Inhalte, fehlerhafte Tool-Call-Argumente und JSON-Schema-Abweichungen vor dem erneuten Versuch.
Wie wählt man für DeepSeek V4 Pro Chat Completions, Responses und Produktionstraffic?
Beide Protokolle bedienen unterschiedliche Workflows. Dies ist eine Auswahlhilfe; genaue Anfragefelder stehen im API-Bereich und in der EvoLink-Dokumentation, Token-Preise im bestehenden Pricing-Bereich; kalkulieren Sie bei der Budgetierung die Tool-Aufruf-Runden in die Gesamtkosten der Aufgabe ein.
01
Standardchat und Client-Funktionen: Chat Completions
Bei bestehenden OpenAI-kompatiblen Chats, Streams oder clientseitigem Function Calling ist Chat Completions der erste Schritt. Prüfen Sie Nachrichtenformat, Stream-Abschluss, Funktionsargumente und usage anhand der Erwartungen des vorhandenen Clients.
Chat und Client-Funktionen
02
Agent-Workflows: Responses
Bewerten Sie die Responses API — neu im 0813-Build — für längere mehrstufige Agent-Abläufe und Codex-artige Integrationen. Prüfen Sie unterstützte Anfragefelder, Fehlerzustände und Wiederholungsgrenzen vor der Integration anhand der aktuellen EvoLink-Dokumentation.
Agent-Workflows
03
Großer Kontext: Cache und Gesamtkosten gemeinsam prüfen
Lange Dokumente, Repositories und Gespräche sollten nicht automatisch vollständig in eine Anfrage wandern. Vergleichen Sie typische Kontextgrößen, Cache-Treffer und -Fehler, Ausgabelänge und Wiederholungen und berechnen Sie die Kosten erfolgreicher Aufgaben aus der Endabrechnung.
Kontextkosten
04
Produktionszugriffe: klein starten und Fallback behalten
Leiten Sie zuerst wenige beobachtbare Aufgaben an DeepSeek V4 Pro und behalten Sie einen bewährten GPT-, Claude- oder Kimi-Route. Die einheitliche EvoLink API bündelt Modellwahl, Nutzung und Guthaben und vereinfacht Wechsel nach Limits, Timeouts, Schema- oder Tool-Fehlern.
Schrittweise Einführung
Cache-Treffer kosten nur einen Bruchteil von frischem Input
Präfix-Caching läuft automatisch: Ein stabiler System-Prompt, Repository-Anweisungen und Tool-Definitionen werden bei späteren Anfragen als Cache-Treffer statt als voller Input berechnet. Messen Sie die reale Trefferquote in Ihren Logs, bevor Sie Kosten für Agent-Schleifen schätzen.
1M Tokens Kontext mit 384K Output-Limit
Halten Sie zusammengehörige Dateien, Spezifikationen und Agent-State in einem Arbeitskontext, aber betrachten Sie das Limit als Kapazität, nicht als Ziel: Rufen Sie gezielt ab, halten Sie das Präfix stabil, damit es cacht, und setzen Sie pro Aufgabe ein Output-Budget.
DeepSeek V4 Pro mit Qwen 3.8 Max und GLM-5.3 vergleichen
EvoLink
Vergleichen Sie Ein-/Ausgabepreise, Kontext, Caching und geeignete Aufgaben. Testen Sie dieselben Anfragen vor der Routenwahl; unten gelten die aktuellen Kontopreise.
Am besten fürCoding-Agenten, lange Aufgabenketten, toollastige Workflows
Was sollte vor dem Produktiveinsatz von DeepSeek V4 Pro geprüft werden?
Beginnen Sie mit wenigen realen Workloads und prüfen Sie Qualität, Latenz, Kosten und Zuverlässigkeit, bevor weitere Zugriffe umgestellt werden.
Integration und Nutzungsdaten sind nachvollziehbar
Prüfen Sie die Modell-ID deepseek-v4-pro, das gewünschte Protokoll sowie die Rückgabe von Responses-, usage- und Cache-Daten. Klare Nutzungsdaten ermöglichen Kostenanalysen und eine einheitliche Beobachtung von Chat- und Responses-Workflows.
Ergebnisse erfüllen die Geschäftsanforderungen
Testen Sie echte Codeänderungen, Dokumentanalysen, Recherchen oder strukturierte Extraktionen. Neben der Antwortqualität zählen bestandene Tests, verlässliche Quellen, korrekte Funktionsargumente und JSON-Schema-Ausgaben, die nachgelagerte Systeme direkt verarbeiten können.
Latenz und Fehlerbehandlung passen zum Betrieb
Beobachten Sie Antwortzeiten unter typischer Last und definieren Sie Wiederholungen für Limits, Timeouts, ungültige strukturierte Ausgaben und Tool-Fehler. Eine konfigurierbare Modellwahl in EvoLink erleichtert den Wechsel zu einer geprüften Alternative, wenn ein Route vorübergehend ausfällt.
Kosten und Modellwahl bleiben steuerbar
Berechnen Sie mit Pricing, usage und Endbetrag die Gesamtkosten derselben Aufgabenklasse. Entscheiden Sie danach, ob DeepSeek V4 Pro Standardroute, Spezialmodell für schwierige Aufgaben oder Fallback sein soll. Das einheitliche Gateway trennt diese Entscheidung von der technischen Integration.
Starten Sie DeepSeek V4 Pro mit einer kleinen, beobachtbaren und rückgängig zu machenden Aufgabengruppe. Erweitern Sie erst, wenn Qualität, Latenz und Kosten passen. Mehrere Modelle hinter der einheitlichen EvoLink API vereinfachen Skalierung, Wechsel und Kostenoptimierung.
DeepSeek V4-Modellfamilie
Gleicher API-Key, gleiches Guthaben – Stufe wechseln, ohne die Integration zu ändern.
DeepSeek V4.1 Flash
Multimodales Flash-Modell von DeepSeek für Text- und Bild-Workloads
Ist die DeepSeek V4 Pro API bereits über EvoLink verfügbar?
Ja. DeepSeek V4 Pro ist auf der EvoLink-Produktionsroute live und nicht von DeepSeeks Änderung am 14. September betroffen, mit der deepseek-v4-pro in DeepSeeks eigener API an V4.1 Flash weitergeleitet wird. Senden Sie Anfragen mit der Modell-ID deepseek-v4-pro über Chat Completions oder Responses; Modell-ID, Preise, Kontext und unterstützte Workflows finden Sie auf dieser Seite.
Ist deepseek-v4-pro die API-Modell-ID?
Ja. Die in der Anfrage gesendete Modell-ID lautet deepseek-v4-pro — dieselbe Zeichenfolge wie diese Seiten-URL. Seit dem 13. August 2026 liefert diese unveränderte ID automatisch den aktualisierten 0813-GA-Build; für den neuen Build ist kein ID-Wechsel nötig.
Was hat sich im DeepSeek V4 Pro 0813-Build geändert?
Der 0813-GA-Build (veröffentlicht am 13. August 2026) hat die Benchmarks für agentisches Coding und Terminal-Aufgaben gegenüber der April-Preview deutlich verbessert und Unterstützung für die Responses API ergänzt. Die aufrufbare Modell-ID bleibt deepseek-v4-pro. Die alten Aliasse deepseek-chat und deepseek-reasoner wurden am 24. Juli 2026 upstream eingestellt.
Welche Ein- und Ausgaben unterstützt DeepSeek V4 Pro?
Nur Texteingabe und Textausgabe. DeepSeek V4 Pro hat auf keinem Protokoll Vision-Fähigkeiten, die Grenzen unterscheiden sich jedoch je Route: Der Messages-Route lehnt Bild- und Dokument-Inhaltstypen ab; auf Responses werden Bild- und Dateianhänge in Platzhalter umgewandelt statt verstanden. Leiten Sie Screenshot- oder Dokumentverständnis-Aufgaben an ein visionfähiges Modell im selben EvoLink-Gateway.
Wann sollte ich Chat Completions oder die Responses API verwenden?
Chat Completions eignet sich für normale Chats, Streaming und Client-Funktionen. Für längere Agent-Workflows ist die im 0813-Build ergänzte Responses API zu prüfen. Exakte Felder stehen im API-Bereich und in der EvoLink-Dokumentation.
Wie sollte reasoning effort gewählt werden?
Gültige Stufen sind low, high und max, der Standard ist high — medium wird akzeptiert, aber still auf high abgebildet, sodass ein Vergleich von medium und high keinen echten Unterschied zeigt. Beginnen Sie Routineaufgaben mit low, vergleichen Sie low und high an denselben Aufgaben und reservieren Sie max für die schwierigsten Probleme, bei denen ein Fehlversuch mehr kostet als die zusätzlichen Reasoning-Tokens.
Wie beeinflusst Cache-Input den Preis der DeepSeek V4 Pro API?
Cache-Input kann Kosten für wiederholten Kontext senken. Cache-Fehler, lange Ausgaben, Wiederholungen und wiederholte Tool-Schritte erhöhen dennoch den Gesamtbetrag. Nutzen Sie Pricing und die endgültige Anfrageabrechnung für die Kosten pro erfolgreicher Aufgabe.
Welche Rate Limits gelten für DeepSeek V4 Pro?
DeepSeeks V4-Dokumentation beschrieb für die Direkt-API statt RPM- oder TPM-Limits pro Token ein Parallelitätslimit auf Kontoebene — rund 500 gleichzeitige Anfragen für Pro. Darüber hinaus wird 429 zurückgegeben, und Anfragen in der Warteschlange werden nach etwa 10 Minuten getrennt. Diese Zahlen beschreiben DeepSeeks eigene API, nicht die Kapazität der EvoLink-Route. Messen Sie die Limits Ihres EvoLink-Kontos, halten Sie laufende Anfragen darunter und nutzen Sie exponentielles Backoff.
Wie vergleicht man DeepSeek V4 Pro mit GPT, Claude oder Kimi?
Lassen Sie dieselben realen Aufgaben mit gleichem Kontext, Tools und Reasoning ausführen. Ergebnisqualität, Antwortzeit, Token-Mix, Tool-Erfolg und Gesamtkosten zeigen, welcher EvoLink-Route zu welcher Zugriffsklasse passt.
Ist DeepSeek V4 Pro Open Source?
Die Preview-Gewichte vom April stehen unter MIT-Lizenz auf Hugging Face; die Gewichte des 0813-GA-Builds waren am 13. August 2026 noch nicht veröffentlicht. Offene Gewichte und die gehostete API sind unabhängige Zugriffswege — der EvoLink-Route bedient die gehostete API, und dieselben MIT-Gewichte bei Dritthosts sind der Grund, warum ein Fallback über Drittanbieter-Hosting möglich ist.
Gibt es ein Modell DeepSeek V4 Pro Max?
Nein. Es gibt kein separates Modell „Pro Max“ — „max“ ist die höchste Thinking-Stufe auf derselben Modell-ID deepseek-v4-pro. Wenn irgendwo „Pro-Max“ erwähnt wird, ist damit der Betrieb dieses Modells mit maximalem Reasoning-Aufwand gemeint, kein anderes Produkt.
Welches Fallback sollte beim Rollout bestehen bleiben?
Behalten Sie ein Modell, das dieselbe Aufgabe bereits zuverlässig erledigt, und halten Sie die Route konfigurierbar. Bei Limits, Timeouts oder ungültiger Ausgabe kann EvoLink zu GPT, Claude, Kimi oder einer anderen geeigneten Alternative wechseln.