Seedance 2.5 ist jetzt auf EvoLink verfügbarSeedance 2.5 testen
DeepSeek-V4-Pro-Agent-Workflow mit Code-Dateien, Tools, Validierung und Fallback-Routen
Produktlaunch

DeepSeek V4 Pro 0813 ist live: Änderungen für Agents und Codex

Jessie
Jessie
COO
6. April 2026
Aktualisiert am 13. August 2026
7 Min. Lesezeit
Aktualisiert am 13. August 2026
Dieser Release-Watch wurde für das API-Update DeepSeek-V4-Pro-0813 überarbeitet. Der aufrufbare Name bleibt deepseek-v4-pro; entscheidend sind die neue Version, die Agent-Integration sowie native Responses-API- und Codex-Unterstützung.
Die offizielle DeepSeek-V4-Pro-API stellt jetzt DeepSeek-V4-Pro-0813 unter dem unveränderten Modellnamen deepseek-v4-pro bereit. Teams müssen keinen datierten Modellnamen erfinden oder ihre Auswahl-Logik umbauen. Da sich der Build hinter dem stabilen Alias geändert hat, sollten sie jedoch Agent-Erfolg, Tool-Aufrufe, Latenz, Token-Verbrauch und Fallbacks neu testen.
DeepSeek dokumentiert außerdem native Responses API-Unterstützung für V4 Flash und V4 Pro sowie einen direkten Codex-Konfigurationsweg. Damit entfällt bei der offiziellen Route der frühere Responses-zu-Chat-Completions-Proxy.
EvoLink-Nutzer sollten ihre aktuelle Modellroute stabil halten, Pro und Flash mit denselben Aufgaben vergleichen und jede Produktionsoberfläche separat verifizieren. Die Upstream-Unterstützung beweist nicht automatisch, dass jedes Gateway denselben Endpoint anbietet. Aktuelle EvoLink-Routen und Preise stehen auf der DeepSeek-V4-Modellseite.

Kurzantwort: Was ändert sich mit DeepSeek V4 Pro 0813?

FrageVerifizierte Antwort am 13. August 2026
Bereitgestellte VersionDeepSeek-V4-Pro-0813
Aufrufbarer ModellnameUnverändert: deepseek-v4-pro
Responses APIFür deepseek-v4-flash und deepseek-v4-pro dokumentiert
Direkte Codex-NutzungJa, über DeepSeeks native Responses-Konfiguration
Kontext und maximale Ausgabe1M Token Kontext, bis zu 384K Ausgabe
Erforderliche WiederholungstestsAgent-Erfolg, Tools, Streaming, Token, Latenz, Fehler und Fallbacks

Stabiler Alias und datierter Build haben verschiedene Aufgaben

  • DeepSeek-V4-Pro-0813 bezeichnet die dokumentierte Version.
  • deepseek-v4-pro ist der offizielle aufrufbare API-Name.
Ersetzen Sie ihn nicht durch einen geratenen Wert wie deepseek-v4-pro-0813. Datierte IDs anderer Anbieter oder Aggregatoren sind nicht automatisch offizielle DeepSeek-Aliase.

Der stabile Name reduziert Migrationsaufwand, macht aber protokollierte Evaluationsdaten wichtiger. Ein Anbieter-Update kann Qualität, Tool-Verhalten, Latenz und Token-Nutzung verändern, ohne dass sich Anwendungscode ändert.

Warum Responses API und Codex den Agent-Workflow verändern

Codex spricht mit benutzerdefinierten Modellanbietern über eine Responses-Schnittstelle. Vor der nativen Unterstützung brauchten viele DeepSeek-V4-Setups eine Übersetzungsschicht zu Chat Completions. DeepSeek dokumentiert jetzt https://api.deepseek.com als Base URL und eine gemeinsame Konfiguration für Codex CLI, die ChatGPT-Desktop-App und die Codex-Erweiterung für VS Code.

„Responses-kompatibel“ bedeutet jedoch keine vollständige Funktionsparität:

FunktionStatusBedeutung für die Produktion
Text, Instructions, StreamingUnterstütztGeeignet für textbasierte Coding-Sessions
Function Tools und serverseitige WebsucheUnterstütztTool-Schemas und Rückgabe mit echten Aufgaben testen
Custom Tool apply_patchUnterstütztDeckt einen zentralen Codex-Dateiworkflow ab
Reasoning EffortUnterstütztQualität, Latenz und Kosten je Stufe neu messen
Bild- und DateieingabenNicht unterstütztMultimodale Aufgaben vorher aufbereiten
file_search, code_interpreter, computer_use, MCPWerden ignoriertKeine Tool-Parität aus dem Protokollnamen ableiten
previous_response_id, Conversation, StoreNicht unterstütztClient muss den nötigen Kontext verwalten
Background und Service TierNicht unterstütztLange Abläufe brauchen eigene Orchestrierung und Retries

Nicht unterstützte Parameter können still ignoriert werden. Ein erfolgreicher HTTP-Status reicht deshalb nicht als Integrationstest; jede benötigte Agent-Funktion muss beobachtbar wirken.

DeepSeek-V4-Migrationsworkflow mit gestufter Evaluation, Modellrouting und Fallback-Pfaden
DeepSeek-V4-Migrationsworkflow mit gestufter Evaluation, Modellrouting und Fallback-Pfaden

Aktuelle Anbieterpreise sind niedriger, aber nicht dauerhaft zugesagt

DeepSeek listet derzeit folgende Direktpreise pro 1 Mio. Token:

ModellCache-Hit-EingabeCache-Miss-EingabeAusgabe
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87
Das sind DeepSeeks direkte API-Preise, gültig bis 16. August 2026, 16:00 UTC, nicht die EvoLink-Abrechnung. DeepSeek hat den ab diesem Zeitpunkt geltenden neuen Preisplan bereits veröffentlicht: duale Peak-/Off-Peak-Tarife (Peak 01:00–04:00 und 06:00–10:00 UTC; Off-Peak liegt bei 50% des Peak-Preises), mit Pro bei $0.66 Cache-Miss-Eingabe / $1.98 Ausgabe pro 1M Token im Off-Peak ($1.32 / $3.96 im Peak) und einem Cache-Hit-Preis von etwa 1/30 des Cache-Miss-Preises. Nutzen Sie für EvoLink die gemeinsame Preisfläche auf der DeepSeek-V4-Pro-Modellseite, statt Upstream-Preise in Produktionsbudgets zu kopieren.
Bei Agents zählt der Preis pro erfolgreicher Aufgabe einschließlich Reasoning-Tokens, wiederholtem Kontext, Tool-Schleifen, Retries und Fehlversuchen.

Was Produktionsteams jetzt neu testen sollten

PhaseTestFreigabekriterium
1. IdentitätAlias, Evaluationsdatum, Endpoint und Route protokollierenKeine geratene datierte ID im Code
2. Offline-EvalRepository-Analyse, Debugging, Refactoring und ToolsKeine kritische Regression
3. Protokoll-EvalStreaming, Functions, Websuche, apply_patch, ignorierte FelderBenötigte Tools laufen zuverlässig
4. Kosten-EvalEingabe, Cache, Reasoning, Ausgabe, Retries, ErfolgskostenBudgetgrenze wird eingehalten
5. CanaryBegrenzter Pro-Traffic mit FallbackFehler und Latenz erfüllen SLOs
6. RolloutNach Workload ausweitenRollback bleibt verfügbar
Pro eignet sich zuerst für Repository-Debugging, Architekturänderungen, langfristiges Refactoring und tool-intensive Analysen. Flash bleibt die günstigere Route für Standardtransformationen, Zusammenfassungen, Testgenerierung und hohes Volumen. Mehr dazu im Flash-vs-Pro-Review.

EvoLink macht aus dem Upstream-Release keine pauschale Migrationsempfehlung, sondern ermöglicht Vergleich und Routing unter einem API- und Abrechnungsprozess.

  1. Prüfen Sie aktuelle Endpoints, Modelle und Preise auf der DeepSeek-V4-Modellseite.
  2. Evaluieren Sie Pro und Flash mit demselben Aufgabensatz.
  3. Behalten Sie einen verifizierten Fallback für qualitäts- oder toolkritische Workloads.
  4. Nehmen Sie keine EvoLink-Responses-Verfügbarkeit an, bevor der genaue Endpoint dokumentiert und getestet ist.
  5. Verwenden Sie den DeepSeek-Status- und Fallback-Leitfaden für die Produktionsrichtlinie.

So bleibt der Nutzen eines einheitlichen Gateways erhalten: Modelle ändern sich, aber Evaluation, Observability, Abrechnung und Fallback-Prozess bleiben konsistent.

Was noch nicht verifiziert ist

Offiziell bestätigt sind Version, Alias, Kontext, Ausgabelimit, aktuelle Preise, Responses-Kompatibilität und Codex-Konfiguration. Nicht belegt ist, dass 0813 in jeder Coding-Aufgabe gewinnt oder ohne eigene Tests einen Premium-Fallback ersetzen kann.

Dieser Artikel behauptet deshalb keinen Benchmark-Sieg, keine erfundene prozentuale Verbesserung gegenüber der Preview und keinen unverifizierten EvoLink-/v1/responses-Aufruf.

FAQ

Ist DeepSeek V4 Pro 0813 ein neuer API-Modellname?

Nein. DeepSeek-V4-Pro-0813 ist die Version; der aufrufbare Name bleibt deepseek-v4-pro.

Müssen bestehende Requests geändert werden?

Der Modellparameter bleibt gleich. Regressionstests sind trotzdem nötig, weil sich der Build hinter dem Alias geändert hat.

Unterstützt V4 Pro die Responses API?

Ja. DeepSeek listet V4 Pro und Flash in der offiziellen Modell- und Responses-Dokumentation.

Kann Codex ohne den alten Übersetzungsproxy verbinden?

Für die offizielle DeepSeek-Route ja. Andere Gateways müssen ihren Responses-Endpoint separat dokumentieren und verifizieren.

Gilt eine Konfiguration für CLI, Desktop und VS Code?

Laut DeepSeek teilen diese Codex-Clients dieselbe Konfigurationsdatei.

Welche Tools werden unterstützt?

Function Tools, serverseitige Websuche und apply_patch. MCP, Computer Use, File Search, Code Interpreter und andere Custom Tools werden nicht unterstützt.

Werden Bilder und Dateien unterstützt?

Nein. Text wird unterstützt; Bildteile können durch Platzhaltertext ersetzt werden.

Ist die Responses API zustandsbehaftet?

Nein. Conversation, Store, Background und previous_response_id werden nicht unterstützt; der Client verwaltet den Kontext.

Wo sind die Benchmarks für DeepSeek V4 Pro 0813?

Offizielle Kanäle nennen für den 0813-Build große Zugewinne bei agentenorientierten Benchmark-Suiten (Terminal-Bench 2.1, DeepSWE, CyberGym), doch bis zum 13. August 2026 hat DeepSeek keine formale Benchmark-Tabelle für 0813 veröffentlicht, und aggregierte Drittanbieter-Scores spiegeln weiterhin überwiegend den Preview-Build wider. Behandeln Sie kursierende 0813-Zahlen als vorläufig, prüfen Sie ihre Quellen und stützen Sie sich auf die Auswertung Ihrer eigenen Workloads, bevor Sie Produktionsverkehr umleiten.

Hat sich der Preis geändert?

Aktuell listet DeepSeek $0.003625 für Cache-Hit-Eingabe, $0.435 für Cache-Miss-Eingabe und $0.87 für Ausgabe je 1 Mio. Token — gültig bis 16. August 2026, 16:00 UTC. Dann tritt die bereits veröffentlichte Peak-/Off-Peak-Neubepreisung in Kraft (Pro im Off-Peak: $0.022 / $0.66 / $1.98; Peak ist 2×). Prüfen Sie vor der Budgetplanung die aktuelle Preisseite; EvoLink-Preise werden separat auf der Modellseite gepflegt.

Quellen

DeepSeek V4 Pro mit eigenen Workloads evaluieren

Vergleichen Sie Pro und Flash auf der DeepSeek-V4-Modellseite und messen Sie Aufgabenerfolg, Tool-Zuverlässigkeit, Latenz, Retries und Kosten pro erfolgreicher Aufgabe, bevor Sie den Produktionstraffic erhöhen.

Bereit, Ihre KI-Kosten um 89 % zu senken?

Starten Sie noch heute mit EvoLink und erleben Sie die Vorteile intelligenter API-Routing.