Skip to main content
POST
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern Bearer-Token-Authentifizierung##

API-Schlüssel erhalten:

Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
Standard:deepseek-v4-flash
erforderlich

Modell-ID

  • deepseek-v4-flash: schnell und universell, geeignet für alltägliche Dialoge, Zusammenfassungen und Extraktion
  • deepseek-v4-pro: tiefes Schlussfolgern, geeignet für komplexe Mathematik, Code und mehrstufige Planung
Verfügbare Optionen:
deepseek-v4-flash,
deepseek-v4-pro
Beispiel:

"deepseek-v4-flash"

input

Eingabe für das Modell. Mindestens eines von input und instructions muss angegeben werden.

  • String-Form: Der gesamte Text wird als eine einzelne user-Nachricht behandelt
  • Array-Form: Liste von Eingabeelementen mit den fünf Typen message, function_call, function_call_output, reasoning und web_search_call

Mehrstufige Unterhaltungen: Der Endpunkt ist zustandslos, daher muss zum Fortsetzen einer Unterhaltung der vollständige Verlauf im Array enthalten sein.

Beispiel:

"Stelle Hangzhou in einem Satz vor."

instructions
string

Anweisungen auf Systemebene, gleichbedeutend mit einer ganz vorne eingefügten system-Nachricht; dient zum Festlegen von Rolle, Tonfall und Ausgabevorgaben.

Beispiel:

"Du bist ein sorgfältiger technischer Redakteur. Halte die Antworten knapp."

stream
boolean
Standard:false

Ob die Antwort gestreamt wird

  • false (Standard): gibt das vollständige Antwortobjekt auf einmal zurück
  • true: sendet semantische SSE-Ereignisse; das letzte Ereignis ist response.completed / response.incomplete / response.failed, und [DONE] wird nicht gesendet
Beispiel:

false

max_output_tokens
integer

Maximale Anzahl an Ausgabetokens für diese Generierung (einschließlich Denktokens). Bereich 1 bis 393216 (384K). Ohne Angabe entscheidet das Modell selbst.

Erforderlicher Bereich: 1 <= x <= 393216
Beispiel:

4096

temperature
number
Standard:1

Sampling-Temperatur; höhere Werte machen die Ausgabe zufälliger. Im Denkmodus ohne Wirkung.

Erforderlicher Bereich: 0 <= x <= 2
Beispiel:

1

top_p
number
Standard:1

Schwellenwert für Nucleus-Sampling; es wird empfohlen, nur diesen oder temperature anzupassen. Im Denkmodus ohne Wirkung.

Erforderlicher Bereich: x <= 1
Beispiel:

1

top_logprobs
integer

Gibt an jeder Position die wahrscheinlichsten Kandidaten-Tokens samt ihrer logarithmischen Wahrscheinlichkeiten zurück.

Erforderlicher Bereich: 0 <= x <= 20
Beispiel:

0

reasoning
object

Konfiguration des Denkmodus. DeepSeek V4 aktiviert das Denken standardmäßig; der Denkinhalt wird als Ausgabeelement reasoning zurückgegeben und seine Tokens zählen zur Ausgabe und werden zum Ausgabepreis abgerechnet.

text
object

Konfiguration des Textausgabeformats.

tools
Werkzeugdefinition · object[]

Liste der Werkzeuge, die das Modell aufrufen kann. Funktionswerkzeuge werden vom Client ausgeführt, der das Ergebnis als function_call_output zurückgibt; web_search wird direkt serverseitig ausgeführt, ohne Beteiligung des Clients.

tool_choice

Strategie für Werkzeugaufrufe

  • none: Werkzeugaufrufe verboten
  • auto (Standard): das Modell entscheidet
  • required: mindestens ein Werkzeug muss aufgerufen werden
  • {"type": "function", "name": "get_weather"}: erzwingt den Aufruf einer bestimmten Funktion
  • {"type": "web_search"}: erzwingt eine Websuche
Beispiel:

"auto"

Antwort

Generierung erfolgreich

Antwortobjekt des Responses-Endpunkts.

id
string

Eindeutige Kennung dieser Antwort

Beispiel:

"resp_9f2c1a4b8e7d"

object
string

Objekttyp, stets response

Beispiel:

"response"

created_at
integer

Erstellungszeit als Unix-Zeitstempel (Sekunden)

Beispiel:

1755000000

status
enum<string>

Status der Antwort

  • completed: normal abgeschlossen
  • in_progress: wird noch generiert
  • incomplete: z. B. wegen der Länge gekürzt, siehe incomplete_details
  • failed: Generierung fehlgeschlagen, siehe error
Verfügbare Optionen:
in_progress,
completed,
incomplete,
failed
Beispiel:

"completed"

model
string

ID des Modells, das diese Antwort tatsächlich erzeugt hat

Beispiel:

"deepseek-v4-flash"

output
object[]

Liste der Ausgabeelemente in Generierungsreihenfolge. Felder je Typ:

  • reasoning: der Denkvorgang, mit id, status, content (Liste von reasoning_text-Blöcken) und summary
  • message: die endgültige Antwort, mit id, status, role und content (Liste von output_text-Blöcken)
  • function_call: ein Funktionsaufruf des Modells, mit id, status, call_id, name und arguments; der Client führt ihn aus und gibt das Ergebnis als function_call_output zurück
  • web_search_call: ein serverseitig ausgeführtes Websuchprotokoll, mit id, status und action (beschreibt die durchgeführte Suche)
error
object | null

Fehlerursache; bei Erfolg null

incomplete_details
object | null

Grund der Kürzung; ohne Kürzung null

usage
object

Statistik zur Tokennutzung (einschließlich Cache- und Denkanteilen)