Zum Hauptinhalt springen
POST
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern Bearer-Token-Authentifizierung##

API-Schlüssel erhalten:

Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
erforderlich

Wählen Sie das aufzurufende Gemini-Textmodell aus:

Verfügbare Optionen:
gemini-3.6-flash,
gemini-3.5-flash,
gemini-3.5-flash-lite,
gemini-3.1-pro-preview,
gemini-3.1-pro-preview-customtools,
gemini-3.1-flash-lite-preview,
gemini-3-pro-preview,
gemini-3-flash-preview,
gemini-2.5-pro,
gemini-2.5-flash,
gemini-2.5-flash-lite
Beispiel:

"gemini-3.6-flash"

messages
object[]
erforderlich

Liste der Chat-Nachrichten, unterstützt Mehrrunden-Dialog und multimodale Eingabe

Minimum array length: 1
stream
boolean
Standard:false

Ob die Antwort im Streaming-Modus zurückgegeben werden soll

  • true: Streaming-Rückgabe, empfängt Inhalte in Echtzeit-Blöcken
  • false: Gibt die vollständige Antwort auf einmal zurück
Beispiel:

false

max_completion_tokens
integer | null

Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.

gemini-3.6-flash / gemini-3.5-flash-lite Obergrenze 65,536 Token; bei allen anderen Modellen gelten die jeweiligen Spezifikationen.

Erforderlicher Bereich: 1 <= x <= 65536
Beispiel:

2000

max_tokens
integer

Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.

Erforderlicher Bereich: 1 <= x <= 65536
Beispiel:

2000

temperature
number
Standard:1

Sampling-Temperatur, steuert die Zufälligkeit der Ausgabe

Beschreibung:

  • Niedrigere Werte (z. B. 0.2): Deterministischere, fokussiertere Ausgabe
  • Höhere Werte (z. B. 1.5): Zufälligere, kreativere Ausgabe

⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich (nicht modellabhängig): Benutzerdefinierte Werte innerhalb des gültigen Bereichs beeinflussen die Ausgabe nicht; Werte außerhalb des gültigen Bereichs dieses Parameters geben einen 400 zurück, statt still ignoriert zu werden.

Erforderlicher Bereich: 0 <= x <= 2
Beispiel:

0.7

top_p
number
Standard:0.95

Nucleus-Sampling-Parameter

Beschreibung:

  • Steuert das Sampling aus den Token mit der höchsten kumulativen Wahrscheinlichkeit
  • Zum Beispiel bedeutet 0.9, dass aus Token mit einer kumulativen Wahrscheinlichkeit von bis zu 90% ausgewählt wird
  • Standardwert: 0.95

Empfehlung: Passen Sie temperature und top_p nicht gleichzeitig an

⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich (nicht modellabhängig): Benutzerdefinierte Werte innerhalb des gültigen Bereichs beeinflussen die Ausgabe nicht; Werte außerhalb des gültigen Bereichs dieses Parameters geben einen 400 zurück, statt still ignoriert zu werden.

Erforderlicher Bereich: 0 <= x <= 1
Beispiel:

0.9

frequency_penalty
number | null
Standard:0

Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.

⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich: Übergebene Werte werden vom Gateway gefiltert und haben keine Wirkung (ohne Fehler).

Erforderlicher Bereich: -2 <= x <= 2
Beispiel:

0

presence_penalty
number | null
Standard:0

Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.

⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich: Übergebene Werte werden vom Gateway gefiltert und haben keine Wirkung (ohne Fehler).

Erforderlicher Bereich: -2 <= x <= 2
Beispiel:

0

stop

Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.

n
integer | null
Standard:1

Anzahl der zu generierenden Kandidaten

⚠️ Gemini 3.x unterstützt nur 1; das Übergeben von >1 gibt einen 400 zurück (entspricht dem in der nativen API bereits entfernten candidateCount).

Erforderlicher Bereich: 1 <= x <= 1
Beispiel:

1

reasoning_effort
enum<string> | null

Begrenzt den Denkaufwand, entspricht der Denkebene von Gemini:

  • minimal: nahezu kein Denken, hoher Durchsatz / geringe Latenz
  • low: weniger Denken, einfache Aufgaben
  • medium: ausgewogenes Verhältnis von Qualität und Geschwindigkeit
  • high: tiefes mehrstufiges Reasoning

Wirkt nur bei der Gemini-3.x-Serie, die unterstützten Stufen und Standardwerte unterscheiden sich je nach Modell (identisch mit der nativen API):

Verfügbare Optionen:
minimal,
low,
medium,
high
Beispiel:

"minimal"

seed
integer | null

Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.

Beispiel:

12345

response_format
object

Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.

stream_options
object | null

Streaming response options. Can be set when stream is true.

tools
object[] | null

List of tool definitions for Function Calling.

tool_choice

Controls tool-calling behavior.

Verfügbare Optionen:
none,
auto,
required
extra_body
object | null

Gemini extension parameters.

Antwort

Chat-Vervollständigung erfolgreich generiert

id
string

Eindeutiger Bezeichner für die Chat-Vervollständigung

Beispiel:

"chatcmpl-20251010015944503180122WJNB8Eid"

model
string

Tatsächlich verwendeter Modellname

Beispiel:

"gemini-3.6-flash"

object
enum<string>

Antworttyp

Verfügbare Optionen:
chat.completion
Beispiel:

"chat.completion"

created
integer

Erstellungszeitstempel

Beispiel:

1760032810

choices
object[]

Liste der Chat-Vervollständigungsoptionen

usage
object

Token-Nutzungsstatistiken