Gemini Schnittstelle für alle Modelle - OpenAI-kompatibles Format
Wählen Sie über model im Anfragekörper das aufzurufende Gemini-Textmodell aus (alle möglichen Werte finden Sie in der Vergleichstabelle des Parameters model).
- Verwendet das OpenAI-SDK-/Chat-Completions-Format und gibt Gesprächsinhalte synchron zurück
- Reiner Text / multimodale Eingabe: gemischte Eingabe aus Text + Bild (
messages[].content) - Streaming: Setzen Sie
stream: true, um blockweise zurückzugeben
Modellspezifikationen und Unterschiede
- Sampling- / Straf-Parameter
temperature/top_p/frequency_penalty/presence_penalty: Bei der gesamten Gemini-3.x-Serie einheitlich, benutzerdefinierte Werte beeinflussen die Ausgabe nicht;temperature/top_paußerhalb des Bereichs geben einen 400 zurück,frequency_penalty/presence_penaltywerden vom Gateway gefiltert (ohne Fehler). - Denksteuerung
reasoning_effort:minimal/low/medium/high(die von jedem Modell unterstützten Stufen und Standardwerte siehe Parameterreasoning_effort); wirkt nur bei der Gemini-3.x-Serie. - Rolle der letzten Runde: Die
roleder letzten Nachricht darf nichtassistantsein (Gemini 3.5+ gibt sonst einen Fehler zurück). - Token-Obergrenze:
gemini-3.6-flash/gemini-3.5-flash-liteKontext 1,048,576, maximale Ausgabe 65,536; bei allen anderen Modellen gelten die jeweiligen Spezifikationen.
https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.Autorisierungen
##Alle APIs erfordern Bearer-Token-Authentifizierung##
API-Schlüssel erhalten:
Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten
Zum Anfrage-Header hinzufügen:
Body
Wählen Sie das aufzurufende Gemini-Textmodell aus:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
Liste der Chat-Nachrichten, unterstützt Mehrrunden-Dialog und multimodale Eingabe
1Ob die Antwort im Streaming-Modus zurückgegeben werden soll
true: Streaming-Rückgabe, empfängt Inhalte in Echtzeit-Blöckenfalse: Gibt die vollständige Antwort auf einmal zurück
false
Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.
gemini-3.6-flash / gemini-3.5-flash-lite Obergrenze 65,536 Token; bei allen anderen Modellen gelten die jeweiligen Spezifikationen.
1 <= x <= 655362000
Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.
1 <= x <= 655362000
Sampling-Temperatur, steuert die Zufälligkeit der Ausgabe
Beschreibung:
- Niedrigere Werte (z. B. 0.2): Deterministischere, fokussiertere Ausgabe
- Höhere Werte (z. B. 1.5): Zufälligere, kreativere Ausgabe
⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich (nicht modellabhängig): Benutzerdefinierte Werte innerhalb des gültigen Bereichs beeinflussen die Ausgabe nicht; Werte außerhalb des gültigen Bereichs dieses Parameters geben einen 400 zurück, statt still ignoriert zu werden.
0 <= x <= 20.7
Nucleus-Sampling-Parameter
Beschreibung:
- Steuert das Sampling aus den Token mit der höchsten kumulativen Wahrscheinlichkeit
- Zum Beispiel bedeutet 0.9, dass aus Token mit einer kumulativen Wahrscheinlichkeit von bis zu 90% ausgewählt wird
- Standardwert: 0.95
Empfehlung: Passen Sie temperature und top_p nicht gleichzeitig an
⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich (nicht modellabhängig): Benutzerdefinierte Werte innerhalb des gültigen Bereichs beeinflussen die Ausgabe nicht; Werte außerhalb des gültigen Bereichs dieses Parameters geben einen 400 zurück, statt still ignoriert zu werden.
0 <= x <= 10.9
Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.
⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich: Übergebene Werte werden vom Gateway gefiltert und haben keine Wirkung (ohne Fehler).
-2 <= x <= 20
Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.
⚠️ Bei der gesamten Gemini-3.x-Serie einheitlich: Übergebene Werte werden vom Gateway gefiltert und haben keine Wirkung (ohne Fehler).
-2 <= x <= 20
Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.
Anzahl der zu generierenden Kandidaten
⚠️ Gemini 3.x unterstützt nur 1; das Übergeben von >1 gibt einen 400 zurück (entspricht dem in der nativen API bereits entfernten candidateCount).
1 <= x <= 11
Begrenzt den Denkaufwand, entspricht der Denkebene von Gemini:
minimal: nahezu kein Denken, hoher Durchsatz / geringe Latenzlow: weniger Denken, einfache Aufgabenmedium: ausgewogenes Verhältnis von Qualität und Geschwindigkeithigh: tiefes mehrstufiges Reasoning
Wirkt nur bei der Gemini-3.x-Serie, die unterstützten Stufen und Standardwerte unterscheiden sich je nach Modell (identisch mit der nativen API):
minimal, low, medium, high "minimal"
Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.
12345
Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.
- Option 1
- Option 2
Streaming response options. Can be set when stream is true.
List of tool definitions for Function Calling.
Controls tool-calling behavior.
none, auto, required Gemini extension parameters.
Antwort
Chat-Vervollständigung erfolgreich generiert
Eindeutiger Bezeichner für die Chat-Vervollständigung
"chatcmpl-20251010015944503180122WJNB8Eid"
Tatsächlich verwendeter Modellname
"gemini-3.6-flash"
Antworttyp
chat.completion "chat.completion"
Erstellungszeitstempel
1760032810
Liste der Chat-Vervollständigungsoptionen
Token-Nutzungsstatistiken