Gemini 全モデルインターフェース - OpenAI 互換形式
リクエストボディ内の model で呼び出す Gemini テキストモデルを選択します(すべての選択可能な値は model パラメータの対照表を参照してください)。
- OpenAI SDK / Chat Completions 形式を使用し、会話内容を同期的に返却します
- プレーンテキスト / マルチモーダル入力:テキスト + 画像の混合入力(
messages[].content) - ストリーミング:
stream: trueを設定するとチャンクごとに返却します
モデルの仕様と差異
- サンプリング / ペナルティパラメータ
temperature/top_p/frequency_penalty/presence_penalty:Gemini 3.x 全シリーズ共通で、カスタム値は出力に影響しません。temperature/top_pが範囲を超えると 400 が返り、frequency_penalty/presence_penaltyはゲートウェイでフィルタされます(エラーにはなりません)。 - 思考制御
reasoning_effort:minimal/low/medium/high(各モデルが対応する段階とデフォルトはreasoning_effortパラメータを参照)。Gemini 3.x シリーズのみ有効です。 - 最終ターンのロール:最後のメッセージの
roleをassistantにすることはできません(Gemini 3.5+ ではエラーになります)。 - Token 上限:
gemini-3.6-flash/gemini-3.5-flash-liteはコンテキスト 1,048,576、最大出力 65,536。その他のモデルは各自の仕様に準じます。
https://direct.evolink.ai で、テキストモデルへの対応が優れており、長時間接続をサポートします。https://api.evolink.ai はマルチモーダルの主力エンドポイントで、テキストモデルに対しては代替アドレスとして使用されます。承認
ボディ
呼び出す Gemini テキストモデルを選択します:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
チャットメッセージのリスト、マルチターン対話とマルチモーダル入力をサポート
1ストリーミングモードでレスポンスを返すかどうか
true: ストリーミング返却、リアルタイムでチャンク単位にコンテンツを受信false: 完全なレスポンスを一括で返却
false
Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.
gemini-3.6-flash / gemini-3.5-flash-lite は上限 65,536 tokens。その他のモデルは各自の仕様に準じます。
1 <= x <= 655362000
Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.
1 <= x <= 655362000
サンプリング温度、出力のランダム性を制御
説明:
- 低い値(例: 0.2): より決定論的で集中した出力
- 高い値(例: 1.5): よりランダムで創造的な出力
⚠️ Gemini 3.x 全シリーズ共通(モデルによって異なりません):正当な範囲内のカスタム値は出力に影響しません。このパラメータの正当な範囲を超えると、静かに無視されるのではなく 400 が返ります。
0 <= x <= 20.7
核サンプリング(Nucleus Sampling)パラメータ
説明:
- 累積確率が上位どこまでのトークンからサンプリングするかを制御します
- 例えば 0.9 は累積確率が90%に達するまでのトークンから選択することを意味します
- デフォルト値: 0.95
推奨: temperature と top_p を同時に調整しないでください
⚠️ Gemini 3.x 全シリーズ共通(モデルによって異なりません):正当な範囲内のカスタム値は出力に影響しません。このパラメータの正当な範囲を超えると、静かに無視されるのではなく 400 が返ります。
0 <= x <= 10.9
Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.
⚠️ Gemini 3.x 全シリーズ共通:指定してもゲートウェイでフィルタされ、有効になりません(エラーにはなりません)。
-2 <= x <= 20
Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.
⚠️ Gemini 3.x 全シリーズ共通:指定してもゲートウェイでフィルタされ、有効になりません(エラーにはなりません)。
-2 <= x <= 20
Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.
生成する候補の数
⚠️ Gemini 3.x は 1 のみサポートします。>1 を指定すると 400 が返ります(native で既に削除された candidateCount に相当します)。
1 <= x <= 11
思考の作業量を制限します。Gemini の思考レベルに対応します:
minimal:思考をほとんど行わず、高スループット / 低レイテンシlow:思考は少なめで、単純なタスク向けmedium:品質と速度のバランスhigh:深いマルチステップ推論
Gemini 3.x シリーズのみ有効で、各モデルが対応する段階とデフォルトは異なります(ネイティブと同じ):
minimal, low, medium, high "minimal"
Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.
12345
Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.
- Option 1
- Option 2
Streaming response options. Can be set when stream is true.
List of tool definitions for Function Calling.
Controls tool-calling behavior.
none, auto, required Gemini extension parameters.