Google Native API Format
Gemini 全モデルインターフェース - ネイティブ API 形式
パス内の {model} で呼び出す Gemini テキストモデルを選択します(すべての選択可能な値は model パラメータの対照表を参照してください)。
- Google ネイティブ API 形式を使用し、会話内容を同期的に返却します
- プレーンテキスト / マルチモーダル入力:テキスト + 画像 / 音声 / 動画の混合入力
- ストリーミング:パス内の
generateContentをstreamGenerateContentに置き換えます(?alt=sseを追加して SSE を取得できます)
モデルの仕様と差異
- サンプリングパラメータ
temperature/topP/topK:Gemini 3.x 全シリーズ共通で、カスタム値は出力に影響しません。topKはゲートウェイで直接破棄され(上流には送信されません)、temperature/topPが正当な範囲を超えると 400 が返ります。 - 思考制御:Gemini 3.x シリーズでは
thinkingConfig.thinkingLevel(各モデルが対応する段階とデフォルトはthinkingLevelパラメータを参照)を使用します。Gemini 2.5 シリーズではthinkingConfig.thinkingBudget(整数、0=無効)を使用します。両者は排他的です。 - 関数呼び出し:Gemini 3.x の
FunctionResponseでは、対応するFunctionCallと一致するidとnameを必ず返す必要があります。そうでない場合はエラーになります。 - 最終ターンのロール:最後のメッセージの
roleをmodelにすることはできません(Gemini 3.5+ ではエラーになります)。 - Token 上限:
gemini-3.6-flash/gemini-3.5-flash-liteはコンテキスト 1,048,576、最大出力 65,536。その他のモデルは各自の仕様に準じます。
POST
BaseURL:デフォルトの BaseURL は
https://direct.evolink.ai で、テキストモデルへの対応が優れており、長時間接続をサポートします。https://api.evolink.ai はマルチモーダルの主力エンドポイントで、テキストモデルに対しては代替アドレスとして使用されます。承認
パスパラメータ
呼び出す Gemini テキストモデルを選択します:
利用可能なオプション:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite 例:
"gemini-3.6-flash"
ボディ
application/json
List of conversation contents, supports multi-turn dialogue and multimodal input
Minimum array length:
1Generation configuration parameters (optional)
System instruction (optional), mainly text content
List of tools the model can call, such as function calling or code execution
Tool calling configuration (optional)
Safety settings list (optional)
Cached content name, in the form cachedContents/{cachedContent}
レスポンス
コンテンツが正常に生成されました
レスポンス形式の説明:
generateContentエンドポイント使用時、GenerateContentResponseを返却(完全なレスポンスを一度に返却)streamGenerateContentエンドポイント使用時、StreamGenerateContentResponseを返却(ストリーミングレスポンス、コンテンツをチャンクで返却)