Google 原生 API 格式
Gemini 全模型接口 - 原生 API 格式
通过路径中的 {model} 选择要调用的 Gemini 文本模型(全部可选值见 model 参数的对照表)。
- 使用 Google 原生 API 格式,同步返回对话内容
- 纯文本 / 多模态输入:文本 + 图像 / 音频 / 视频混合输入
- 流式:将路径中的
generateContent替换为streamGenerateContent(可追加?alt=sse获取 SSE)
模型规格与差异
- 采样参数
temperature/topP/topK:Gemini 3.x 全系一致,自定义值不影响输出;topK被网关直接丢弃(不下发上游),temperature/topP超出合法范围会返回 400。 - 思考控制:Gemini 3.x 系列用
thinkingConfig.thinkingLevel(各模型支持档位与默认见thinkingLevel参数);Gemini 2.5 系列用thinkingConfig.thinkingBudget(整数,0=关闭)。二者互斥。 - 函数调用:Gemini 3.x 的
FunctionResponse必须回传与对应FunctionCall匹配的id和name,否则报错。 - 末轮角色:最后一条消息的
role不能为model(Gemini 3.5+ 会报错)。 - Token 上限:
gemini-3.6-flash/gemini-3.5-flash-lite上下文 1,048,576、最大输出 65,536;其余模型以各自规格为准。
POST
BaseURL 说明:默认 BaseURL 为
https://direct.evolink.ai,对文本模型支持更好、支持长连接;https://api.evolink.ai 为备用地址。授权
路径参数
选择要调用的 Gemini 文本模型:
可用选项:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite 示例:
"gemini-3.6-flash"
请求体
application/json
响应
内容生成成功
响应格式说明:
- 使用
generateContent端点时,返回GenerateContentResponse(等待完整响应后一次性返回) - 使用
streamGenerateContent端点时,返回StreamGenerateContentResponse(流式响应,逐块返回内容)