Gemini 全模型接口 - OpenAI 兼容格式
通过请求体中的 model 选择要调用的 Gemini 文本模型(全部可选值见 model 参数的对照表)。
- 使用 OpenAI SDK / Chat Completions 格式,同步返回对话内容
- 纯文本 / 多模态输入:文本 + 图像混合输入(
messages[].content) - 流式:设置
stream: true逐块返回
模型规格与差异
- 采样 / 惩罚参数
temperature/top_p/frequency_penalty/presence_penalty:Gemini 3.x 全系一致,自定义值不影响输出;temperature/top_p超范围返回 400,frequency_penalty/presence_penalty被网关过滤(不报错)。 - 思考控制
reasoning_effort:minimal/low/medium/high(各模型支持档位与默认见reasoning_effort参数);仅 Gemini 3.x 系列生效。 - 末轮角色:最后一条消息的
role不能为assistant(Gemini 3.5+ 会报错)。 - Token 上限:
gemini-3.6-flash/gemini-3.5-flash-lite上下文 1,048,576、最大输出 65,536;其余模型以各自规格为准。
https://direct.evolink.ai,对文本模型支持更好、支持长连接;https://api.evolink.ai 为备用地址。授权
请求体
选择要调用的 Gemini 文本模型:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
对话消息列表,支持多轮对话和多模态输入
1是否以流式方式返回响应
true: 流式返回,逐块实时返回内容false: 等待完整响应后一次性返回
false
生成回复的最大 completion token 数量,对应 Gemini 的 maxOutputTokens。
gemini-3.6-flash / gemini-3.5-flash-lite 上限 65,536 tokens;其余模型以各自规格为准。
1 <= x <= 655362000
生成回复的最大 token 数量,兼容旧版 OpenAI 参数。
1 <= x <= 655362000
采样温度,控制输出的随机性
说明:
- 较低值(如 0.2): 更确定、更聚焦的输出
- 较高值(如 1.5): 更随机、更有创意的输出
⚠️ Gemini 3.x 全系一致(不因模型而异):合法范围内的自定义值不影响输出;超出该参数合法范围会返回 400,而非静默忽略。
0 <= x <= 20.7
核采样(Nucleus Sampling)参数
说明:
- 控制从累积概率前多少的token中采样
- 例如 0.9 表示从累积概率达到90%的token中选择
- 默认值: 0.95
建议: 不要同时调整 temperature 和 top_p
⚠️ Gemini 3.x 全系一致(不因模型而异):合法范围内的自定义值不影响输出;超出该参数合法范围会返回 400,而非静默忽略。
0 <= x <= 10.9
重复 token 惩罚系数,范围 -2 到 2,对应 Gemini 的 frequencyPenalty。
⚠️ Gemini 3.x 全系一致:传入被网关过滤、不生效(不报错)。
-2 <= x <= 20
已出现 token 惩罚系数,范围 -2 到 2,对应 Gemini 的 presencePenalty。
⚠️ Gemini 3.x 全系一致:传入被网关过滤、不生效(不报错)。
-2 <= x <= 20
停止序列,支持字符串或字符串数组,对应 Gemini 的 stopSequences。
生成候选数量
⚠️ Gemini 3.x 仅支持 1;传入 >1 会返回 400(等同 native 已移除的 candidateCount)。
1 <= x <= 11
限制思考工作量,对应 Gemini 的思考层级:
minimal:近乎零思考,高吞吐 / 低延迟low:较少思考,简单任务medium:质量与速度均衡high:深度多步推理
仅 Gemini 3.x 系列生效,各模型支持的档位与默认不同(与原生一致):
minimal, low, medium, high "minimal"
用于尽可能复现输出的随机种子,对应 Gemini 的 seed。
12345
响应格式设置,支持 JSON mode 与 JSON Schema,对应 Gemini 的 responseMimeType、responseSchema 和 responseJsonSchema。
- Option 1
- Option 2
流式响应的选项。当 stream 为 true 时,可设置此字段
工具定义列表,用于 Function Calling
控制工具调用行为
none, auto, required Gemini 扩展参数