Skip to main content
POST
BaseURL 说明:默认 BaseURL 为 https://direct.evolink.ai,对文本模型支持更好、支持长连接;https://api.evolink.ai 为备用地址。

授权

Authorization
string
header
必填

##所有接口均需要使用Bearer Token进行认证##

获取 API Key:

访问 API Key 管理页面 获取您的 API Key

使用时在请求头中添加:

请求体

application/json
model
enum<string>
必填

选择要调用的 Gemini 文本模型:

可用选项:
gemini-3.6-flash,
gemini-3.5-flash,
gemini-3.5-flash-lite,
gemini-3.1-pro-preview,
gemini-3.1-pro-preview-customtools,
gemini-3.1-flash-lite-preview,
gemini-3-pro-preview,
gemini-3-flash-preview,
gemini-2.5-pro,
gemini-2.5-flash,
gemini-2.5-flash-lite
示例:

"gemini-3.6-flash"

messages
object[]
必填

对话消息列表,支持多轮对话和多模态输入

Minimum array length: 1
stream
boolean
默认值:false

是否以流式方式返回响应

  • true: 流式返回,逐块实时返回内容
  • false: 等待完整响应后一次性返回
示例:

false

max_completion_tokens
integer | null

生成回复的最大 completion token 数量,对应 Gemini 的 maxOutputTokens。

gemini-3.6-flash / gemini-3.5-flash-lite 上限 65,536 tokens;其余模型以各自规格为准。

必填范围: 1 <= x <= 65536
示例:

2000

max_tokens
integer

生成回复的最大 token 数量,兼容旧版 OpenAI 参数。

必填范围: 1 <= x <= 65536
示例:

2000

temperature
number
默认值:1

采样温度,控制输出的随机性

说明:

  • 较低值(如 0.2): 更确定、更聚焦的输出
  • 较高值(如 1.5): 更随机、更有创意的输出

⚠️ Gemini 3.x 全系一致(不因模型而异):合法范围内的自定义值不影响输出;超出该参数合法范围会返回 400,而非静默忽略。

必填范围: 0 <= x <= 2
示例:

0.7

top_p
number
默认值:0.95

核采样(Nucleus Sampling)参数

说明:

  • 控制从累积概率前多少的token中采样
  • 例如 0.9 表示从累积概率达到90%的token中选择
  • 默认值: 0.95

建议: 不要同时调整 temperature 和 top_p

⚠️ Gemini 3.x 全系一致(不因模型而异):合法范围内的自定义值不影响输出;超出该参数合法范围会返回 400,而非静默忽略。

必填范围: 0 <= x <= 1
示例:

0.9

frequency_penalty
number | null
默认值:0

重复 token 惩罚系数,范围 -2 到 2,对应 Gemini 的 frequencyPenalty。

⚠️ Gemini 3.x 全系一致:传入被网关过滤、不生效(不报错)。

必填范围: -2 <= x <= 2
示例:

0

presence_penalty
number | null
默认值:0

已出现 token 惩罚系数,范围 -2 到 2,对应 Gemini 的 presencePenalty。

⚠️ Gemini 3.x 全系一致:传入被网关过滤、不生效(不报错)。

必填范围: -2 <= x <= 2
示例:

0

stop

停止序列,支持字符串或字符串数组,对应 Gemini 的 stopSequences。

n
integer | null
默认值:1

生成候选数量

⚠️ Gemini 3.x 仅支持 1;传入 >1 会返回 400(等同 native 已移除的 candidateCount)。

必填范围: 1 <= x <= 1
示例:

1

reasoning_effort
enum<string> | null

限制思考工作量,对应 Gemini 的思考层级:

  • minimal:近乎零思考,高吞吐 / 低延迟
  • low:较少思考,简单任务
  • medium:质量与速度均衡
  • high:深度多步推理

仅 Gemini 3.x 系列生效,各模型支持的档位与默认不同(与原生一致):

可用选项:
minimal,
low,
medium,
high
示例:

"minimal"

seed
integer | null

用于尽可能复现输出的随机种子,对应 Gemini 的 seed。

示例:

12345

response_format
object

响应格式设置,支持 JSON mode 与 JSON Schema,对应 Gemini 的 responseMimeType、responseSchema 和 responseJsonSchema。

stream_options
object | null

流式响应的选项。当 stream 为 true 时,可设置此字段

tools
object[] | null

工具定义列表,用于 Function Calling

tool_choice

控制工具调用行为

可用选项:
none,
auto,
required
extra_body
object | null

Gemini 扩展参数

响应

对话生成成功

id
string

对话完成的唯一标识符

示例:

"chatcmpl-20251010015944503180122WJNB8Eid"

model
string

实际使用的模型名称

示例:

"gemini-3.6-flash"

object
enum<string>

响应类型

可用选项:
chat.completion
示例:

"chat.completion"

created
integer

创建时间戳

示例:

1760032810

choices
object[]

对话生成的选择列表

usage
object

Token 使用统计信息