curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "gemini-3.6-flash",
"messages": [
{
"role": "user",
"content": "请介绍一下你自己"
}
]
}
'{
"id": "chatcmpl-20251010015944503180122WJNB8Eid",
"model": "gemini-3.6-flash",
"object": "chat.completion",
"created": 1760032810,
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "你好!很高兴能向你介绍自己。\n\n我是一个大型语言模型(Large Language Model),由 Google 训练和开发。\n\n简单来说,你可以把我理解为一个经过海量文本数据训练、能够理解和生成人类语言的\"智能大脑\"。我的核心能力是处理和生成文本,具体来说,我能做以下这些事情:\n\n**1. 信息查询与知识解答**\n我可以像一部\"会说话的百科全书\",为你解答各种问题,无论是科学知识、历史事件,还是生活常识。\n\n**2. 创意写作与文本生成**\n我可以根据你的要求,创作各种类型的文本,比如:\n* **写作**:诗歌、故事、剧本、邮件、演讲稿、广告文案等。\n* **规划**:为你制定旅行计划、学习大纲、活动方案等。\n* **头脑风暴**:和你一起碰撞想法,激发新的创意。\n\n**3. 翻译与语言处理**\n我精通多种语言,可以为你提供快速、流畅的翻译服务。同时,我也可以帮你润色、校对、总结或改写文本,让你的表达更清晰、更专业。\n\n**4. 编程与代码辅助**\n我可以编写代码片段、解释代码逻辑、调试错误,或者将代码从一种编程语言\"翻译\"成另一种,是程序员的好帮手。\n\n**5. 逻辑分析与推理**\n我可以帮助你分析复杂的问题,梳理逻辑链条,并根据你提供的信息进行推理和总结。\n\n---\n\n**总而言之**,我的目标是成为一个强大而有用的工具,通过自然语言交流的方式,帮助你更高效地获取信息、完成任务和激发创意。\n\n**需要记住的是:** 我是一个人工智能,我的知识来源于我所学习的数据,并且可能不是最新的。有时我也可能会犯错,所以对于非常重要的信息,建议你进行再次核实。",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"logprobs": {
"content": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
],
"top_logprobs": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
]
}
]
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 13,
"completion_tokens": 1891,
"total_tokens": 1904,
"prompt_tokens_details": {
"cached_tokens": 0,
"text_tokens": 13,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 0,
"audio_tokens": 0,
"reasoning_tokens": 1480
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model",
"fallback_suggestion": "gemini-3.6-flash"
}
}{
"error": {
"code": 413,
"message": "Image file too large",
"type": "request_too_large_error",
"param": "content",
"fallback_suggestion": "compress image to under 10MB"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try different model"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}Gemini 全模型接口 - OpenAI 兼容格式
通过请求体中的 model 选择要调用的 Gemini 文本模型(全部可选值见 model 参数的对照表)。
- 使用 OpenAI SDK / Chat Completions 格式,同步返回对话内容
- 纯文本 / 多模态输入:文本 + 图像混合输入(
messages[].content) - 流式:设置
stream: true逐块返回
模型规格与差异
- 3.8 行为:相比 3.7,软件工程、Agent、多步推理与多模态准确率更强;模型可能消耗更多推理 / 输出 Token,尤其在
high档。延迟敏感场景建议用low,通用场景用默认medium,复杂代码、长视频或多步推理再用high。 - 采样 / 惩罚参数
temperature/top_p/frequency_penalty/presence_penalty:Gemini 3.x 全系一致,自定义值不影响输出;temperature/top_p超范围返回 400,frequency_penalty/presence_penalty传入不生效(会被忽略,不报错)。 - 思考控制
reasoning_effort:minimal/low/medium/high(各模型支持档位与默认见reasoning_effort参数);仅 Gemini 3.x 系列生效。gemini-3.8-flash/gemini-3.7-flash与 Pro 系不支持minimal,传入会被自动降级为low。 - 末轮角色:最后一条消息的
role不能为assistant(Gemini 3.5+ 会报错)。 - Token 上限:
gemini-3.8-flash/gemini-3.7-flash/gemini-3.6-flash/gemini-3.5-flash-lite上下文 1,048,576、最大输出 65,536;其余模型以各自规格为准。
curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "gemini-3.6-flash",
"messages": [
{
"role": "user",
"content": "请介绍一下你自己"
}
]
}
'{
"id": "chatcmpl-20251010015944503180122WJNB8Eid",
"model": "gemini-3.6-flash",
"object": "chat.completion",
"created": 1760032810,
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "你好!很高兴能向你介绍自己。\n\n我是一个大型语言模型(Large Language Model),由 Google 训练和开发。\n\n简单来说,你可以把我理解为一个经过海量文本数据训练、能够理解和生成人类语言的\"智能大脑\"。我的核心能力是处理和生成文本,具体来说,我能做以下这些事情:\n\n**1. 信息查询与知识解答**\n我可以像一部\"会说话的百科全书\",为你解答各种问题,无论是科学知识、历史事件,还是生活常识。\n\n**2. 创意写作与文本生成**\n我可以根据你的要求,创作各种类型的文本,比如:\n* **写作**:诗歌、故事、剧本、邮件、演讲稿、广告文案等。\n* **规划**:为你制定旅行计划、学习大纲、活动方案等。\n* **头脑风暴**:和你一起碰撞想法,激发新的创意。\n\n**3. 翻译与语言处理**\n我精通多种语言,可以为你提供快速、流畅的翻译服务。同时,我也可以帮你润色、校对、总结或改写文本,让你的表达更清晰、更专业。\n\n**4. 编程与代码辅助**\n我可以编写代码片段、解释代码逻辑、调试错误,或者将代码从一种编程语言\"翻译\"成另一种,是程序员的好帮手。\n\n**5. 逻辑分析与推理**\n我可以帮助你分析复杂的问题,梳理逻辑链条,并根据你提供的信息进行推理和总结。\n\n---\n\n**总而言之**,我的目标是成为一个强大而有用的工具,通过自然语言交流的方式,帮助你更高效地获取信息、完成任务和激发创意。\n\n**需要记住的是:** 我是一个人工智能,我的知识来源于我所学习的数据,并且可能不是最新的。有时我也可能会犯错,所以对于非常重要的信息,建议你进行再次核实。",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"logprobs": {
"content": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
],
"top_logprobs": [
{
"token": "<string>",
"logprob": 123,
"bytes": [
123
]
}
]
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 13,
"completion_tokens": 1891,
"total_tokens": 1904,
"prompt_tokens_details": {
"cached_tokens": 0,
"text_tokens": 13,
"audio_tokens": 0,
"image_tokens": 0
},
"completion_tokens_details": {
"text_tokens": 0,
"audio_tokens": 0,
"reasoning_tokens": 1480
},
"input_tokens": 0,
"output_tokens": 0,
"input_tokens_details": null
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model",
"fallback_suggestion": "gemini-3.6-flash"
}
}{
"error": {
"code": 413,
"message": "Image file too large",
"type": "request_too_large_error",
"param": "content",
"fallback_suggestion": "compress image to under 10MB"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try different model"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai,对文本模型支持更好、支持长连接;https://api.evolink.ai 为备用地址。授权
##所有接口均需要使用Bearer Token进行认证##
获取 API Key:
访问 API Key 管理页面 获取您的 API Key
使用时在请求头中添加:
Authorization: Bearer YOUR_API_KEY
请求体
选择要调用的 Gemini 文本模型:
| 模型 ID | 系列 | 定位 |
|---|---|---|
gemini-3.8-flash | 3.8 Flash | 增强的软件工程 / Agent / 多步推理 / 多模态准确率 |
gemini-3.7-flash | 3.7 Flash | Pro 级 agentic / 代码生成 / 终端执行 |
gemini-3.6-flash | 3.6 Flash | 多步编排 / 代码重构 / 通用推理 |
gemini-3.5-flash | 3.5 Flash | 通用 Flash |
gemini-3.5-flash-lite | 3.5 Flash-Lite | 低成本 / 高吞吐 / 轻量 agent |
gemini-3.1-pro-preview | 3.1 Pro (Preview) | 高级推理 |
gemini-3.1-pro-preview-customtools | 3.1 Pro · CustomTools | 高级推理 + 自定义工具 |
gemini-3.1-flash-lite-preview | 3.1 Flash-Lite (Preview) | 低成本 |
gemini-3-pro-preview | 3.0 Pro (Preview) | 高级推理 |
gemini-3-flash-preview | 3.0 Flash (Preview) | 通用 Flash |
gemini-2.5-pro | 2.5 Pro | 高级推理 |
gemini-2.5-flash | 2.5 Flash | 通用 Flash |
gemini-2.5-flash-lite | 2.5 Flash-Lite | 低成本 |
gemini-3.8-flash, gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
对话消息列表,支持多轮对话和多模态输入
1Show child attributes
Show child attributes
是否以流式方式返回响应
true: 流式返回,逐块实时返回内容false: 等待完整响应后一次性返回
false
生成回复的最大 completion token 数量,对应 Gemini 的 maxOutputTokens。
gemini-3.8-flash / gemini-3.7-flash / gemini-3.6-flash / gemini-3.5-flash-lite 上限 65,536 tokens;其余模型以各自规格为准。
1 <= x <= 655362000
生成回复的最大 token 数量,兼容旧版 OpenAI 参数。
1 <= x <= 655362000
采样温度,控制输出的随机性
说明:
- 较低值(如 0.2): 更确定、更聚焦的输出
- 较高值(如 1.5): 更随机、更有创意的输出
Gemini 3.x 全系一致(不因模型而异):合法范围内的自定义值不影响输出;超出该参数合法范围会返回 400,而非静默忽略。
0 <= x <= 20.7
核采样(Nucleus Sampling)参数
说明:
- 控制从累积概率前多少的token中采样
- 例如 0.9 表示从累积概率达到90%的token中选择
- 默认值: 0.95
建议: 不要同时调整 temperature 和 top_p
Gemini 3.x 全系一致(不因模型而异):合法范围内的自定义值不影响输出;超出该参数合法范围会返回 400,而非静默忽略。
0 <= x <= 10.9
重复 token 惩罚系数,范围 -2 到 2,对应 Gemini 的 frequencyPenalty。
Gemini 3.x 全系一致:传入会被忽略、不生效(不报错)。
-2 <= x <= 20
已出现 token 惩罚系数,范围 -2 到 2,对应 Gemini 的 presencePenalty。
Gemini 3.x 全系一致:传入会被忽略、不生效(不报错)。
-2 <= x <= 20
停止序列,支持字符串或字符串数组,对应 Gemini 的 stopSequences。
生成候选数量
Gemini 3.x 仅支持 1;传入 >1 会返回 400(等同 native 已移除的 candidateCount)。
1 <= x <= 11
限制思考工作量,对应 Gemini 的思考层级:
minimal:近乎零思考,高吞吐 / 低延迟low:较少思考,简单任务medium:质量与速度均衡high:深度多步推理
仅 Gemini 3.x 系列生效,各模型支持的档位与默认不同(与原生一致):
| 模型 | 支持档位 | 默认 |
|---|---|---|
gemini-3.8-flash | low / medium / high | medium |
gemini-3.7-flash | low / medium / high | medium |
gemini-3.6-flash | minimal / low / medium / high | medium |
gemini-3.5-flash | minimal / low / medium / high | medium |
gemini-3.5-flash-lite | minimal / low / medium / high | minimal |
gemini-3.1-flash-lite-preview | minimal / low / medium / high | minimal |
gemini-3-flash-preview | minimal / low / medium / high | medium |
gemini-3.1-pro-preview | low / medium / high | high |
gemini-3.1-pro-preview-customtools | low / medium / high | high |
gemini-3-pro-preview | low / medium / high | high |
传入模型不支持的档位(如向 Pro 系或 gemini-3.8-flash / gemini-3.7-flash 传 minimal)会被自动降级为 low,不会报错。
minimal, low, medium, high "minimal"
用于尽可能复现输出的随机种子,对应 Gemini 的 seed。
12345
响应格式设置,支持 JSON mode 与 JSON Schema,对应 Gemini 的 responseMimeType、responseSchema 和 responseJsonSchema。
- Option 1
- Option 2
Show child attributes
Show child attributes
流式响应的选项。当 stream 为 true 时,可设置此字段
Show child attributes
Show child attributes
工具定义列表,用于 Function Calling
Show child attributes
Show child attributes
控制工具调用行为
none, auto, required Gemini 扩展参数
Show child attributes
Show child attributes
响应
对话生成成功