curl --request POST \
--url https://direct.evolink.ai/v1beta/models/{model}:generateContent \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"contents": [
{
"role": "user",
"parts": [
{
"text": "请介绍下你自己"
}
]
}
]
}
'{
"candidates": [
{
"content": {
"role": "model",
"parts": [
{
"text": "你好!很高兴能向你介绍我自己。\n\n我是一个大型语言模型,由 Google 训练和开发...",
"thought": true,
"thoughtSignature": "<Signature_A>"
}
]
},
"finishReason": "STOP",
"index": 0,
"safetyRatings": [
{}
]
}
],
"promptFeedback": {
"safetyRatings": [
{}
]
},
"usageMetadata": {
"promptTokenCount": 4,
"cachedContentTokenCount": 0,
"candidatesTokenCount": 611,
"totalTokenCount": 2422,
"thoughtsTokenCount": 1807,
"promptTokensDetails": [
{
"modality": "TEXT",
"tokenCount": 4
}
]
},
"modelVersion": "gemini-3.6-flash",
"responseId": "l-LoaPu0BPmo1dkP6ZPHiQc"
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error"
}
}{
"error": {
"code": 404,
"message": "Model not found",
"type": "not_found_error"
}
}{
"error": {
"code": 413,
"message": "Request body too large",
"type": "request_too_large_error",
"fallback_suggestion": "reduce file size"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}Google 原生 API 格式
Gemini 全模型接口 - 原生 API 格式
通过路径中的 {model} 选择要调用的 Gemini 文本模型(全部可选值见 model 参数的对照表)。
- 使用 Google 原生 API 格式,同步返回对话内容
- 纯文本 / 多模态输入:文本 + 图像 / 音频 / 视频混合输入
- 流式:将路径中的
generateContent替换为streamGenerateContent(可追加?alt=sse获取 SSE)
模型规格与差异
- 3.8 行为:相比 3.7,软件工程、Agent、多步推理与多模态准确率更强;模型可能消耗更多推理 / 输出 Token,尤其在
high档。延迟敏感场景建议用low,通用场景用默认medium,复杂代码、长视频或多步推理再用high。 - 采样参数
temperature/topP/topK:Gemini 3.x 全系一致,自定义值不影响输出;topK传入不生效(会被忽略,不报错),temperature/topP超出合法范围会返回 400。 - 思考控制:Gemini 3.x 系列用
thinkingConfig.thinkingLevel(各模型支持档位与默认见thinkingLevel参数);Gemini 2.5 系列用thinkingConfig.thinkingBudget(整数,0=关闭)。二者互斥。gemini-3.8-flash/gemini-3.7-flash与 Pro 系不支持minimal,传入会被自动降级为low。 - 函数调用:Gemini 3.x 的
FunctionResponse必须回传与对应FunctionCall匹配的id和name,否则报错。 - 末轮角色:最后一条消息的
role不能为model(Gemini 3.5+ 会报错)。 - Token 上限:
gemini-3.8-flash/gemini-3.7-flash/gemini-3.6-flash/gemini-3.5-flash-lite上下文 1,048,576、最大输出 65,536;其余模型以各自规格为准。
POST
/
v1beta
/
models
/
{model}
:generateContent
curl --request POST \
--url https://direct.evolink.ai/v1beta/models/{model}:generateContent \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"contents": [
{
"role": "user",
"parts": [
{
"text": "请介绍下你自己"
}
]
}
]
}
'{
"candidates": [
{
"content": {
"role": "model",
"parts": [
{
"text": "你好!很高兴能向你介绍我自己。\n\n我是一个大型语言模型,由 Google 训练和开发...",
"thought": true,
"thoughtSignature": "<Signature_A>"
}
]
},
"finishReason": "STOP",
"index": 0,
"safetyRatings": [
{}
]
}
],
"promptFeedback": {
"safetyRatings": [
{}
]
},
"usageMetadata": {
"promptTokenCount": 4,
"cachedContentTokenCount": 0,
"candidatesTokenCount": 611,
"totalTokenCount": 2422,
"thoughtsTokenCount": 1807,
"promptTokensDetails": [
{
"modality": "TEXT",
"tokenCount": 4
}
]
},
"modelVersion": "gemini-3.6-flash",
"responseId": "l-LoaPu0BPmo1dkP6ZPHiQc"
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error"
}
}{
"error": {
"code": 404,
"message": "Model not found",
"type": "not_found_error"
}
}{
"error": {
"code": 413,
"message": "Request body too large",
"type": "request_too_large_error",
"fallback_suggestion": "reduce file size"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}流式调用:将 URL 中的
generateContent 替换为 streamGenerateContent,请求体不变,响应逐块返回;可追加 ?alt=sse 获取 SSE 格式。BaseURL 说明:默认 BaseURL 为
https://direct.evolink.ai,对文本模型支持更好、支持长连接;https://api.evolink.ai 为备用地址。授权
##所有接口均需要使用Bearer Token进行认证##
获取 API Key:
访问 API Key 管理页面 获取您的 API Key
使用时在请求头中添加:
Authorization: Bearer YOUR_API_KEY
路径参数
选择要调用的 Gemini 文本模型:
| 模型 ID | 系列 | 定位 |
|---|---|---|
gemini-3.8-flash | 3.8 Flash | 增强的软件工程 / Agent / 多步推理 / 多模态准确率 |
gemini-3.7-flash | 3.7 Flash | Pro 级 agentic / 代码生成 / 终端执行 |
gemini-3.6-flash | 3.6 Flash | 多步编排 / 代码重构 / 通用推理 |
gemini-3.5-flash | 3.5 Flash | 通用 Flash |
gemini-3.5-flash-lite | 3.5 Flash-Lite | 低成本 / 高吞吐 / 轻量 agent |
gemini-3.1-pro-preview | 3.1 Pro (Preview) | 高级推理 |
gemini-3.1-pro-preview-customtools | 3.1 Pro · CustomTools | 高级推理 + 自定义工具 |
gemini-3.1-flash-lite-preview | 3.1 Flash-Lite (Preview) | 低成本 |
gemini-3-pro-preview | 3.0 Pro (Preview) | 高级推理 |
gemini-3-flash-preview | 3.0 Flash (Preview) | 通用 Flash |
gemini-2.5-pro | 2.5 Pro | 高级推理 |
gemini-2.5-flash | 2.5 Flash | 通用 Flash |
gemini-2.5-flash-lite | 2.5 Flash-Lite | 低成本 |
可用选项:
gemini-3.8-flash, gemini-3.7-flash, gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite 示例:
"gemini-3.6-flash"
请求体
application/json
对话内容列表,支持多轮对话和多模态输入
Minimum array length:
1Show child attributes
Show child attributes
系统指令(可选),当前以文本为主
Show child attributes
Show child attributes
模型可调用的工具列表,如函数调用或代码执行
工具调用配置(可选)
安全设置列表(可选)
生成配置参数(可选)
Show child attributes
Show child attributes
缓存内容名称,格式为 cachedContents/{cachedContent}
响应
内容生成成功
响应格式说明:
- 使用
generateContent端点时,返回GenerateContentResponse(等待完整响应后一次性返回) - 使用
streamGenerateContent端点时,返回StreamGenerateContentResponse(流式响应,逐块返回内容)