Skip to main content
POST
BaseURL: The default BaseURL is https://direct.evolink.ai, which has better support for text models and long-lived connections. https://api.evolink.ai is the primary endpoint for multimodal services and serves as a fallback address for text models.

Authorizations

Authorization
string
header
required

##All APIs require Bearer Token authentication##

Get API Key:

Visit API Key Management Page to get your API Key

Add to request header:

Body

application/json
model
enum<string>
default:gemini-3.1-pro-preview-customtools
required

Chat model name

Available options:
gemini-3.1-pro-preview-customtools
Example:

"gemini-3.1-pro-preview-customtools"

messages
object[]
required

List of chat messages, supports multi-turn dialogue and multimodal input

Minimum array length: 1
stream
boolean
default:false

Whether to return response in streaming mode

  • true: Streaming return, receives content in real-time chunks
  • false: Returns complete response at once
Example:

false

max_completion_tokens
integer | null

Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.

Required range: 1 <= x <= 65536
Example:

2000

max_tokens
integer

Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.

Required range: 1 <= x <= 65536
Example:

2000

temperature
number
default:1

Sampling temperature, controls output randomness

Description:

  • Lower values (e.g., 0.2): More deterministic, focused output
  • Higher values (e.g., 1.5): More random, creative output
Required range: 0 <= x <= 2
Example:

0.7

top_p
number
default:1

Nucleus Sampling parameter

Description:

  • Controls sampling from tokens with cumulative probability
  • For example, 0.9 means selecting from tokens with cumulative probability up to 90%
  • Default: 1.0 (considers all tokens)

Recommendation: Do not adjust temperature and top_p simultaneously

Required range: 0 <= x <= 1
Example:

0.9

frequency_penalty
number | null
default:0

Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.

Required range: -2 <= x <= 2
Example:

0

presence_penalty
number | null
default:0

Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.

Required range: -2 <= x <= 2
Example:

0

stop

Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.

n
integer | null
default:1

Number of generated candidates.

Required range: x >= 1
Example:

1

reasoning_effort
enum<string> | null
default:medium

Limits reasoning effort. Gemini 3 supports low/high thinking levels; medium maps to the higher level and none is not supported.

Available options:
low,
medium,
high
Example:

"medium"

seed
integer | null

Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.

Example:

12345

logprobs
boolean | null
default:false

Whether to return token logprob information, corresponding to Gemini's responseLogprobs.

Example:

true

top_logprobs
integer | null

Number of top logprob values returned for each token, corresponding to Gemini's logprobs.

Required range: 0 <= x <= 20
Example:

5

response_format
object

Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.

stream_options
object | null

Streaming response options. Can be set when stream is true.

tools
object[] | null

List of tool definitions for Function Calling.

tool_choice

Controls tool-calling behavior.

Available options:
none,
auto,
required
extra_body
object | null

Gemini extension parameters.

Response

Chat completion generated successfully

id
string

Unique identifier for the chat completion

Example:

"chatcmpl-20251010015944503180122WJNB8Eid"

model
string

Model name actually used

Example:

"gemini-3.1-pro-preview-customtools"

object
enum<string>

Response type

Available options:
chat.completion
Example:

"chat.completion"

created
integer

Creation timestamp

Example:

1760032810

choices
object[]

List of chat completion choices

usage
object

Token usage statistics