Saltar al contenido principal
POST
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.

Autorizaciones

Authorization
string
header
requerido

##Todas las APIs requieren autenticación Bearer Token##

Obtener API Key:

Visita la Página de gestión de API Key para obtener tu API Key

Agregar al encabezado de la solicitud:

Cuerpo

application/json
model
enum<string>
requerido

Selecciona el modelo de texto Gemini que deseas invocar:

Opciones disponibles:
gemini-3.6-flash,
gemini-3.5-flash,
gemini-3.5-flash-lite,
gemini-3.1-pro-preview,
gemini-3.1-pro-preview-customtools,
gemini-3.1-flash-lite-preview,
gemini-3-pro-preview,
gemini-3-flash-preview,
gemini-2.5-pro,
gemini-2.5-flash,
gemini-2.5-flash-lite
Ejemplo:

"gemini-3.6-flash"

messages
object[]
requerido

Lista de mensajes de chat, soporta diálogo de múltiples turnos y entrada multimodal

Minimum array length: 1
stream
boolean
predeterminado:false

Si se devuelve la respuesta en modo streaming

  • true: Retorno en streaming, recibe contenido en fragmentos en tiempo real
  • false: Devuelve la respuesta completa de una sola vez
Ejemplo:

false

max_completion_tokens
integer | null

Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.

gemini-3.6-flash / gemini-3.5-flash-lite tienen un límite de 65,536 tokens; el resto de los modelos se rigen por sus propias especificaciones.

Rango requerido: 1 <= x <= 65536
Ejemplo:

2000

max_tokens
integer

Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.

Rango requerido: 1 <= x <= 65536
Ejemplo:

2000

temperature
number
predeterminado:1

Temperatura de muestreo, controla la aleatoriedad de la salida

Descripción:

  • Valores más bajos (ej., 0.2): Salida más determinista y enfocada
  • Valores más altos (ej., 1.5): Salida más aleatoria y creativa

⚠️ Consistente en toda la serie Gemini 3.x (no varía según el modelo): los valores personalizados dentro del rango válido no afectan a la salida; los valores fuera del rango válido de este parámetro devuelven un 400 en lugar de ignorarse de forma silenciosa.

Rango requerido: 0 <= x <= 2
Ejemplo:

0.7

top_p
number
predeterminado:0.95

Parámetro de muestreo Nucleus (Nucleus Sampling)

Descripción:

  • Controla el muestreo de tokens con probabilidad acumulativa
  • Por ejemplo, 0.9 significa seleccionar de tokens con probabilidad acumulativa hasta el 90%
  • Valor por defecto: 0.95

Recomendación: No ajustes temperature y top_p simultáneamente

⚠️ Consistente en toda la serie Gemini 3.x (no varía según el modelo): los valores personalizados dentro del rango válido no afectan a la salida; los valores fuera del rango válido de este parámetro devuelven un 400 en lugar de ignorarse de forma silenciosa.

Rango requerido: 0 <= x <= 1
Ejemplo:

0.9

frequency_penalty
number | null
predeterminado:0

Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.

⚠️ Consistente en toda la serie Gemini 3.x: los valores enviados se filtran en el gateway y no surten efecto (no producen error).

Rango requerido: -2 <= x <= 2
Ejemplo:

0

presence_penalty
number | null
predeterminado:0

Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.

⚠️ Consistente en toda la serie Gemini 3.x: los valores enviados se filtran en el gateway y no surten efecto (no producen error).

Rango requerido: -2 <= x <= 2
Ejemplo:

0

stop

Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.

n
integer | null
predeterminado:1

Número de candidatos a generar

⚠️ Gemini 3.x solo admite 1; enviar un valor >1 devuelve un 400 (equivale al candidateCount ya eliminado en la API nativa).

Rango requerido: 1 <= x <= 1
Ejemplo:

1

reasoning_effort
enum<string> | null

Limita el esfuerzo de razonamiento; corresponde al nivel de razonamiento de Gemini:

  • minimal: razonamiento casi nulo, alto rendimiento / baja latencia
  • low: menos razonamiento, tareas simples
  • medium: equilibrio entre calidad y velocidad
  • high: razonamiento profundo de múltiples pasos

Solo surte efecto en la serie Gemini 3.x, y los niveles admitidos y el valor por defecto difieren según el modelo (igual que en la API nativa):

Opciones disponibles:
minimal,
low,
medium,
high
Ejemplo:

"minimal"

seed
integer | null

Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.

Ejemplo:

12345

response_format
object

Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.

stream_options
object | null

Streaming response options. Can be set when stream is true.

tools
object[] | null

List of tool definitions for Function Calling.

tool_choice

Controls tool-calling behavior.

Opciones disponibles:
none,
auto,
required
extra_body
object | null

Gemini extension parameters.

Respuesta

Completado de chat generado exitosamente

id
string

Identificador único para la completación de chat

Ejemplo:

"chatcmpl-20251010015944503180122WJNB8Eid"

model
string

Nombre del modelo realmente utilizado

Ejemplo:

"gemini-3.6-flash"

object
enum<string>

Tipo de respuesta

Opciones disponibles:
chat.completion
Ejemplo:

"chat.completion"

created
integer

Marca de tiempo de creación

Ejemplo:

1760032810

choices
object[]

Lista de opciones de completado de chat

usage
object

Estadísticas de uso de tokens