Interfaz de todos los modelos Gemini - formato compatible con OpenAI
Selecciona el modelo de texto Gemini que deseas invocar mediante model en el cuerpo de la solicitud (consulta la tabla de referencia del parámetro model para ver todos los valores posibles).
- Usa el formato OpenAI SDK / Chat Completions y devuelve el contenido de la conversación de forma síncrona
- Entrada de texto plano / multimodal: entrada mixta de texto + imagen (
messages[].content) - Streaming: establece
stream: truepara recibir la respuesta fragmento a fragmento
Especificaciones y diferencias de los modelos
- Parámetros de muestreo / penalización
temperature/top_p/frequency_penalty/presence_penalty: consistente en toda la serie Gemini 3.x, los valores personalizados no afectan a la salida;temperature/top_pdevuelven un 400 si están fuera de rango, yfrequency_penalty/presence_penaltyse filtran en el gateway (no producen error). - Control del razonamiento
reasoning_effort:minimal/low/medium/high(consulta el parámetroreasoning_effortpara ver los niveles admitidos y el valor por defecto de cada modelo); solo surte efecto en la serie Gemini 3.x. - Rol del último turno: el
roledel último mensaje no puede serassistant(Gemini 3.5+ devuelve un error). - Límite de tokens:
gemini-3.6-flash/gemini-3.5-flash-litetienen un contexto de 1,048,576 y una salida máxima de 65,536; el resto de los modelos se rigen por sus propias especificaciones.
https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.Autorizaciones
##Todas las APIs requieren autenticación Bearer Token##
Obtener API Key:
Visita la Página de gestión de API Key para obtener tu API Key
Agregar al encabezado de la solicitud:
Cuerpo
Selecciona el modelo de texto Gemini que deseas invocar:
gemini-3.6-flash, gemini-3.5-flash, gemini-3.5-flash-lite, gemini-3.1-pro-preview, gemini-3.1-pro-preview-customtools, gemini-3.1-flash-lite-preview, gemini-3-pro-preview, gemini-3-flash-preview, gemini-2.5-pro, gemini-2.5-flash, gemini-2.5-flash-lite "gemini-3.6-flash"
Lista de mensajes de chat, soporta diálogo de múltiples turnos y entrada multimodal
1Si se devuelve la respuesta en modo streaming
true: Retorno en streaming, recibe contenido en fragmentos en tiempo realfalse: Devuelve la respuesta completa de una sola vez
false
Maximum number of completion tokens for the generated response, corresponding to Gemini's maxOutputTokens.
gemini-3.6-flash / gemini-3.5-flash-lite tienen un límite de 65,536 tokens; el resto de los modelos se rigen por sus propias especificaciones.
1 <= x <= 655362000
Maximum number of tokens for the generated response, compatible with the legacy OpenAI parameter.
1 <= x <= 655362000
Temperatura de muestreo, controla la aleatoriedad de la salida
Descripción:
- Valores más bajos (ej., 0.2): Salida más determinista y enfocada
- Valores más altos (ej., 1.5): Salida más aleatoria y creativa
⚠️ Consistente en toda la serie Gemini 3.x (no varía según el modelo): los valores personalizados dentro del rango válido no afectan a la salida; los valores fuera del rango válido de este parámetro devuelven un 400 en lugar de ignorarse de forma silenciosa.
0 <= x <= 20.7
Parámetro de muestreo Nucleus (Nucleus Sampling)
Descripción:
- Controla el muestreo de tokens con probabilidad acumulativa
- Por ejemplo, 0.9 significa seleccionar de tokens con probabilidad acumulativa hasta el 90%
- Valor por defecto: 0.95
Recomendación: No ajustes temperature y top_p simultáneamente
⚠️ Consistente en toda la serie Gemini 3.x (no varía según el modelo): los valores personalizados dentro del rango válido no afectan a la salida; los valores fuera del rango válido de este parámetro devuelven un 400 en lugar de ignorarse de forma silenciosa.
0 <= x <= 10.9
Frequency penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's frequencyPenalty.
⚠️ Consistente en toda la serie Gemini 3.x: los valores enviados se filtran en el gateway y no surten efecto (no producen error).
-2 <= x <= 20
Presence penalty coefficient. Range: -2.0 to 2.0. Corresponds to Gemini's presencePenalty.
⚠️ Consistente en toda la serie Gemini 3.x: los valores enviados se filtran en el gateway y no surten efecto (no producen error).
-2 <= x <= 20
Stop sequences. Supports a string or string array, corresponding to Gemini's stopSequences.
Número de candidatos a generar
⚠️ Gemini 3.x solo admite 1; enviar un valor >1 devuelve un 400 (equivale al candidateCount ya eliminado en la API nativa).
1 <= x <= 11
Limita el esfuerzo de razonamiento; corresponde al nivel de razonamiento de Gemini:
minimal: razonamiento casi nulo, alto rendimiento / baja latencialow: menos razonamiento, tareas simplesmedium: equilibrio entre calidad y velocidadhigh: razonamiento profundo de múltiples pasos
Solo surte efecto en la serie Gemini 3.x, y los niveles admitidos y el valor por defecto difieren según el modelo (igual que en la API nativa):
minimal, low, medium, high "minimal"
Random seed used to make output as reproducible as possible, corresponding to Gemini's seed.
12345
Response format settings, supporting JSON mode and JSON Schema, corresponding to Gemini's responseMimeType, responseSchema and responseJsonSchema.
- Option 1
- Option 2
Streaming response options. Can be set when stream is true.
List of tool definitions for Function Calling.
Controls tool-calling behavior.
none, auto, required Gemini extension parameters.
Respuesta
Completado de chat generado exitosamente
Identificador único para la completación de chat
"chatcmpl-20251010015944503180122WJNB8Eid"
Nombre del modelo realmente utilizado
"gemini-3.6-flash"
Tipo de respuesta
chat.completion "chat.completion"
Marca de tiempo de creación
1760032810
Lista de opciones de completado de chat
Estadísticas de uso de tokens