Skip to main content
POST
Completado de chat GPT (todos los modelos, parámetros completos)
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.
Las herramientas del lado del servidor (búsqueda web, ejecución de código, búsqueda documental, MCP) solo se ofrecen en la API Responses. El endpoint de Chat Completions solo admite llamadas a herramientas function normales.
GPT-6: Las llamadas a funciones con Sol / Luna requieren reasoning_effort: "none" en este endpoint. Use Responses para llamadas a funciones con Astra y 6.1 Sol, o para el nivel max de GPT-6.

Autorizaciones

Authorization
string
header
requerido

##Todas las APIs requieren autenticación Bearer Token##

Obtener API Key:

Visita la Página de gestión de API Key para obtener tu API Key

Agregar al encabezado de la solicitud:

Cuerpo

application/json
model
enum<string>
requerido

Modelo a invocar:

Opciones disponibles:
gpt-6.1-sol,
gpt-6-astra,
gpt-6-sol,
gpt-6-luna,
gpt-5.6-sol,
gpt-5.6-terra,
gpt-5.6-luna,
gpt-5.5,
gpt-5.4,
gpt-5.2,
gpt-5.1
Ejemplo:

"gpt-6.1-sol"

messages
object[]
requerido

Lista de mensajes de chat, admite contexto de varios turnos y entrada multimodal.

role puede ser system / developer / user / assistant / tool.

content puede ser una cadena o un array de bloques de contenido. Se admiten dos tipos de bloque: text (texto) e image_url (imagen):

Imagen

  • Envía en image_url.url la URL pública de la imagen
  • image_url también puede escribirse directamente como una cadena, equivalente a { "url": "..." }
  • detail controla la precisión del análisis de la imagen: auto (predeterminado) / low / high / original
  • La imagen debe poder descargarse, de lo contrario se devuelve 400

Nota Los tipos de bloque de esta API son distintos de los de la API Responses (que usa input_text / input_image). No pueden mezclarse; usarlos mal devuelve 400.

Punto de caché explícito para GPT-6 / GPT-5.6 en un bloque de contenido. Máximo cuatro escrituras por solicitud; un punto implícito ocupa una posición. prompt_cache_breakpoint: {"mode": "explicit"}.

Ejemplo:
stream
boolean
predeterminado:false

Si la respuesta se devuelve en streaming (flujo de eventos SSE, que termina con data: [DONE]). El valor predeterminado es false.

Ejemplo:

false

max_completion_tokens
integer

Máximo de tokens generados, incluido el razonamiento. Se recomienda max_completion_tokens. GPT-6 convierte el campo antiguo max_tokens; si se envían ambos, conserva max_completion_tokens y elimina max_tokens. GPT-6 Astra / Sol / Luna y GPT-6.1 Sol permiten hasta 128.000 tokens de salida.

Ejemplo:

2048

reasoning_effort
enum<string>

Control de la profundidad de razonamiento. Los valores posibles varían según el modelo:

Los tokens de razonamiento se facturan como tokens de salida y se contabilizan en usage.completion_tokens_details.reasoning_tokens.

GPT-6 usa medium de forma predeterminada. gpt-6-astra y gpt-6.1-sol no admiten none; gpt-6-sol / gpt-6-luna sí. El nivel max de GPT-6 solo está disponible en Responses.

Opciones disponibles:
none,
low,
medium,
high,
xhigh
Ejemplo:

"medium"

verbosity
enum<string>

Nivel de detalle de la respuesta: low / medium / high.

GPT-6 Sol / Luna y GPT-6.1 Sol: aún no se ha confirmado la compatibilidad con este parámetro; omítalo en las solicitudes básicas.

Las siguientes reglas de modelos existentes excluyen GPT-6 Sol / Luna y GPT-6.1 Sol:

Nota Compatible con gpt-6-astra, gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna y gpt-5.5; los demás modelos no admiten este parámetro.

Opciones disponibles:
low,
medium,
high
Ejemplo:

"low"

temperature
number

Temperatura de muestreo, con valores de 0 a 2. Cuanto más bajo, más determinista es la salida.

GPT-6: omita este parámetro con gpt-6-astra y gpt-6.1-sol. Con gpt-6-sol / gpt-6-luna, solo puede ajustarse con esfuerzo de razonamiento none; omítalo en los demás niveles. Omitir el esfuerzo selecciona medium, no none.

Modelos existentes: gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 permiten ajustes; la familia gpt-5.6 solo acepta el valor predeterminado 1.

Rango requerido: 0 <= x <= 2
Ejemplo:

1

top_p
number

Parámetro de muestreo por núcleo, con valores de 0 a 1. No se recomienda ajustarlo junto con temperature.

GPT-6: omita este parámetro con gpt-6-astra y gpt-6.1-sol. Con gpt-6-sol / gpt-6-luna, solo puede ajustarse con esfuerzo de razonamiento none; omítalo en los demás niveles. Omitir el esfuerzo selecciona medium, no none.

Modelos existentes: gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 permiten ajustes; la familia gpt-5.6 solo acepta el valor predeterminado 1.

Rango requerido: 0 <= x <= 1
Ejemplo:

1

frequency_penalty
number

Penalización por frecuencia, con valores de -2 a 2. Los valores positivos penalizan los tokens según su frecuencia de aparición y reducen el contenido repetido.

GPT-6 Sol / Luna y GPT-6.1 Sol: aún no se ha confirmado la compatibilidad con este parámetro; omítalo en las solicitudes básicas.

Las siguientes reglas de modelos existentes excluyen GPT-6 Sol / Luna y GPT-6.1 Sol:

Nota Solo puede ajustarse en gpt-5.4 / gpt-5.2 / gpt-5.1; la familia gpt-5.6 y gpt-5.5 no permiten ajustarlo. GPT-6 Astra solo acepta el valor predeterminado 0; enviar cualquier otro valor devuelve 400.

Rango requerido: -2 <= x <= 2
Ejemplo:

0

presence_penalty
number

Penalización por presencia, con valores de -2 a 2. Los valores positivos animan al modelo a tratar temas nuevos.

GPT-6 Sol / Luna y GPT-6.1 Sol: aún no se ha confirmado la compatibilidad con este parámetro; omítalo en las solicitudes básicas.

Las siguientes reglas de modelos existentes excluyen GPT-6 Sol / Luna y GPT-6.1 Sol:

Nota Solo puede ajustarse en gpt-5.4 / gpt-5.2 / gpt-5.1; la familia gpt-5.6 y gpt-5.5 no permiten ajustarlo. GPT-6 Astra solo acepta el valor predeterminado 0; enviar cualquier otro valor devuelve 400.

Rango requerido: -2 <= x <= 2
Ejemplo:

0

logprobs
boolean
predeterminado:false

Si se devuelven las probabilidades logarítmicas de cada token de salida.

GPT-6: Astra y 6.1 Sol no admiten logprobs de salida. Sol / Luna solo permiten usarlos con esfuerzo none. En otros niveles, elimine logprobs, top_logprobs y message.output_text.logprobs de include en Responses.

Las siguientes reglas de modelos existentes excluyen GPT-6 Sol / Luna y GPT-6.1 Sol:

Nota Solo lo admiten gpt-5.4 / gpt-5.2 / gpt-5.1; la familia gpt-5.6 y gpt-5.5 no admiten este parámetro.

GPT-6 Astra y GPT-6.1 Sol no admiten este parámetro.

Ejemplo:

true

top_logprobs
integer

Número de tokens candidatos devueltos en cada posición, con valores de 0 a 20; debe usarse junto con logprobs: true.

Nota El alcance de compatibilidad es el mismo que el de logprobs.

GPT-6: Astra y 6.1 Sol no admiten logprobs de salida. Sol / Luna solo permiten usarlos con esfuerzo none. En otros niveles, elimine logprobs, top_logprobs y message.output_text.logprobs de include en Responses.

Rango requerido: 0 <= x <= 20
Ejemplo:

2

n
integer
predeterminado:1

Número de respuestas candidatas a generar, devueltas como varios elementos del array choices. Se facturan todos los tokens (incluida la salida de cada candidata).

GPT-6 Sol / Luna y GPT-6.1 Sol: aún no se ha confirmado la compatibilidad con este parámetro; omítalo en las solicitudes básicas.

Ejemplo:

1

seed
integer

Semilla aleatoria. Con la misma semilla y la misma combinación de parámetros, el modelo intenta devolver resultados coherentes (en la medida de lo posible; no se garantiza una reproducibilidad total).

GPT-6 Sol / Luna y GPT-6.1 Sol: aún no se ha confirmado la compatibilidad con este parámetro; omítalo en las solicitudes básicas.

Ejemplo:

42

response_format
object

Control del formato de salida:

  • {"type": "text"}: texto libre, el valor predeterminado
  • {"type": "json_object"}: devuelve JSON válido y exige que la palabra json aparezca en messages, de lo contrario devuelve 400
  • {"type": "json_schema", "json_schema": {...}}: devuelve resultados estructurados conforme al JSON Schema indicado; combínalo con "strict": true para forzar la conformidad con el esquema
tools
object[]

Lista de herramientas, usada para Function Calling (llamadas a funciones del lado del cliente, sin coste por llamada).

Las herramientas del lado del servidor (búsqueda web, ejecución de código, etc.) no se ofrecen en esta API; utiliza en su lugar la API Responses.

GPT-6: gpt-6-sol / gpt-6-luna usan medium de forma predeterminada. Las llamadas a funciones en Chat Completions requieren reasoning_effort: "none" explícito. gpt-6-astra y gpt-6.1-sol no admiten none; use Responses para llamar a funciones. El nivel max de GPT-6 solo está disponible en Responses.

tool_choice

Control de la selección de herramientas: "auto" (predeterminado) / "none" / "required", o un objeto que indica una función concreta, como {"type": "function", "function": {"name": "get_weather"}}.

Opciones disponibles:
none,
auto,
required
parallel_tool_calls
boolean
predeterminado:true

Si el modelo puede llamar a varias herramientas en paralelo dentro de un mismo turno. El valor predeterminado es true; con false se fuerza a llamarlas una a una.

GPT-6 Sol / Luna y GPT-6.1 Sol: aún no se ha confirmado la compatibilidad con este parámetro; omítalo en las solicitudes básicas.

Ejemplo:

true

prompt_cache_key
string

Clave de agrupación de caché. GPT-6 / GPT-5.6 gestionan el enrutamiento automáticamente; este campo no es necesario para optimizarlo. Las claves separadas distinguen la reutilización y la contabilidad por cliente o usuario. Mantenga la misma clave para solicitudes que deban reutilizar un prefijo. En modelos anteriores, una clave estable ayuda al enrutamiento.

Ejemplo:

"app-chat-v1"

user
string

Identificador del usuario final, usado para distinguir el origen de las llamadas.

Ejemplo:

"user-1024"

prompt_cache_options
object

Opciones de caché para GPT-6 y GPT-5.6. Los puntos implícitos son el valor predeterminado. mode: "explicit" usa solo puntos explícitos; sin ellos no hay caché.

Ejemplo:

Respuesta

Generación de la conversación correcta (objeto JSON; con stream=true, un flujo de eventos SSE que termina con data: [DONE])

id
string

Identificador único de esta conversación

Ejemplo:

"chatcmpl-CvJ2p8mQxK7nR4wS"

object
enum<string>

Tipo de respuesta

Opciones disponibles:
chat.completion
Ejemplo:

"chat.completion"

created
integer

Marca de tiempo de creación

Ejemplo:

1786705221

model
string

Nombre del modelo real utilizado

Ejemplo:

"gpt-6.1-sol"

choices
object[]

Lista de resultados generados (su longitud es igual a n en la solicitud)

usage
object

Estadísticas de uso de tokens. La caché de prompts se aplica automáticamente y los tokens de entrada servidos desde caché se facturan a la tarifa de caché, más baja.

GPT-6 factura por separado entrada sin caché, lectura de caché, escritura de caché y salida. Si la entrada supera 272.000 tokens, toda la solicitud se factura a 2× las tarifas de entrada y caché y 1,5× la de salida. La generación de imágenes integrada se cobra aparte. Consulte los precios actuales.