Interfaz de todos los modelos GPT - Referencia completa de Chat Completions
- API Chat Completions compatible con OpenAI para los modelos de texto de la serie GPT; el modelo concreto se elige mediante
model(todos los valores posibles están en la tabla comparativa del parámetromodel) - Toda la serie está formada por modelos de razonamiento; la profundidad se controla con
reasoning_efforty los tokens de razonamiento se facturan como tokens de salida - La caché de prompts se aplica automáticamente: los tokens de entrada servidos desde caché se facturan a la tarifa de caché, más baja
- Admite los modos síncrono y en streaming (SSE)
- Admite entrada mixta de texto e imagen, así como llamadas a herramientas
function - Las herramientas del lado del servidor (búsqueda web, ejecución de código, búsqueda documental, MCP) solo se ofrecen en la API Responses
- Nota El alcance de compatibilidad de los parámetros de muestreo (
temperature,top_p,logprobs, etc.) varía según el modelo; consulta las notas de cada parámetro más abajo
https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.function normales.stop (secuencias de parada) y web_search_options no se admiten en ningún modelo y devuelven 400 si se envían; logit_bias no es aplicable a esta serie de modelos.El alcance de compatibilidad de temperature, top_p, frequency_penalty, presence_penalty, logprobs y verbosity varía según el modelo: consulta las notas de cada parámetro más arriba.Autorizaciones
##Todas las APIs requieren autenticación Bearer Token##
Obtener API Key:
Visita la Página de gestión de API Key para obtener tu API Key
Agregar al encabezado de la solicitud:
Cuerpo
Modelo a invocar:
gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-5.5, gpt-5.4, gpt-5.2, gpt-5.1 "gpt-5.6-sol"
Lista de mensajes de chat, admite contexto de varios turnos y entrada multimodal.
role puede ser system / developer / user / assistant / tool.
content puede ser una cadena o un array de bloques de contenido. Se admiten dos tipos de bloque: text (texto) e image_url (imagen):
Imagen
- Envía en
image_url.urlla URL pública de la imagen image_urltambién puede escribirse directamente como una cadena, equivalente a{ "url": "..." }detailcontrola la precisión del análisis de la imagen:auto(predeterminado) /low/high/original- La imagen debe poder descargarse, de lo contrario se devuelve
400
Nota Los tipos de bloque de esta API son distintos de los de la API Responses (que usa input_text / input_image). No pueden mezclarse; usarlos mal devuelve 400.
Si la respuesta se devuelve en streaming (flujo de eventos SSE, que termina con data: [DONE]). El valor predeterminado es false.
false
Número máximo de tokens a generar (incluidos los tokens de razonamiento).
Nota Esta serie de modelos usa max_completion_tokens. Por compatibilidad con código antiguo, enviar solo max_tokens se interpreta automáticamente como max_completion_tokens; sin embargo, no envíes ambos campos a la vez — en gpt-5.1 / gpt-5.2 / gpt-5.4 enviarlos juntos devuelve 400.
2048
Control de la profundidad de razonamiento. Los valores posibles varían según el modelo:
Los tokens de razonamiento se facturan como tokens de salida y se contabilizan en usage.completion_tokens_details.reasoning_tokens.
none, low, medium, high, xhigh "medium"
Nivel de detalle de la respuesta: low / medium / high.
Nota Solo lo admiten gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5; los demás modelos no admiten este parámetro.
low, medium, high "low"
Temperatura de muestreo, con valores de 0 a 2. Cuanto más bajo, más determinista es la salida.
Nota Solo la admiten gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1. La familia gpt-5.6 solo acepta el valor predeterminado 1; enviar cualquier otro valor devuelve 400.
0 <= x <= 20.7
Parámetro de muestreo por núcleo, con valores de 0 a 1. No se recomienda ajustarlo junto con temperature.
Nota Solo lo admiten gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1; la familia gpt-5.6 no admite este parámetro.
0 <= x <= 10.9
Penalización por frecuencia, con valores de -2 a 2. Los valores positivos penalizan los tokens según su frecuencia de aparición y reducen el contenido repetido.
Nota Solo la admiten gpt-5.4 / gpt-5.2 / gpt-5.1; la familia gpt-5.6 y gpt-5.5 no admiten este parámetro.
-2 <= x <= 20.5
Penalización por presencia, con valores de -2 a 2. Los valores positivos animan al modelo a tratar temas nuevos.
Nota Solo la admiten gpt-5.4 / gpt-5.2 / gpt-5.1; la familia gpt-5.6 y gpt-5.5 no admiten este parámetro.
-2 <= x <= 20.5
Si se devuelven las probabilidades logarítmicas de cada token de salida.
Nota Solo lo admiten gpt-5.4 / gpt-5.2 / gpt-5.1; la familia gpt-5.6 y gpt-5.5 no admiten este parámetro.
true
Número de tokens candidatos devueltos en cada posición, con valores de 0 a 5; debe usarse junto con logprobs: true.
Nota El alcance de compatibilidad es el mismo que el de logprobs.
0 <= x <= 52
Número de respuestas candidatas a generar, devueltas como varios elementos del array choices. Se facturan todos los tokens (incluida la salida de cada candidata).
1
Semilla aleatoria. Con la misma semilla y la misma combinación de parámetros, el modelo intenta devolver resultados coherentes (en la medida de lo posible; no se garantiza una reproducibilidad total).
42
Control del formato de salida:
{"type": "text"}: texto libre, el valor predeterminado{"type": "json_object"}: devuelve JSON válido y exige que la palabrajsonaparezca enmessages, de lo contrario devuelve400{"type": "json_schema", "json_schema": {...}}: devuelve resultados estructurados conforme al JSON Schema indicado; combínalo con"strict": truepara forzar la conformidad con el esquema
Lista de herramientas, usada para Function Calling (llamadas a funciones del lado del cliente, sin coste por llamada).
Las herramientas del lado del servidor (búsqueda web, ejecución de código, etc.) no se ofrecen en esta API; utiliza en su lugar la API Responses.
Control de la selección de herramientas: "auto" (predeterminado) / "none" / "required", o un objeto que indica una función concreta, como {"type": "function", "function": {"name": "get_weather"}}.
none, auto, required Si el modelo puede llamar a varias herramientas en paralelo dentro de un mismo turno. El valor predeterminado es true; con false se fuerza a llamarlas una a una.
true
Clave de agrupación de caché. Enviar el mismo valor para solicitudes que comparten el mismo prefijo mejora la tasa de aciertos de la caché de prompts.
"app-chat-v1"
Identificador del usuario final, usado para distinguir el origen de las llamadas.
"user-1024"
Respuesta
Generación de la conversación correcta (objeto JSON; con stream=true, un flujo de eventos SSE que termina con data: [DONE])
Identificador único de esta conversación
"chatcmpl-CvJ2p8mQxK7nR4wS"
Tipo de respuesta
chat.completion "chat.completion"
Marca de tiempo de creación
1786705221
Nombre del modelo real utilizado
"gpt-5.6-sol"
Lista de resultados generados (su longitud es igual a n en la solicitud)
Estadísticas de uso de tokens. La caché de prompts se aplica automáticamente y los tokens de entrada servidos desde caché se facturan a la tarifa de caché, más baja.