> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Interfaz de todos los modelos Grok - Referencia completa de Chat Completions

> - Endpoint Chat Completions compatible con OpenAI para los modelos de texto xAI Grok; selecciona el modelo con el parámetro `model` (todos los valores están en la tabla del parámetro `model`)
- `grok-4.5`: ventana de contexto de 500K tokens; a partir de 200K tokens en el prompt, todos los tipos de token se facturan al doble
- El almacenamiento en caché del prompt es automático: los tokens de entrada servidos desde la caché se facturan a la tarifa de caché, más baja
- Modos sincrónico y streaming (SSE)
- Se admiten las llamadas a herramientas `function` normales; las herramientas del lado del servidor de xAI solo están disponibles en la [Responses API](../responses/responses-reference)

<Note>
  **BaseURL**: La BaseURL predeterminada es `https://direct.evolink.ai`, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. `https://api.evolink.ai` es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.
</Note>

<Note>
  **Las herramientas del lado del servidor** (búsqueda web, búsqueda en X, ejecución de código, búsqueda de adjuntos, búsqueda de colecciones) solo están disponibles en la [Responses API](../responses/responses-reference). El endpoint Chat Completions solo admite las llamadas a herramientas `function` normales.
</Note>


## OpenAPI

````yaml es/api-manual/language-series/grok/chat-completions/chat-completions-reference.json POST /v1/chat/completions
openapi: 3.1.0
info:
  title: Interfaz de todos los modelos Grok - Referencia completa de Chat Completions
  description: >-
    Referencia completa de parámetros para llamar a los modelos de texto xAI
    Grok mediante la API Chat Completions compatible con OpenAI.
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: Producción (recomendado)
  - url: https://api.evolink.ai
    description: URL alternativa
security:
  - bearerAuth: []
tags:
  - name: Chat Completion
    description: APIs relacionadas con completado de chat IA
paths:
  /v1/chat/completions:
    post:
      tags:
        - Completado de chat
      summary: Completado de chat Grok (todos los modelos, parámetros completos)
      description: >-
        - Endpoint Chat Completions compatible con OpenAI para los modelos de
        texto xAI Grok; selecciona el modelo con el parámetro `model` (todos los
        valores están en la tabla del parámetro `model`)

        - `grok-4.5`: ventana de contexto de 500K tokens; a partir de 200K
        tokens en el prompt, todos los tipos de token se facturan al doble

        - El almacenamiento en caché del prompt es automático: los tokens de
        entrada servidos desde la caché se facturan a la tarifa de caché, más
        baja

        - Modos sincrónico y streaming (SSE)

        - Se admiten las llamadas a herramientas `function` normales; las
        herramientas del lado del servidor de xAI solo están disponibles en la
        [Responses API](../responses/responses-reference)
      operationId: grokChatCompletionsReference
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ChatCompletionRequest'
      responses:
        '200':
          description: >-
            Completado de chat generado exitosamente (objeto JSON, o un flujo
            SSE de eventos `chat.completion.chunk` cuando `stream=true`)
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ChatCompletionResponse'
        '400':
          description: Parámetros de solicitud inválidos
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: No autorizado, token inválido o expirado
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Cuota insuficiente, se requiere recarga
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient quota
                  type: insufficient_quota_error
                  fallback_suggestion: https://evolink.ai/dashboard/billing
        '429':
          description: Límite de frecuencia de solicitudes excedido
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: Rate limit exceeded
                  type: rate_limit_error
                  fallback_suggestion: retry after 60 seconds
        '500':
          description: Error interno del servidor
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Internal server error
                  type: internal_server_error
                  fallback_suggestion: try again later
        '503':
          description: Servicio temporalmente no disponible
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 503
                  message: Service temporarily unavailable
                  type: service_unavailable_error
                  fallback_suggestion: retry after 30 seconds
components:
  schemas:
    ChatCompletionRequest:
      type: object
      required:
        - model
        - messages
      properties:
        model:
          type: string
          description: >-
            Modelo a invocar:


            | ID del modelo | Posicionamiento |

            |---|---|

            | `grok-4.5` | Modelo xAI de razonamiento y uso de herramientas,
            ventana de contexto de 500K |
          enum:
            - grok-4.5
          example: grok-4.5
        messages:
          type: array
          description: >-
            Lista de mensajes de chat. Admite los roles `system`, `user` y
            `assistant`.
          items:
            $ref: '#/components/schemas/Message'
          minItems: 1
          example:
            - role: system
              content: You are a concise assistant.
            - role: user
              content: Explain prompt caching in one sentence.
        stream:
          type: boolean
          description: >-
            Indica si se devuelve una respuesta en streaming (SSE, eventos
            `chat.completion.chunk`). Predeterminado `false`.
          default: false
          example: false
        max_tokens:
          type: integer
          description: Número máximo de tokens a generar. Se transmite al modelo tal cual.
          example: 1024
        temperature:
          type: number
          description: >-
            Temperatura de muestreo (0-2). Los valores más altos producen una
            salida más aleatoria.
          example: 0.7
        top_p:
          type: number
          description: Parámetro de muestreo nucleus (0-1).
          example: 0.95
        tools:
          type: array
          description: >-
            Definiciones de herramientas `function` normales de OpenAI (llamadas
            a funciones del lado del cliente, sin coste adicional por llamada).
            Las herramientas del lado del servidor de xAI solo están disponibles
            en la Responses API.
          items:
            $ref: '#/components/schemas/FunctionTool'
        tool_choice:
          description: >-
            Controla la selección de la función: `"auto"` / `"none"` /
            `"required"`, o un objeto que fija una función concreta.
          oneOf:
            - type: string
              enum:
                - auto
                - none
                - required
            - type: object
    ChatCompletionResponse:
      type: object
      properties:
        id:
          type: string
          description: Identificador único para la completación de chat
          example: chatcmpl-20260812164515123456789AbCdEfGh
        model:
          type: string
          description: Nombre del modelo realmente utilizado
          example: grok-4.5
        object:
          type: string
          enum:
            - chat.completion
          description: Tipo de respuesta
          example: chat.completion
        created:
          type: integer
          description: Marca de tiempo de creación
          example: 1786538000
        choices:
          type: array
          description: Lista de opciones de completado de chat
          items:
            $ref: '#/components/schemas/Choice'
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: Código de error de estado HTTP
            message:
              type: string
              description: Descripción del error
            type:
              type: string
              description: Tipo de error
            param:
              type: string
              description: Nombre del parámetro relacionado
            fallback_suggestion:
              type: string
              description: Sugerencia cuando ocurre un error
    Message:
      type: object
      required:
        - role
        - content
      properties:
        role:
          type: string
          description: Rol del mensaje
          enum:
            - system
            - user
            - assistant
        content:
          type: string
          description: Contenido del mensaje
    FunctionTool:
      type: object
      required:
        - type
        - function
      properties:
        type:
          type: string
          enum:
            - function
          description: >-
            Tipo de herramienta; el endpoint Chat Completions solo acepta
            `function`
        function:
          type: object
          description: >-
            Definición de la función: `name`, `description` y un objeto
            `parameters` en formato JSON Schema
    Choice:
      type: object
      properties:
        index:
          type: integer
          description: Índice de elección
          example: 0
        message:
          $ref: '#/components/schemas/AssistantMessage'
        finish_reason:
          type: string
          description: Razon de finalizacion
          enum:
            - stop
            - length
            - tool_calls
            - content_filter
          example: stop
    Usage:
      type: object
      description: >-
        Estadísticas de uso de tokens. Los prompts de 200K tokens o más se
        facturan al doble en todos los tipos de token (entrada, entrada en
        caché, salida).
      properties:
        prompt_tokens:
          type: integer
          description: Número de tokens en el contenido de entrada
          example: 504
        completion_tokens:
          type: integer
          description: Número de tokens en el contenido de salida
          example: 2
        total_tokens:
          type: integer
          description: Número total de tokens
          example: 526
        prompt_tokens_details:
          type: object
          description: Información detallada de tokens de entrada
          properties:
            cached_tokens:
              type: integer
              description: >-
                Número de tokens del prompt servidos desde la caché (facturados
                a la tarifa de caché, más baja; el almacenamiento en caché es
                automático)
              example: 0
    AssistantMessage:
      type: object
      properties:
        role:
          type: string
          description: Rol del remitente del mensaje
          enum:
            - assistant
          example: assistant
        content:
          type: string
          description: Contenido del mensaje de respuesta de la IA
          example: >-
            Prompt caching reuses previously processed prompt prefixes so
            repeated context is billed at a lower rate.
        tool_calls:
          type: array
          description: >-
            Llamadas a funciones solicitadas por el modelo (presentes al usar
            herramientas `function`)
          items:
            type: object
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Todas las APIs requieren autenticación Bearer Token##


        **Obtener API Key:**


        Visita la [Página de gestión de API
        Key](https://evolink.ai/dashboard/keys) para obtener tu API Key


        **Agregar al encabezado de la solicitud:**

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````