> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Interfaz de todos los modelos Gemini - formato de API nativa

> Selecciona el modelo de texto Gemini que deseas invocar mediante `{model}` en la ruta (consulta la tabla de referencia del parámetro `model` para ver todos los valores posibles).

- Usa el formato de API nativa de Google y devuelve el contenido de la conversación de forma síncrona
- **Entrada de texto plano / multimodal**: entrada mixta de texto + imagen / audio / video
- **Streaming**: reemplaza `generateContent` por `streamGenerateContent` en la ruta (puedes añadir `?alt=sse` para obtener SSE)

---

**Especificaciones y diferencias de los modelos**
- **Parámetros de muestreo** `temperature` / `topP` / `topK`: `gemini-3.6-flash` y `gemini-3.5-flash-lite` no admiten personalización y los valores enviados no surten efecto; el resto de los modelos funcionan con normalidad.
- **Control del razonamiento**: la serie Gemini 3.x usa `thinkingConfig.thinkingLevel` (consulta el parámetro `thinkingLevel` para ver los niveles admitidos y el valor por defecto de cada modelo); la serie Gemini 2.5 usa `thinkingConfig.thinkingBudget` (entero, `0`=desactivado). Ambos son mutuamente excluyentes.
- **Llamadas a funciones**: en Gemini 3.x, el `FunctionResponse` debe devolver el `id` y el `name` que coincidan con el `FunctionCall` correspondiente; de lo contrario, se produce un error.
- **Rol del último turno**: el `role` del último mensaje no puede ser `model` (Gemini 3.5+ devuelve un error).
- **Límite de tokens**: `gemini-3.6-flash` / `gemini-3.5-flash-lite` tienen un contexto de 1,048,576 y una salida máxima de 65,536; el resto de los modelos se rigen por sus propias especificaciones.

<Tip>
  **Streaming**: Reemplace `generateContent` por `streamGenerateContent` en la URL. Los parámetros del cuerpo de la solicitud son idénticos. Las respuestas se devolverán en bloques de streaming. Consulte la sección «Respuesta en streaming» a continuación para el formato de respuesta.
</Tip>

<Note>
  **BaseURL**: La BaseURL predeterminada es `https://direct.evolink.ai`, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. `https://api.evolink.ai` es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.
</Note>


## OpenAPI

````yaml es/api-manual/language-series/gemini/native-api/native-api-reference.json POST /v1beta/models/{model}:generateContent
openapi: 3.1.0
info:
  title: Interfaz de todos los modelos Gemini (formato de API nativa)
  description: >-
    Interfaz nativa unificada para toda la serie de modelos de texto Gemini;
    selecciona el modelo específico mediante model en la ruta y admite entradas
    de texto y multimodales (imagen / audio / video).
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: Producción (recomendado)
  - url: https://api.evolink.ai
    description: URL alternativa
security:
  - bearerAuth: []
tags:
  - name: Generación de contenido
    description: Generación de contenido Gemini
paths:
  /v1beta/models/{model}:generateContent:
    post:
      tags:
        - Generación de contenido
      summary: Generación de contenido Gemini (todos los modelos)
      description: >-
        Selecciona el modelo de texto Gemini que deseas invocar mediante
        `{model}` en la ruta (consulta la tabla de referencia del parámetro
        `model` para ver todos los valores posibles).


        - Usa el formato de API nativa de Google y devuelve el contenido de la
        conversación de forma síncrona

        - **Entrada de texto plano / multimodal**: entrada mixta de texto +
        imagen / audio / video

        - **Streaming**: reemplaza `generateContent` por `streamGenerateContent`
        en la ruta (puedes añadir `?alt=sse` para obtener SSE)


        ---


        **Especificaciones y diferencias de los modelos**

        - **Parámetros de muestreo** `temperature` / `topP` / `topK`:
        `gemini-3.6-flash` y `gemini-3.5-flash-lite` no admiten personalización
        y los valores enviados no surten efecto; el resto de los modelos
        funcionan con normalidad.

        - **Control del razonamiento**: la serie Gemini 3.x usa
        `thinkingConfig.thinkingLevel` (consulta el parámetro `thinkingLevel`
        para ver los niveles admitidos y el valor por defecto de cada modelo);
        la serie Gemini 2.5 usa `thinkingConfig.thinkingBudget` (entero,
        `0`=desactivado). Ambos son mutuamente excluyentes.

        - **Llamadas a funciones**: en Gemini 3.x, el `FunctionResponse` debe
        devolver el `id` y el `name` que coincidan con el `FunctionCall`
        correspondiente; de lo contrario, se produce un error.

        - **Rol del último turno**: el `role` del último mensaje no puede ser
        `model` (Gemini 3.5+ devuelve un error).

        - **Límite de tokens**: `gemini-3.6-flash` / `gemini-3.5-flash-lite`
        tienen un contexto de 1,048,576 y una salida máxima de 65,536; el resto
        de los modelos se rigen por sus propias especificaciones.
      operationId: geminiGenerateContent
      parameters:
        - name: model
          in: path
          required: true
          description: >-
            Selecciona el modelo de texto Gemini que deseas invocar:


            | ID del modelo | Serie | Posicionamiento |

            |---|---|---|

            | `gemini-3.6-flash` | 3.6 Flash | Orquestación multipaso /
            refactorización de código / razonamiento general |

            | `gemini-3.5-flash` | 3.5 Flash | Flash general |

            | `gemini-3.5-flash-lite` | 3.5 Flash-Lite | Bajo costo / alto
            rendimiento / agente ligero |

            | `gemini-3.1-pro-preview` | 3.1 Pro (Preview) | Razonamiento
            avanzado |

            | `gemini-3.1-pro-preview-customtools` | 3.1 Pro · CustomTools |
            Razonamiento avanzado + herramientas personalizadas |

            | `gemini-3.1-flash-lite-preview` | 3.1 Flash-Lite (Preview) | Bajo
            costo |

            | `gemini-3-pro-preview` | 3.0 Pro (Preview) | Razonamiento avanzado
            |

            | `gemini-3-flash-preview` | 3.0 Flash (Preview) | Flash general |

            | `gemini-2.5-pro` | 2.5 Pro | Razonamiento avanzado |

            | `gemini-2.5-flash` | 2.5 Flash | Flash general |

            | `gemini-2.5-flash-lite` | 2.5 Flash-Lite | Bajo costo |
          schema:
            type: string
            enum:
              - gemini-3.6-flash
              - gemini-3.5-flash
              - gemini-3.5-flash-lite
              - gemini-3.1-pro-preview
              - gemini-3.1-pro-preview-customtools
              - gemini-3.1-flash-lite-preview
              - gemini-3-pro-preview
              - gemini-3-flash-preview
              - gemini-2.5-pro
              - gemini-2.5-flash
              - gemini-2.5-flash-lite
            example: gemini-3.6-flash
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/GenerateContentRequest'
            examples:
              simple_text:
                summary: Conversación de texto de un solo turno
                value:
                  contents:
                    - role: user
                      parts:
                        - text: Please introduce yourself
              multi_turn:
                summary: Conversación multi-turno (comprensión de contexto)
                value:
                  contents:
                    - role: user
                      parts:
                        - text: What is Python?
                    - role: model
                      parts:
                        - text: Python is a high-level programming language...
                    - role: user
                      parts:
                        - text: What are its advantages?
              audio_analysis:
                summary: Análisis de audio
                value:
                  contents:
                    - role: user
                      parts:
                        - text: >-
                            Please analyze this song audio and answer: 1. Song
                            source and artist 2. Song mood 3. Complete lyrics
                            output
                        - fileData:
                            mimeType: audio/mp3
                            fileUri: https://example.com/audio.mp3
              image_understanding:
                summary: Comprensión de imágenes
                value:
                  contents:
                    - role: user
                      parts:
                        - text: >-
                            Please describe the scene and main elements in this
                            image in detail
                        - fileData:
                            mimeType: image/jpeg
                            fileUri: https://example.com/image.jpg
              multi_file:
                summary: Entrada de múltiples archivos (mixta)
                value:
                  contents:
                    - role: user
                      parts:
                        - text: >-
                            Compare the relationship between these two images
                            and this audio
                        - fileData:
                            mimeType: image/jpeg
                            fileUri: https://example.com/image1.jpg
                        - fileData:
                            mimeType: image/png
                            fileUri: https://example.com/image2.png
                        - fileData:
                            mimeType: audio/mp3
                            fileUri: https://example.com/audio.mp3
      responses:
        '200':
          description: >-
            Contenido generado exitosamente


            **Descripción del formato de respuesta**:

            - Al usar el endpoint `generateContent`, devuelve
            `GenerateContentResponse` (devuelve la respuesta completa de una
            vez)

            - Al usar el endpoint `streamGenerateContent`, devuelve
            `StreamGenerateContentResponse` (respuesta en streaming, devuelve
            contenido en fragmentos)
          content:
            application/json:
              schema:
                oneOf:
                  - $ref: '#/components/schemas/GenerateContentResponse'
                  - $ref: '#/components/schemas/StreamGenerateContentResponse'
        '400':
          description: Parámetros de solicitud inválidos
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Parámetros de solicitud inválidos
                  type: invalid_request_error
        '401':
          description: No autorizado, token inválido o expirado
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Cuota insuficiente, se requiere recarga
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Cuota insuficiente
                  type: insufficient_quota_error
                  fallback_suggestion: https://evolink.ai/dashboard/billing
        '403':
          description: Acceso denegado
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 403
                  message: Access denied for this model
                  type: permission_error
        '404':
          description: Recurso no encontrado
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 404
                  message: Model not found
                  type: not_found_error
        '413':
          description: Cuerpo de solicitud demasiado grande, archivo demasiado grande
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 413
                  message: Cuerpo de solicitud demasiado grande
                  type: request_too_large_error
                  fallback_suggestion: reduce file size
        '429':
          description: >-
            Semilla aleatoria, rango `[1, 2147483647]`


            **Nota:**

            - Usar el mismo valor de semilla puede mantener resultados de
            generación consistentes

            - Dejar vacío para semilla aleatoria
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: >-
                    Semilla aleatoria, rango `[1, 2147483647]`


                    **Nota:**

                    - Usar el mismo valor de semilla puede mantener resultados
                    de generación consistentes

                    - Dejar vacío para semilla aleatoria
                  type: rate_limit_error
                  fallback_suggestion: retry after 60 seconds
        '500':
          description: Error interno del servidor
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Error interno del servidor
                  type: internal_server_error
                  fallback_suggestion: try again later
        '502':
          description: Error del servicio upstream
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 502
                  message: Upstream AI service unavailable
                  type: upstream_error
                  fallback_suggestion: try again later
        '503':
          description: Servicio temporalmente no disponible
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 503
                  message: Servicio temporalmente no disponible
                  type: service_unavailable_error
                  fallback_suggestion: retry after 30 seconds
components:
  schemas:
    GenerateContentRequest:
      type: object
      required:
        - contents
      properties:
        contents:
          type: array
          description: >-
            List of conversation contents, supports multi-turn dialogue and
            multimodal input
          items:
            $ref: '#/components/schemas/Content'
          minItems: 1
        generationConfig:
          $ref: '#/components/schemas/GenerationConfig'
          description: Generation configuration parameters (optional)
        systemInstruction:
          $ref: '#/components/schemas/Content'
          description: System instruction (optional), mainly text content
        tools:
          type: array
          items:
            type: object
          description: >-
            List of tools the model can call, such as function calling or code
            execution
        toolConfig:
          type: object
          description: Tool calling configuration (optional)
        safetySettings:
          type: array
          items:
            type: object
          description: Safety settings list (optional)
        cachedContent:
          type: string
          description: Cached content name, in the form cachedContents/{cachedContent}
    GenerateContentResponse:
      title: Respuesta sincrónica
      type: object
      properties:
        candidates:
          type: array
          description: List of candidate responses
          items:
            $ref: '#/components/schemas/Candidate'
        promptFeedback:
          $ref: '#/components/schemas/PromptFeedback'
        usageMetadata:
          $ref: '#/components/schemas/UsageMetadata'
        modelVersion:
          type: string
          description: Model version
          example: gemini-3.6-flash
        responseId:
          type: string
          description: Response ID
          example: l-LoaPu0BPmo1dkP6ZPHiQc
    StreamGenerateContentResponse:
      title: Respuesta en streaming
      type: object
      description: |-
        Fragmento de respuesta en streaming

        **Fragmento intermedio**:
        ```json
        {
          "candidates": [
            {
              "content": {
                "role": "model",
                "parts": [{ "text": "Texto parcial..." }]
              }
            }
          ],
          "usageMetadata": {
            "trafficType": "ON_DEMAND"
          },
          "modelVersion": "gemini-3.6-flash",
          "createTime": "2025-10-10T10:40:23.072315Z",
          "responseId": "xxx"
        }
        ```

        **Último fragmento**:
        ```json
        {
          "candidates": [
            {
              "content": {
                "role": "model",
                "parts": [{ "text": "Fragmento de texto final" }]
              },
              "finishReason": "STOP"
            }
          ],
          "usageMetadata": {
            "promptTokenCount": 4,
            "candidatesTokenCount": 522,
            "totalTokenCount": 2191,
            "trafficType": "ON_DEMAND"
          },
          "modelVersion": "gemini-3.6-flash",
          "createTime": "2025-10-10T10:40:23.072315Z",
          "responseId": "xxx"
        }
        ```
      properties:
        candidates:
          type: array
          description: >-
            Lista de respuestas candidatas (el modo streaming no incluye index y
            safetyRatings)
          items:
            $ref: '#/components/schemas/StreamCandidate'
        usageMetadata:
          type: object
          description: >-
            Estadísticas de uso (los fragmentos intermedios solo tienen
            trafficType, el último fragmento contiene estadísticas completas)
          properties:
            promptTokenCount:
              type: integer
              description: >-
                Número de tokens en el contenido de entrada (solo último
                fragmento)
              example: 4
            candidatesTokenCount:
              type: integer
              description: >-
                Número de tokens en el contenido de salida (solo último
                fragmento)
              example: 522
            totalTokenCount:
              type: integer
              description: Número total de tokens (solo último fragmento)
              example: 2191
            trafficType:
              type: string
              description: Tipo de tráfico
              example: ON_DEMAND
            cachedContentTokenCount:
              type: integer
              description: Number of cached content tokens (last chunk only)
              example: 0
        modelVersion:
          type: string
          description: Versión del modelo
          example: gemini-3.6-flash
        createTime:
          type: string
          format: date-time
          description: Hora de creación
          example: '2025-10-10T10:40:23.072315Z'
        responseId:
          type: string
          description: ID de respuesta
          example: l-LoaPu0BPmo1dkP6ZPHiQc
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: Código de error de estado HTTP
            message:
              type: string
              description: Mensaje de descripción del error
            type:
              type: string
              description: Tiempo estimado de finalización (segundos)
            fallback_suggestion:
              type: string
              description: Sugerencia cuando ocurre un error
    Content:
      type: object
      required:
        - role
        - parts
      properties:
        role:
          type: string
          description: >-
            Rol del contenido


            - `user`: Entrada del usuario

            - `model`: Respuesta del modelo de IA (para conversación de
            múltiples turnos)
          enum:
            - user
            - model
          example: user
        parts:
          type: array
          description: >-
            Content parts list, supports text, file data, inline data, function
            calls, function responses, and code execution results
          items:
            $ref: '#/components/schemas/Part'
          minItems: 1
    GenerationConfig:
      type: object
      description: Generation configuration parameters
      properties:
        temperature:
          type: number
          description: >-
            Temperatura de muestreo, controla la aleatoriedad de la salida


            **Descripción**:

            - Valores más bajos (ej., 0.2): Salida más determinista y enfocada

            - Valores más altos (ej., 1.5): Salida más aleatoria y creativa


            ⚠️ `gemini-3.6-flash` y `gemini-3.5-flash-lite` no admiten la
            personalización de este parámetro (los valores enviados no surten
            efecto); el resto de los modelos funcionan con normalidad.
          minimum: 0
          maximum: 2
          example: 0.7
        maxOutputTokens:
          type: integer
          description: >-
            Número máximo de tokens para la respuesta generada


            **Descripción**:

            - Un valor demasiado pequeño puede causar truncamiento de la
            respuesta


            `gemini-3.6-flash` / `gemini-3.5-flash-lite` tienen un límite de
            65,536 tokens; el resto de los modelos se rigen por sus propias
            especificaciones.
          minimum: 1
          example: 2000
        topP:
          type: number
          description: >-
            Parámetro de muestreo Nucleus


            **Descripción**:

            - Controla el muestreo de tokens con probabilidad acumulativa

            - Por ejemplo, 0.9 significa seleccionar de tokens con probabilidad
            acumulativa hasta el 90%

            - Predeterminado: 1.0 (considera todos los tokens)


            **Recomendación**: No ajuste temperature y topP simultáneamente


            ⚠️ `gemini-3.6-flash` y `gemini-3.5-flash-lite` no admiten la
            personalización de este parámetro (los valores enviados no surten
            efecto); el resto de los modelos funcionan con normalidad.
          minimum: 0
          maximum: 1
          example: 0.9
        topK:
          type: integer
          description: >-
            Parámetro de muestreo Top-K


            **Descripción**:

            - Por ejemplo, 10 significa limitar el muestreo a considerar solo
            los 10 tokens más probables

            - Valores más pequeños hacen la salida más enfocada

            - Predeterminado: sin límite


            ⚠️ `gemini-3.6-flash` y `gemini-3.5-flash-lite` no admiten la
            personalización de este parámetro (los valores enviados no surten
            efecto); el resto de los modelos funcionan con normalidad.
          minimum: 1
          example: 40
        responseMimeType:
          type: string
          description: >-
            MIME type of generated candidate content, for example text/plain or
            application/json
          example: application/json
        responseSchema:
          type: object
          description: >-
            Output schema definition for generated content (JSON mode /
            structured output)
        responseJsonSchema:
          type: object
          description: >-
            JSON Schema for generated content (useful for more complex
            structured output)
        thinkingConfig:
          type: object
          description: >-
            Configuración de razonamiento; controla el comportamiento de
            razonamiento del modelo.


            - **Serie Gemini 3.x**: usa `thinkingLevel` (consulta el parámetro
            `thinkingLevel` para ver los niveles admitidos y el valor por
            defecto de cada modelo)

            - **Serie Gemini 2.5**: usa `thinkingBudget`


            ⚠️ `thinkingLevel` y `thinkingBudget` son mutuamente excluyentes;
            enviar ambos a la vez provoca un error.
          properties:
            thinkingLevel:
              type: string
              enum:
                - minimal
                - low
                - medium
                - high
              description: >-
                Nivel de razonamiento; controla la profundidad del razonamiento
                (no distingue mayúsculas de minúsculas):

                - `minimal`: razonamiento casi nulo, orientado a escenarios de
                alto rendimiento / baja latencia (clasificación, extracción,
                enrutamiento, etc.)

                - `low`: menos razonamiento, adecuado para tareas simples

                - `medium`: equilibrio entre calidad y velocidad, adecuado para
                tareas de complejidad media

                - `high`: razonamiento profundo de múltiples pasos, adecuado
                para razonamiento complejo, matemáticas y codificación


                **Solo lo admite la serie Gemini 3.x**, y los niveles admitidos
                y el valor por defecto difieren según el modelo (la serie Gemini
                2.5 usa `thinkingBudget` en su lugar):


                | Modelo | Niveles admitidos | Por defecto |

                |---|---|---|

                | `gemini-3.6-flash` | `minimal` / `low` / `medium` / `high` |
                `medium` |

                | `gemini-3.5-flash` | `minimal` / `low` / `medium` / `high` |
                `medium` |

                | `gemini-3.5-flash-lite` | `minimal` / `low` / `medium` /
                `high` | `minimal` |

                | `gemini-3.1-flash-lite-preview` | `minimal` / `low` / `medium`
                / `high` | `minimal` |

                | `gemini-3-flash-preview` | `minimal` / `low` / `medium` /
                `high` | `medium` |

                | `gemini-3.1-pro-preview` | `low` / `medium` / `high` | `high`
                |

                | `gemini-3.1-pro-preview-customtools` | `low` / `medium` /
                `high` | `high` |

                | `gemini-3-pro-preview` | `low` / `medium` / `high` | `high` |


                Enviar un nivel no admitido por el modelo provoca un error (por
                ejemplo, enviar `minimal` a la serie Pro devuelve un 400 del
                upstream).
              example: minimal
            thinkingBudget:
              type: integer
              description: >-
                Presupuesto de tokens de razonamiento; lo usa la **serie Gemini
                2.5** (`gemini-2.5-flash` / `gemini-2.5-flash-lite` /
                `gemini-2.5-pro`): `0`=desactivar el razonamiento,
                `-1`=presupuesto dinámico, entero positivo=presupuesto fijo (el
                rango de valores concreto depende de cada modelo). Es mutuamente
                excluyente con `thinkingLevel`.
              example: -1
    Candidate:
      type: object
      properties:
        content:
          $ref: '#/components/schemas/ContentResponse'
        finishReason:
          type: string
          description: Finish reason
          enum:
            - FINISH_REASON_UNSPECIFIED
            - STOP
            - MAX_TOKENS
            - SAFETY
            - RECITATION
            - LANGUAGE
            - OTHER
            - BLOCKLIST
            - PROHIBITED_CONTENT
            - SPII
            - MALFORMED_FUNCTION_CALL
            - IMAGE_SAFETY
            - IMAGE_PROHIBITED_CONTENT
            - IMAGE_OTHER
            - NO_IMAGE
            - IMAGE_RECITATION
            - UNEXPECTED_TOOL_CALL
            - TOO_MANY_TOOL_CALLS
            - MISSING_THOUGHT_SIGNATURE
          example: STOP
        index:
          type: integer
          description: Índice del candidato
          example: 0
        safetyRatings:
          type: array
          nullable: true
          description: Calificaciones de seguridad
          items:
            type: object
    PromptFeedback:
      type: object
      properties:
        safetyRatings:
          type: array
          nullable: true
          description: Calificaciones de seguridad del prompt
          items:
            type: object
    UsageMetadata:
      type: object
      description: Estadísticas de uso
      properties:
        promptTokenCount:
          type: integer
          description: Número de tokens en el contenido de entrada
          example: 4
        candidatesTokenCount:
          type: integer
          description: Número de tokens en el contenido de salida
          example: 611
        totalTokenCount:
          type: integer
          description: Número total de tokens
          example: 2422
        thoughtsTokenCount:
          type: integer
          description: Número de tokens de razonamiento
          example: 1807
        promptTokensDetails:
          type: array
          description: Información detallada de tokens de entrada (por modalidad)
          items:
            $ref: '#/components/schemas/TokenDetail'
        cachedContentTokenCount:
          type: integer
          description: Number of cached content tokens
          example: 0
    StreamCandidate:
      type: object
      description: Stream response candidate (more simplified than regular response)
      properties:
        content:
          $ref: '#/components/schemas/ContentResponse'
        finishReason:
          type: string
          description: Finish reason (only included in last chunk)
          enum:
            - FINISH_REASON_UNSPECIFIED
            - STOP
            - MAX_TOKENS
            - SAFETY
            - RECITATION
            - LANGUAGE
            - OTHER
            - BLOCKLIST
            - PROHIBITED_CONTENT
            - SPII
            - MALFORMED_FUNCTION_CALL
            - IMAGE_SAFETY
            - IMAGE_PROHIBITED_CONTENT
            - IMAGE_OTHER
            - NO_IMAGE
            - IMAGE_RECITATION
            - UNEXPECTED_TOOL_CALL
            - TOO_MANY_TOOL_CALLS
            - MISSING_THOUGHT_SIGNATURE
          example: STOP
    Part:
      oneOf:
        - $ref: '#/components/schemas/TextPart'
        - $ref: '#/components/schemas/FilePart'
        - $ref: '#/components/schemas/InlineDataPart'
        - $ref: '#/components/schemas/FunctionCallPart'
        - $ref: '#/components/schemas/FunctionResponsePart'
        - $ref: '#/components/schemas/ExecutableCodePart'
        - $ref: '#/components/schemas/CodeExecutionResultPart'
      description: >-
        Content part union type. The thoughtSignature returned by thinking
        models must be echoed back in the next turn.
    ContentResponse:
      type: object
      properties:
        role:
          type: string
          description: Rol de respuesta
          enum:
            - model
          example: model
        parts:
          type: array
          description: >-
            Response content parts, supports text, inline data, function calls,
            function responses, and code execution results
          items:
            $ref: '#/components/schemas/Part'
    TokenDetail:
      type: object
      description: Detalles de tokens (estadísticas por modalidad)
      properties:
        modality:
          type: string
          description: Content modality type
          enum:
            - MODALITY_UNSPECIFIED
            - TEXT
            - IMAGE
            - AUDIO
            - VIDEO
            - DOCUMENT
          example: TEXT
        tokenCount:
          type: integer
          description: Número de tokens para esta modalidad
          example: 4
    TextPart:
      title: Entrada de texto
      type: object
      required:
        - text
      properties:
        text:
          type: string
          description: Contenido de texto
          example: |-
            Hello! I'm pleased to introduce myself.

            I'm a large language model, trained and developed by Google...
        thought:
          type: boolean
          description: Whether this is thought content
        thoughtSignature:
          type: string
          description: Thought signature, must be echoed back in the next turn
          example: <Signature_A>
    FilePart:
      title: Entrada multimodal
      type: object
      required:
        - fileData
      properties:
        fileData:
          type: object
          required:
            - mimeType
            - fileUri
          properties:
            mimeType:
              type: string
              description: Entorno del servicio de archivos
              example: audio/mp3
            fileUri:
              type: string
              format: uri
              description: Subida de archivos
              example: https://example.com/audio.mp3
    InlineDataPart:
      title: Inline Data
      type: object
      required:
        - inlineData
      properties:
        inlineData:
          $ref: '#/components/schemas/BlobData'
        thought:
          type: boolean
          description: Whether this is thought content
        thoughtSignature:
          type: string
          description: Thought signature, must be echoed back in the next turn
          example: <Signature_A>
    FunctionCallPart:
      title: Function Call
      type: object
      required:
        - functionCall
      properties:
        functionCall:
          $ref: '#/components/schemas/FunctionCall'
        thought:
          type: boolean
          description: Whether this is thought content
        thoughtSignature:
          type: string
          description: Thought signature, must be echoed back in the next turn
          example: <Signature_A>
    FunctionResponsePart:
      title: Function Response
      type: object
      required:
        - functionResponse
      properties:
        functionResponse:
          $ref: '#/components/schemas/FunctionResponse'
    ExecutableCodePart:
      title: Generated Code
      type: object
      required:
        - executableCode
      properties:
        executableCode:
          $ref: '#/components/schemas/ExecutableCode'
    CodeExecutionResultPart:
      title: Code Execution Result
      type: object
      required:
        - codeExecutionResult
      properties:
        codeExecutionResult:
          $ref: '#/components/schemas/CodeExecutionResult'
    BlobData:
      type: object
      properties:
        mimeType:
          type: string
          description: IANA MIME type
          example: image/png
        data:
          type: string
          format: byte
          description: Base64-encoded raw media data
      required:
        - mimeType
        - data
    FunctionCall:
      type: object
      required:
        - name
        - args
      properties:
        name:
          type: string
          description: Function name
          example: get_weather
        args:
          type: object
          description: Function arguments
        id:
          type: string
          description: >-
            ID de la llamada. En Gemini 3.x lo genera el modelo y se usa para
            emparejar llamadas a funciones en paralelo.
          example: fc-abc123
    FunctionResponse:
      type: object
      required:
        - name
        - response
      properties:
        name:
          type: string
          description: Function name
          example: get_weather
        parts:
          type: array
          description: Optional multimodal response parts
          items:
            $ref: '#/components/schemas/FunctionResponseMediaPart'
        response:
          type: object
          description: Function response payload
        id:
          type: string
          description: >-
            ID de la llamada correspondiente al `FunctionCall` (algunos
            documentos / SDK lo llaman `call_id`). **En Gemini 3.x es
            obligatorio devolverlo**; se usa junto con `name` para el
            emparejamiento; de lo contrario, se produce un error.
          example: fc-abc123
    ExecutableCode:
      type: object
      required:
        - language
        - code
      properties:
        language:
          type: string
          description: Code language
          example: python
        code:
          type: string
          description: Generated code
    CodeExecutionResult:
      type: object
      required:
        - outcome
      properties:
        outcome:
          type: string
          description: Code execution result
          enum:
            - OUTCOME_UNSPECIFIED
            - OUTCOME_OK
            - OUTCOME_FAILED
            - OUTCOME_DEADLINE_EXCEEDED
          example: OUTCOME_OK
        output:
          type: string
          description: Standard output, error output, or other description
    FunctionResponseMediaPart:
      type: object
      required:
        - inlineData
      properties:
        inlineData:
          $ref: '#/components/schemas/BlobData'
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Todas las APIs requieren autenticación Bearer Token##


        **Obtener API Key:**


        Visita la [Página de gestión de API
        Key](https://evolink.ai/dashboard/keys) para obtener tu API Key


        **Agregar al encabezado de la solicitud:**

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````