Gemini API Family
Compara Gemini 3.8 Flash, 3.7 Flash, Pro, Flash y Lite mediante una API de EvoLink por precio, contexto, modalidad, precision y uso de tokens.
11 rutas
Niveles Pro, Flash y Lite para cada presupuesto
Acceso API unificado
Compatible con OpenAI, una clave para todo Gemini
Elige por workflow
Asigna Pro vs Flash vs Lite a tu tarea
Comparar rutas Gemini API
Empieza por el workload: razonamiento flagship, trafico Flash de produccion, extraccion de bajo costo o analisis multimodal de contexto largo.
| Ruta | Ideal para | Precios | Ventana de contexto | Modalidad | Estado |
|---|---|---|---|---|---|
Gemini 3.8 Flash Flash mas reciente — GA | El nuevo Flash de Google para codigo y agentes con mayor precision; compara su consumo con 3.7 Flash. | $0.675/$3.375 per MTok | 1M | Texto, imagen, video, audio, PDF de entrada | Disponible |
Gemini 3.7 Flash Flash — GA | Caballo de batalla agentico de la familia Gemini 3, con mejor generacion de codigo y ejecucion en terminal. | $0.675/$3.375 per MTok | 1M | Texto | Disponible |
Gemini 3.6 Flash Flash — GA | El modelo Flash eficiente mas reciente para codigo, agentes y trabajo de conocimiento. | $0.675/$3.375 per MTok | 1M | Texto | Disponible |
Gemini 3.5 Flash-Lite Flash Lite | Ruta 3.5 rápida para clasificación, extracción y tareas de baja latencia a alto rendimiento; razonamiento mínimo por defecto. | $0.271/$2.25 per MTok | 1M | Texto | Disponible |
Gemini 3.1 Pro Preview Razonamiento flagship | Maxima calidad Gemini para razonamiento, codigo, agentes y analisis de contexto largo. | $1.865/$11.183 <=200K; $3.73/$16.774 >200K | 1M input / 64K output | Texto, codigo, imagen, video, audio, PDF de entrada | Preview flagship |
Gemini 3.5 Flash Estable — GA para produccion | Workflows agentivos, agentes de codigo, despliegue de sub-agentes y tareas de produccion de largo plazo a costo Flash. | $1.35/$8.10 per MTok | 1M input / 65K output | Texto, imagen, video, audio, PDF de entrada | Stable (GA) |
Gemini 3 Flash Preview Gemini 3 rapido | Apps multimodales de baja latencia que necesitan comportamiento Gemini 3. | $0.467/$2.796 per MTok (audio in: $0.933) | 1M input / 64K output | Texto, imagen, video, audio, PDF de entrada | Preview route |
Gemini 3.1 Flash Lite Preview Flash Lite | Traducción, clasificación, extracción y procesamiento de texto por lotes a alto volumen en la generación Gemini 3. | $0.234/$1.399 per MTok (audio in: $0.467) | 1M input / 64K output | Texto, imagen, video, audio, PDF de entrada | Preview route |
Gemini 2.5 Pro Pro estable | Razonamiento de produccion, ayuda de codigo, analisis y tareas multimodales complejas. | $1.165/$9.318 <=200K; $2.33/$13.977 >200K | 1M input / 64K output | Texto, imagen, video, audio, PDF de entrada | Stable deep reasoning |
Gemini 2.5 Flash Flash produccion | Chat rapido, extraccion, resumenes y trafico multimodal de produccion. | $0.281/$2.33 per MTok (audio in: $0.933) | 1M input / 64K output | Texto, imagen, video, audio, PDF de entrada | Production workhorse |
Gemini 2.5 Flash Lite Flash Lite | Clasificacion, extraccion, enrutamiento y flujos de chat ligeros a alto volumen. | $0.095/$0.374 per MTok (audio in: $0.281) | 1M input / 64K output | Texto y audio de entrada | Flash Lite |
Como decidir que modelo Gemini usar
Sigue estas 4 reglas para acotar tu eleccion entre los niveles Pro, Flash y Lite.
Empieza por la profundidad de razonamiento
Agentes de codigo complejos, uso de herramientas multietapa, analisis profundo de documentos y salida de alta precision — empieza con Gemini 3.1 Pro o Gemini 2.5 Pro.
Luego revisa las necesidades de latencia y rendimiento
Chat de produccion, bots de soporte, extraccion en tiempo real y apps multimodales de alta frecuencia — compara Gemini 3 Flash o Gemini 2.5 Flash.
Luego revisa la sensibilidad al coste
Clasificacion de alto volumen, procesamiento de texto por lotes, enrutamiento y extraccion ligera — compara Gemini 3.1 Flash Lite o Gemini 2.5 Flash Lite.
Por ultimo, considera workflows de complejidad mixta
Si la misma pipeline mezcla clasificacion simple con pasos de razonamiento profundo, considera EvoLink Smart Router en vez de codificar un solo modelo Gemini.
Smart Router →Si ya conoces tu tipo de tarea, encuentra el punto de partida recomendado en la tabla siguiente.
Elige un modelo Gemini por workflow: razonamiento, velocidad, coste y tareas multimodales
Asigna tu tarea principal a la ruta Gemini adecuada.
| Tu tarea | Inicio recomendado | Buena opcion si… | Ten en cuenta |
|---|---|---|---|
| Razonamiento complejo y agentes de codigo | Gemini 3.1 Pro | Necesitas la mayor calidad de razonamiento Gemini, uso de herramientas multietapa o analisis profundo de codigo | Compara las tarifas actuales por token y el uso total por tarea completada. |
| Deep reasoning estable con multimodal | Gemini 2.5 Pro | Necesitas razonamiento de nivel produccion con soporte multimodal amplio y estabilidad demostrada | Techo de capacidad ligeramente menor que 3.1 Pro |
| Codigo y agentes con mayor precision | Gemini 3.8 Flash | Necesitas la ruta Flash mas reciente de Google para codigo, agentes, analisis multimodal y contexto de 1M | Usa mas tokens que 3.7 Flash — compara el coste por tarea aceptada |
| Apps multimodales de baja latencia | Gemini 3 Flash | Necesitas respuestas rapidas con capacidades de generacion Gemini 3 en texto, imagen, audio y video | Ruta preview — verifica requisitos de estabilidad |
| Chat y extraccion de produccion | Gemini 2.5 Flash | Necesitas un modelo de produccion probado para chat, resumenes y extraccion a escala | Buen punto de partida para la mayoria de workloads de produccion |
| Procesamiento de texto por lotes | Gemini 2.5 Flash Lite | Las tareas son clasificacion, enrutamiento o respuestas cortas donde el coste es lo mas importante | Limitado a entrada de texto y audio |
| Workflows de texto de complejidad mixta | EvoLink Smart Router | La misma pipeline tiene tareas simples y complejas entre Gemini y otros proveedores | Ideal cuando no quieres logica de enrutamiento manual de modelos |
Workflows de la API Gemini: agentes, chat, documentos y procesamiento multimodal
Descubre como los modelos Gemini encajan en productos reales, agentes y pipelines de procesamiento de contenido.
Agentes de razonamiento y codigo
Para generacion de codigo, correccion de bugs, uso de herramientas multietapa y agentes de analisis complejos. Si la calidad de salida afecta directamente al comportamiento del producto, empieza con Gemini 3.1 Pro. Para estabilidad demostrada, compara Gemini 2.5 Pro.
Chat y soporte de produccion
Para bots de soporte, asistentes integrados, preguntas sobre bases de conocimiento y conversaciones multiturno frecuentes. Empieza con Gemini 2.5 Flash por su rendimiento probado, pasa el mismo tráfico por Flash Lite y compara la calidad de las respuestas con las tarifas por token actuales.
Analisis de documentos largos y multimodal
Para analisis de PDFs, comprension de video, transcripcion de audio y workflows de investigacion multi-archivo. La ventana de contexto de 1M de Gemini y su soporte multimodal nativo hacen de las rutas Pro y Flash opciones solidas.
Enrutamiento de agentes y tareas mixtas
Para workflows donde clasificacion, extraccion, razonamiento y generacion coexisten en la misma pipeline. Usa EvoLink Smart Router para enrutar automaticamente entre Gemini y otros proveedores via evolink/auto.
Ver detalles de cada modelo Gemini
Cada ruta enlaza a una pagina dedicada con precios, especificaciones y detalles de integracion.
Gemini 3.8 Flash
Flash mas reciente — GA
- Ventana de contexto
- 1M
- Precios
- $0.675/$3.375 per MTok
Gemini 3.7 Flash
Flash — GA
- Ventana de contexto
- 1M
- Precios
- $0.675/$3.375 per MTok
Gemini 3.6 Flash
Flash — GA
- Ventana de contexto
- 1M
- Precios
- $0.675/$3.375 per MTok
Gemini 3.5 Flash-Lite
Flash Lite
- Ventana de contexto
- 1M
- Precios
- $0.271/$2.25 per MTok
Gemini 3.1 Pro Preview
Razonamiento flagship
- Ventana de contexto
- 1M input / 64K output
- Precios
- $1.865/$11.183 <=200K; $3.73/$16.774 >200K
Gemini 3.5 Flash
Estable — GA para produccion
- Ventana de contexto
- 1M input / 65K output
- Precios
- $1.35/$8.10 per MTok
Gemini 3 Flash Preview
Gemini 3 rapido
- Ventana de contexto
- 1M input / 64K output
- Precios
- $0.467/$2.796 per MTok (audio in: $0.933)
Gemini 3.1 Flash Lite Preview
Flash Lite
- Ventana de contexto
- 1M input / 64K output
- Precios
- $0.234/$1.399 per MTok (audio in: $0.467)
Gemini 2.5 Pro
Pro estable
- Ventana de contexto
- 1M input / 64K output
- Precios
- $1.165/$9.318 <=200K; $2.33/$13.977 >200K
Gemini 2.5 Flash
Flash produccion
- Ventana de contexto
- 1M input / 64K output
- Precios
- $0.281/$2.33 per MTok (audio in: $0.933)
Gemini 2.5 Flash Lite
Flash Lite
- Ventana de contexto
- 1M input / 64K output
- Precios
- $0.095/$0.374 per MTok (audio in: $0.281)
Accede a todos los modelos Gemini a traves de una sola API de EvoLink
Las 11 rutas Gemini estan disponibles con una unica clave API de EvoLink y un endpoint compatible con OpenAI. Cambia entre Pro, Flash y Lite modificando el parametro model — sin cuentas ni claves adicionales.
Cambia model="gemini-3.1-pro" a model="gemini-2.5-flash" sin reconstruir tu integracion.Como pensar en el coste de la API Gemini: Pro vs Flash vs Lite
Rutas Pro: el razonamiento justifica el premium
Gemini 3.1 Pro / Gemini 2.5 Pro — Evalúa estas rutas para código complejo, análisis documental y razonamiento multipaso; compara calidad y coste por tarea completada.
Rutas Flash: mejor equilibrio para volumen de produccion
Gemini 3 Flash y 2.5 Flash ofrecen capacidades multimodales solidas a una fraccion del precio de Pro. Empieza aqui para chat, resumenes y extraccion a escala de produccion antes de considerar Pro.
Rutas Lite: minimizar costes para tareas simples de alto volumen
Gemini 3.1 Flash Lite y 2.5 Flash Lite son las rutas que conviene probar primero para clasificación, enrutamiento, texto por lotes y respuestas cortas que no exigen razonamiento profundo. Revisa la tarifa por token actual de cada ruta en su página de modelo antes de escalar el volumen.
Pricing summary
Rango de precios de entrada: $0.095–$3.73 / 1M tokens (EvoLink).
Gemini 3.8 Flash
$0.675/$3.375 /MTok
Context: 1M
El Flash más reciente de Google para coding y tareas agénticas más precisas — 1M de contexto; prevé un mayor consumo de tokens que 3.7 Flash.
Gemini 3.7 Flash
$0.675/$3.375 /MTok
Context: 1M
Gemini 3.7 Flash · Entrada $0.675 · Salida $3.375 / 1M tokens.
Gemini 3.6 Flash
$0.675/$3.375 /MTok
Context: 1M
Modelo Flash eficiente a $0.675/$3.375 per MTok, solido para orquestacion multipaso y refactorizacion, 1M de contexto.
Gemini 3.5 Flash-Lite
$0.271/$2.25 /MTok
Context: 1M
Gemini 3.5 Flash-Lite · Entrada $0.271 · Salida $2.25 / 1M tokens.
Gemini 3.1 Pro
$1.865/$11.183 — $3.73/$16.774 /MTok
Context: 1M
Flagship reasoning with 1M context. Tiered pricing: $1.865/$11.183 under 200K, $3.73/$16.774 over 200K input tokens.
Gemini 3.5 Flash
$1.35/$8.10 /MTok
Context: 1M
Flash GA estable para workflows agentivos y codigo a $1.35/$8.10 per MTok con 1M de contexto y razonamiento integrado.
Gemini 3 Flash
$0.467/$2.796 /MTok
Context: 1M
Gemini 3 generation Flash route at $0.467/$2.796 per MTok with 1M context.
Gemini 3.1 Flash Lite
$0.234/$1.399 /MTok
Context: 1M
Gemini 3.1 Flash Lite · Entrada $0.234 · Salida $1.399 / 1M tokens.
Gemini 2.5 Pro
$1.165/$9.318 — $2.33/$13.977 /MTok
Context: 1M
Stable deep reasoning at $1.165/$9.318 under 200K, $2.33/$13.977 over 200K.
Gemini 2.5 Flash
$0.281/$2.33 /MTok
Context: 1M
Production workhorse at $0.281/$2.33 per MTok with full multimodal support.
Gemini 2.5 Flash Lite
$0.095/$0.374 /MTok
Context: 1M
Gemini 2.5 Flash Lite · Entrada $0.095 · Salida $0.374 / 1M tokens.
Guias y comparativas Gemini
Consulta estas guias cuando necesites mas contexto antes de elegir una ruta.
Gemini 3.8 Flash vs Gemini 3.7 Flash
Compara precisión, consumo de tokens, periodos de precio y coste por tarea aceptada.
Cómo usar la API de Gemini 3.8 Flash
Haz la primera solicitud, migra parámetros y añade canary y rollback de producción.
Guia de migracion por deprecacion de Gemini 3 Pro
Migra el trafico antiguo de Gemini 3 Pro Preview a las rutas Gemini actuales sin afectar el comportamiento en produccion.
Integracion de OpenCode con rutas Gemini
Descubre como acceder a Gemini junto con Claude y GPT a traves de la capa API unificada de EvoLink.
Seguimiento del lanzamiento de Gemini 3.5 Pro API
Sigue la disponibilidad publica de la API, la confirmacion oficial de Google y los retrasos de lanzamiento reportados.
Gemini 3.5 Pro vs Gemini 3.5 Flash
Compara los datos confirmados de Flash con la ruta Pro aun pendiente antes de elegir un modelo.
Disponibilidad de la API de Gemini 4
Google ha confirmado el preentrenamiento de Gemini 4; sigue el estado de la API publica, el ID del modelo, los precios y la verificacion de la ruta en EvoLink.
FAQ de la API Gemini
Everything you need to know about the product and billing.