
Gemini 3.7 Flash vs Gemini 3.6 Flash: ¿conviene actualizar?

La respuesta corta
minimal, porque ese nivel ya no existe en 3.7 — para esos pipelines la respuesta honesta no es 3.7, es Gemini 3.5 Flash-Lite.Todo lo que viene a continuación es lo que conviene verificar antes de comprometerse.
Qué cambió de verdad
¿La migración de 3.6 a 3.7 es transparente?
No del todo. Según la checklist oficial de migración de Google, hay cuatro cosas que rompen:
- El nivel de thinking
minimaldesaparece. Los niveles sonlow,medium(por defecto) yhigh. Enviarminimala la Gemini API devuelve error. - Hay que eliminar
temperature,top_p,top_kycandidate_countde la configuración de generación. - El
thinking_budgetnumérico se sustituye por el stringthinking_level. - Hay que eliminar los turnos de modelo prellenados.
reasoning_effort: "none" o "minimal" se degradarán a low en lugar de fallar, así que una migración por fases no se romperá en caliente mientras actualizas los puntos de llamada.Los cambios de comportamiento que merece la pena probar
Los benchmarks te dicen dónde mejoró un modelo en las tareas de otra persona. Estos son los cambios con más probabilidad de aparecer en las tuyas:
minimal, tu nuevo suelo es low. En un pipeline de clasificación de alto volumen esa diferencia se acumula en cada llamada, y es la razón más habitual por la que una carga en 3.6 no debería pasar a 3.7.Cuándo quedarse en 3.6 Flash es la decisión correcta
- Dependes del thinking
minimal. Evalúa 3.5 Flash-Lite en lugar de pagar el suelo delowen cada llamada. - Tu carga es simple, crítica en latencia y de alto volumen. Razonar más no es gratis; una ruta de gama Lite suele ganar.
- Tienes un pipeline validado y congelado, sin dolor en coding ni en agentes. Sin incentivo de precio, actualizar un sistema estable solo te compra trabajo de revalidación y poco más.
- Ahora mismo no puedes permitirte una ventana de regresión. Tres semanas entre lanzamientos sugieren que llegará otro modelo; no hay penalización por agrupar tu validación.
Una evaluación reproducible

- Congela una línea base. Captura entre 50 y 200 peticiones reales en 3.6 Flash con telemetría completa: tokens de input, tokens de output, tokens de thinking, aciertos de caché, validez de las tool calls, reintentos y correcciones humanas.
- Repite contra 3.7. Mismos prompts, mismas herramientas, mismo nivel de thinking (mapea
minimal→lowde forma explícita para saber qué estás comparando). Cambia una variable cada vez. - Lanza 3.7 como retador. Enruta una porción del tráfico real y compara por tasa de tareas aceptadas y coste total por tarea aceptada, no por precio por petición, que es idéntico por definición.
- Fija de antemano los umbrales de promoción y rollback. Decide qué números convertirían a 3.7 en tu opción por defecto y qué números te harían volver atrás, antes de mirar los resultados.
Ambos modelos siguen disponibles al mismo precio en los mismos endpoints, así que el rollback es un cambio de ID de modelo sin ninguna consecuencia comercial.
Ejecutar los dos en EvoLink
gemini-3.7-flash para la porción de tráfico del retador y deja gemini-3.6-flash sirviendo producción hasta que se cumplan tus umbrales.Preguntas frecuentes
¿Es Gemini 3.7 Flash mejor que Gemini 3.6 Flash?
En los benchmarks publicados por Google, sí, sobre todo en coding y ejecución agéntica. Son cifras reportadas por el proveedor, y un tracker independiente midió una tasa de alucinación más alta durante el lanzamiento, así que verifica con tus propias tareas antes de cambiar los valores por defecto.
¿Es Gemini 3.7 Flash más caro que 3.6 Flash?
No. Ambos comparten la misma tarifa, incluido el precio introductorio hasta el 31 de diciembre de 2026. Tu factura sí puede cambiar si 3.7 consume más tokens por tarea, ya que los tokens de thinking se facturan a la tarifa de output.
¿Tengo que tocar código para migrar de 3.6 a 3.7?
temperature, top_p, top_k y candidate_count, sustituir el thinking_budget numérico por el string thinking_level y quitar los turnos de modelo prellenados.¿Qué sustituye al nivel de thinking minimal?
low es el nuevo suelo en 3.7 Flash. Para clasificación y extracción de alto volumen sensibles al coste, Gemini 3.5 Flash-Lite suele ser mejor ruta que pagar low en cada llamada.¿Debo actualizar si solo hago chat sencillo o clasificación?
Normalmente no. Las mejoras se concentran en coding y agentes multi-paso; el trabajo simple de alto volumen se cubre mejor con un modelo de gama Lite.
¿Puedo usar Gemini 3.7 Flash y 3.6 Flash a la vez?
Sí. Comparten endpoints y precio, así que puedes enrutar una porción del tráfico a 3.7 como retador y hacer rollback cambiando el ID del modelo.
¿Se va a retirar Gemini 3.6 Flash?
Google no ha anunciado fecha de retirada para Gemini 3.6 Flash. Sigue disponible al mismo precio junto a 3.7 Flash.
¿Cuánto tiempo tengo antes de que cambie el precio?
Las tarifas introductorias se aplican a ambos modelos hasta el 31 de diciembre de 2026, con tarifas estándar a partir del 1 de enero de 2027, así que la decisión de actualizar y la fecha límite de precio son independientes entre sí.


