GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5

Gemini Omni Flash API

Accede a Gemini Omni Flash - también buscado como Gemini Omni u Omni Flash - a través de la API de vídeo unificada de EvoLink. Prueba texto a vídeo, imagen a vídeo, referencia a vídeo y edición de vídeo conversacional antes de integrar.

GoogleGeneración de vídeoDisponible
Desde $0.015 / 1K tokens de salida de vídeo$0.018 Precio oficial-15%
Texto a vídeoImagen a vídeoReferencia a vídeoEdición de vídeo conversacionalAudio nativo
Ruta de producciónLive
Lo más destacado
3-10 s o duración Auto · salida 720p · audio nativo incluido
Casos de uso
Anuncios cortos, sustitución de objetos, escenas ancladas en referencia, retoques conversacionales
Entrada
Texto, imágenes o un vídeo de entrada
Salida
Vídeo 720p con audio nativo

Prueba Gemini Omni Flash directamente en el navegador.

Elige un modo, escribe un prompt y mira el coste estimado antes de gastar nada.

Crear tarea

Fijado a gemini-omni-flash-text-to-video
Duración

Auto deja la duración al proveedor; la estimación de arriba asume 10 segundos.

Relación de aspecto
Estimado: ~$0.87059.1102 cr
Listo
Listo
Historial

Los resultados se guardan 24 horas — descarga lo que quieras conservar.

Tu historial de generación aparecerá aquí

Conoce tu coste de prueba de Gemini Omni Flash antes de añadir créditos.

Gemini Omni Flash se factura por tokens, no por segundo. El cargo final siempre usa los tokens que el modelo devolvió realmente.

Coste de la primera prueba

Texto a vídeo · 3 s · 720p
-15%Cargo mínimo
Créditos18.0961

Una muestra de 3 s en 720p

Coste aprox.$0.267

Unas 35 pruebas con 10 $ en créditos.

En el Playground elige Texto a vídeo, pon la duración en 3 s y envía un prompt corto sin medios de entrada: esa es la petición válida más barata de esta página. La salida siempre es 720p, así que el coste escala con la duración, no con la resolución.

Guía de presupuesto de pruebas

Elige un importe según cuántas pruebas esperas hacer.
Añadir créditos
$10
Unas 35 muestras

Validar un prompt y confirmar cómo se factura

$50
Unas 187 muestras

Iterar un storyboard completo en las cuatro rutas

$100
Unas 375 muestras

Producción por lotes para una campaña de vídeo corto

Ejemplos de coste habituales

Iteración de promptTexto a vídeo · 3 s
~$0.267-15%
~18.0961 cr·~$0.314 precio oficial
Plano anclado en referenciasReferencia a vídeo · 5 s · 3 imágenes
~$0.447-15%
~30.344 cr·~$0.525 precio oficial
Montaje finalTexto a vídeo · 10 s (o Auto)
~$0.870-15%
~59.1063 cr·~$1.023 precio oficial

Solo estimaciones. Gemini Omni Flash se factura por tokens, así que el cargo final siempre usa el uso que el modelo devolvió realmente. La duración Auto se reserva como 10 s y se liquida según los segundos realmente generados.

Precios del modelo

Precios del modeloFacturación por token

Gemini Omni Flash factura por token en tres categorías: salida de vídeo, entrada (prompt + medios), y otra salida (tokens de razonamiento). Los cargos finales siempre reflejan el uso realmente devuelto por el modelo.

Salida de vídeo
Fotogramas de vídeo y audio generados · Salida
$0.015 / 1K tokens-15%
1.0115 cr / 1K tokens$0.018 precio oficial
Entrada
Texto del prompt, imágenes de referencia y vídeo de entrada · Entrada
$0.0013 / 1K tokens-15%
0.0867 cr / 1K tokens$0.0015 precio oficial
Otra salida
Tokens de razonamiento y razonamiento interno · Salida
$0.0077 / 1K tokens-15%
0.5202 cr / 1K tokens$0.0090 precio oficial

Las tarifas mostradas son por 1.000 tokens. El cargo real de cada solicitud se calcula a partir de los valores de uso devueltos en la respuesta de la API.

Calcula tu propia solicitud de Gemini Omni Flash

Gemini Omni Flash API en EvoLink

Usa Gemini Omni Flash en EvoLink para texto a vídeo, imagen a vídeo, referencias a vídeo y edición de vídeo mediante una API de vídeo unificada. La conversación pública suele presentar Gemini Omni como una contraparte de video de Nano Banana porque lleva la creación multimodal y la edición conversacional a workflows de video corto. En EvoLink, el valor práctico está en el acceso API: model IDs de EvoLink, flujo de tareas async, soporte de callback, visibilidad de uso basada en tokens y la misma API key que ya se usa para Veo, Seedance, Kling y otros modelos de video.

Entrada
Texto, imágenes o un vídeo de entrada
Salida
MP4 720p con audio nativo
Duración
3-10 s, o Auto
Resolución
720p (fija)
Referencias
Hasta 6 imágenes de referencia

¿Qué puedes construir con Gemini Omni API?

Text to Video

gemini-omni-flash-text-to-video

Generate a 720p video from a prompt with 3-10 second or Auto duration.

Image to Video

gemini-omni-flash-image-to-video

Animate one input image with a prompt and 3-10 second or Auto duration.

Reference to Video

gemini-omni-flash-reference-to-video

Use 1-6 reference images to guide a 3-10 second or Auto-duration video.

Video Edit

gemini-omni-flash-video-edit

Edit one MP4 input video with a natural-language instruction.

Edición de video por chat

Genera un clip con Gemini Omni y luego refínalo en conversación — "haz la iluminación más cálida", "reemplaza el auto rojo". El workflow está diseñado para edición iterativa y busca conservar la escena, la identidad del sujeto y el movimiento dentro de lo que soporte la ruta seleccionada.

  • · Refinamiento multi-turno en un solo hilo de chat
  • · Continuidad de escena durante la edición
  • · Menos trabajo de regenerar desde cero

Reemplazo de objetos y reescritura de escenas

Intercambia un objeto en el fotograma, elimina un elemento no deseado o reescribe una escena preservando identidad y movimiento. Útil para iteración de creatividades publicitarias y renderizado de variantes de producto sin herramientas de edición externas.

  • · Intercambia o elimina objetos en el fotograma
  • · Preserva identidad y movimiento
  • · Iteración de creatividades publicitarias y variantes de producto

Flujo con imagen de referencia

Pasa una imagen de referencia y Gemini Omni ancla la identidad del personaje, la iluminación y el color a lo largo del video generado. Combínalo con la edición por chat para refinar tomas específicas sin perder consistencia visual.

  • · Ancla la identidad del personaje desde una imagen de referencia
  • · Iluminación y color consistentes entre clips
  • · Combina con edición por chat para refinamiento

Generación de video con soporte de audio

Las rutas Gemini Omni Flash pueden devolver salidas de video corto con audio cuando el modo seleccionado lo admite, reduciendo la necesidad de unir un pipeline separado de TTS o diseño de sonido en la primera generación.

  • · Video con audio cuando esté soportado
  • · Útil para primeros conceptos de video corto
  • · Menos trabajo de pipeline de audio separado

Dos formas de usar Gemini Omni Flash: API de EvoLink o Agent

Usa la API de EvoLink para integrar el modelo en un producto o ejecutar lotes, o llámala desde Codex, Claude o Gemini para tareas creativas y de desarrollo. Ambos métodos comparten la misma clave API, saldo, rutas e historial de tareas.

Opción 1

Integrar con la API de EvoLink

Ideal para: backends de producto, tareas por lotes y workflows automatizados

Llama a la API de vídeo unificada de EvoLink desde tu servidor y controla el ID del modelo, parámetros, cola de tareas, callbacks y almacenamiento de resultados.

  1. 1Validar el resultado y el coste con un brief real en Playground
  2. 2Crear una clave API de EvoLink en la consola
  3. 3Elegir el ID de modelo adecuado para tu tarea en las tarjetas de rutas de arriba
  4. 4Enviar la tarea y recuperar el resultado por polling o callback HTTPS
Opción 2

Llamar con un Agent

Ideal para: tareas creativas y de desarrollo en Codex, Claude y Gemini

Entrega al Agent el objetivo, los recursos y los criterios de aceptación. Podrá elegir la ruta, crear la solicitud, seguir la tarea y devolver el resultado sin que programes cada paso.

  1. 1Configurar EVOLINK_API_KEY como variable de entorno local; nunca incluirla en el código ni en el prompt
  2. 2Describir el objetivo, las referencias y los parámetros clave
  3. 3Pedir al Agent que llame a una ruta Gemini Omni Flash y guarde el task ID
  4. 4Dejar que consulte el estado final, descargue el resultado y explique los fallos

Qué construyen los equipos con la API de Gemini Omni Flash

Cuatro flujos para cuatro rutas. La diferencia está en la forma de la entrada, no en un nivel de calidad: elige según el material que tengas.

Variantes de anuncios cortos desde un brief

Genera de 3 a 10 segundos solo con el prompt e itera sobre el texto en lugar de volver a grabar. El audio nativo hace que la primera pasada ya sea revisable sin un paso aparte de TTS o diseño de sonido.

Animar una foto de producto

Imagen a vídeo toma exactamente una imagen de entrada y añade movimiento e iluminación controlados manteniendo el sujeto. Útil cuando ya hay fotografía de producto aprobada pero no presupuesto de vídeo.

Escenas con identidad consistente desde referencias

Referencia a vídeo acepta de 1 a 6 imágenes para fijar un personaje, una paleta o un estilo en varios planos. Aquí el orden no tiene significado: el conjunto se lee como un todo.

Retoques conversacionales sobre un clip existente

La edición de vídeo reescribe objetos, estilo o luz en un MP4 de hasta 10 segundos. La duración y la relación de aspecto siguen la entrada, así que la salida sigue siendo intercambiable con el montaje original.

API Gemini Omni Flash: ejemplo de código y gestión de errores

Este ejemplo muestra el flujo ejecutable mínimo: crear una tarea, guardar el task ID devuelto y después consultar el estado o esperar un callback HTTPS. Abre la pestaña API para ver todos los parámetros y respuestas.

Ver documentación API completa
cURL
curl -X POST https://api.evolink.ai/v1/videos/generations \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-omni-flash-text-to-video",
    "prompt": "A cinematic wide shot of a glass greenhouse at sunrise, slow camera push in",
    "duration": 8,
    "aspect_ratio": "16:9",
    "callback_url": "https://your-domain.com/webhooks/video"
  }'

# Save the returned task ID, then query:
curl https://api.evolink.ai/v1/tasks/{task_id} \
  -H "Authorization: Bearer $EVOLINK_API_KEY"

Error de validación de parámetros

Comprueba cada valor con las tarjetas de parámetros de arriba: rangos, opciones permitidas, cantidad de recursos y formatos de archivo deben coincidir con la ruta elegida.

Problema de autenticación o saldo

Revisa el token Authorization Bearer y confirma el saldo disponible y la facturación de la tarea en la consola.

Contenido o recurso rechazado

Revisa derechos de imagen, recursos de marca, texto legible, contenido sensible y conformidad de los archivos de entrada.

Tarea fallida o con tiempo de espera agotado

Una tarea Gemini Omni Flash cuyo estado final es fallido no se cobra. Conserva el task ID e identifica si la causa es validación, moderación o ejecución antes de volver a intentarlo.

Callback no recibido

callback_url debe ser una URL HTTPS pública, no localhost ni una red privada. Conserva siempre el task ID como alternativa para el polling.

Gemini Omni vs Veo 3.1 vs Seedance 2.0 — Comparativa lado a lado

Tres modelos frecuentemente preseleccionados para flujos de producción de video en 2026. Los tres accesibles con una sola API key de EvoLink.

CaracterísticaGemini OmniVeo 3.1Seedance 2.0
Precio en EvoLinkBasado en tokensDesde $0.04/sDesde $0.045/s
Calidad720p720p / 1080p, escalado 4K donde esté disponible480p / 720p / 1080p
Audio nativoSíSíSí
Control de referenciaTexto + imagen + edición por chatTexto + imagenTexto + imagen + video + audio
Duración del video3-10s / AutoClips cortos con Extend para escenas más largas cuando esté disponible4–15s
EdiciónNativa por chat, multi-turnoPrioriza generaciónModo V2V
Ideal paraFlujos con edición intensivaLínea base cinematográficaProducción con referencia multimodal

Cómo integrar Gemini Omni API

Tres pasos para tu primera tarea de video con Gemini Omni. Mismo patrón de integración que Veo 3.1, Seedance 2.0 y Kling 3.0.

1

Paso 1 — Obtén tu API key

Regístrate en EvoLink.ai y genera tu API key desde el panel de control. No se requiere proyecto Google Cloud.

2

Paso 2 — Envía la tarea de generación

Haz un POST a /v1/videos/generations con uno de los nombres de modelo de Gemini Omni Flash y tu prompt. Usa duration para modos generativos de 3-10 segundos o Auto, image_urls para imagen a vídeo o referencias a vídeo, video_urls para edición de vídeo y callback_url opcional para notificaciones de finalización. La API procesa de forma asíncrona y devuelve un task_id.

3

Paso 3 — Recupera el resultado del video

Usa el task_id para consultar el endpoint de estado, o espera el webhook de callback_url. Cuando el estado llegue a completado, recibirás una URL de descarga del MP4 generado. Los enlaces son válidos por 24 horas.

Capacidades de Gemini Omni API

Especificaciones técnicas para flujos de producción de video.

Edición

Edición de video por chat

Refinamiento multi-turno en un workflow conversacional, con continuidad de escena dependiente de la ruta seleccionada y la calidad de entrada.

Salida

720p, clips de 3-10s / Auto

Salida 720p con clips configurables de 3-10 segundos o Auto para modos generativos. Auto se estima como 10 segundos. La edición de vídeo acepta un MP4 de entrada de hasta 10 segundos.

Modos

Texto a video e imagen a video

T2V desde prompts e I2V con imagen de referencia. La edición por chat se aplica a las salidas de ambos modos.

Audio

Salida de video con soporte de audio

Las salidas de video corto pueden incluir audio cuando la ruta Gemini Omni Flash seleccionada lo soporta.

Consistencia

Consistencia de personaje en contexto largo

Diseñado para mayor continuidad en workflows multi-input y con mucha edición; valida la consistencia con tus propios prompts de producción.

Flujo

API async con task_id y callback

Envía una tarea, recibe un ID, consulta el estado o configura una callback_url. Mismo ciclo de vida que otros modelos de video en EvoLink.

Ejemplo de costos — Estimaciones de precios de Gemini Omni

100 × clips de 3-10s/Auto para lote de redes sociales

Usa las tarifas actuales de Pricing

1,000 × clips de 3-10s/Auto/mes a escala de producción

Usa las tarifas actuales de Pricing

1 generación + 3 ediciones en flujo multi-turno

Usa las tarifas actuales de Pricing

Consulta la pestaña Pricing para ver las tarifas tokenizadas actuales. Selecciona el flujo cambiando el parámetro model.

Cómo se compara Gemini Omni — Todos los modelos con una sola API key de EvoLink

Gemini Omni destaca sobre todo por workflow: entradas multimodales, edición conversacional y una ruta práctica de EvoLink para probarlo junto a Veo, Seedance y Kling con una sola API key.

Flujo de edición nativo por chat

Gemini Omni está orientado a la edición conversacional de video, mientras que Veo 3.1 y Seedance 2.0 suelen evaluarse primero como rutas de generación. Para refinamiento multi-turno, esta es la diferencia de workflow que conviene probar.

Consistencia de personaje en contexto largo

Gemini Omni se reporta como beneficiado por el contexto y el conocimiento del mundo de Gemini para continuidad en workflows multi-input y con mucha edición. Evalúa este comportamiento con tus propios prompts de storyboard o video corto.

Sin proyecto Google Cloud — Mismo patrón async que Veo y Seedance

Sin configuración de GCP, sin facturación de Vertex, sin aprobación de región. Si ya ejecutas generación de video a través de EvoLink, agregar Gemini Omni es un cambio de un solo parámetro — misma estructura de request, mismo ciclo de vida de tareas que Veo 3.1, Seedance 2.0 y Kling.

Familia de modelos de vídeo Gemini

Compara las rutas de vídeo de Google con una sola cuenta de EvoLink y una sola clave API, y elige según duración del plano, resolución y coste.

Comparar todos los modelos Gemini
Gemini Omni Flash API

Gemini Omni Flash

Modelo actual

Esta página. Cuatro rutas en 720p con audio nativo, duración de 3-10 s o Auto, y edición de vídeo conversacional.

Gemini Omni 1.1 Flash API

Gemini Omni 1.1 Flash

La generación Omni más reciente: de 360p a 4K escalado, control de primer y último fotograma, más edición y extensión de vídeo.

Ver API
Veo 3.1 API

Veo 3.1

El modelo de vídeo cinematográfico de Google con audio nativo, para planos más largos y de mayor fidelidad.

Ver API

Otros modelos de vídeo en EvoLink además de Gemini Omni Flash

Cuando Gemini Omni Flash no es la opción por defecto, usa el mismo brief para comparar resolución, duración de plano, audio, estabilidad de movimiento y coste total del proyecto.

Seedance 2.5 API

Seedance 2.5

Para planos de 4 a 30 segundos con hasta 50 referencias multimodales; compara la tasa de planos utilizables en clips largos.

Ver API
MiniMax H3 API

MiniMax H3

Para clips 2K detallados de 4 a 15 segundos; compara su tasa de planos utilizables con el mismo brief.

Ver API
Kling 3.0 API

Kling 3.0

Para generación creativa, acción y vídeo multiplano; una alternativa de producción fuera de la familia Gemini.

Ver API
Topaz Video Upscale API

Topaz Video Upscale

Cuando el movimiento y la composición ya sirven pero la imagen se ve blanda, usa Topaz para recuperar detalle y escalar 1x, 2x o 4x.

Ver API

Preguntas frecuentes sobre Gemini Omni API

¿Qué es Gemini Omni y en qué se diferencia de Veo 3.1?

Gemini Omni es la familia de modelos de video multimodales anunciada por Google en Google I/O 2026. Omni Flash se comenta como una ruta de video corto para entradas de texto, imagen, video y audio. Frente a Veo 3.1, Gemini Omni destaca sobre todo por la edición conversacional y los workflows multi-input; Veo sigue siendo una base sólida para generación cinematográfica.

¿Cuánto cuesta Gemini Omni API en EvoLink?

La facturación sigue los usage tokens devueltos por la API, con métricas separadas para input, video output y other output. Consulta la tabla de precios para las tarifas actuales.

¿Necesito un proyecto Google Cloud para usar Gemini Omni a través de EvoLink?

No. EvoLink proporciona acceso con una sola API key. Sin proyecto Google Cloud, sin facturación de Vertex, sin aprobación de región. Misma autenticación que Veo 3.1 y Seedance 2.0 en EvoLink.

¿Qué modos admite Gemini Omni Flash?

Hay cuatro modos disponibles: gemini-omni-flash-text-to-video, gemini-omni-flash-image-to-video, gemini-omni-flash-reference-to-video y gemini-omni-flash-video-edit. Todos comparten el mismo endpoint asíncrono de vídeo.

¿Gemini Omni soporta callback_url y webhooks?

Sí. Pasa una callback_url (HTTPS) al enviar la tarea y EvoLink puede enviar actualizaciones por POST cuando la tarea llegue a un estado terminal. También funciona la consulta al endpoint de estado si no proporcionas callback URL.

¿Cómo manejo las tareas fallidas de Gemini Omni?

Las tareas fallidas devuelven un estado failed con un motivo de error. Para reintentos a nivel de aplicación, inspecciona el error, conserva los parámetros originales para depuración y reenvía solo cuando el problema de entrada o fallo temporal esté claro.

¿Puedo editar un video generado previamente con Gemini Omni?

Sí — esta es una de las diferencias principales de workflow de Gemini Omni. Usa una instrucción de edición en lenguaje natural y valida qué tan bien la ruta seleccionada conserva la escena, la identidad del sujeto y el movimiento entre iteraciones.

¿Cuál es la duración máxima de clip para Gemini Omni?

Los modos generativos admiten clips configurables de 3-10 segundos o Auto. Auto se estima como 10 segundos para la reserva. La edición de vídeo acepta un MP4 de entrada de hasta 10 segundos. Para narrativas más largas, encadena múltiples clips usando la consistencia de personaje en contexto largo.

¿Gemini Omni soporta imagen a video?

Sí. Pasa una URL de imagen de referencia y Gemini Omni la usa como ancla de identidad para el video generado.

¿Cómo se compara Gemini Omni con Seedance 2.0 y Veo 3.1?

Seedance 2.0 muestra señales sólidas en benchmarks y referencias multimodales, mientras que Veo 3.1 sigue siendo una base cinematográfica fuerte con workflows avanzados de Flow y Extend. Gemini Omni se diferencia por la edición conversacional, la generación multi-input y la iteración de video corto.

¿Puedo acceder a todos los modelos de video de Google con una sola API key de EvoLink?

Sí. EvoLink expone Gemini Omni, Veo 3.1, Nano Banana 2 y el resto de la familia Gemini a través de una sola API key. Cambia modificando el parámetro model.