GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

Gemini Omni Flash API

Accédez à Gemini Omni Flash - aussi recherché sous Gemini Omni ou Omni Flash - via l'API vidéo unifiée d'EvoLink. Testez le texte-vers-vidéo, l'image-vers-vidéo, la référence-vers-vidéo et l'édition vidéo conversationnelle avant d'intégrer.

GoogleGénération vidéoDisponible
À partir de $0.015 / 1K tokens de sortie vidéo$0.018 Prix officiel-15%
Texte-vers-vidéoImage-vers-vidéoRéférence-vers-vidéoÉdition vidéo conversationnelleAudio natif
Route productionLive
Points forts du modèle
3-10 s ou durée Auto · sortie 720p · audio natif inclus
Cas d'usage
Publicités courtes, remplacement d'objets, scènes ancrées sur référence, retouches conversationnelles
Entrée
Texte, images ou une vidéo d'entrée
Sortie
Vidéo 720p avec audio natif

Essayez Gemini Omni Flash directement dans le navigateur.

Choisissez un mode, écrivez un prompt et voyez le coût estimé avant de dépenser quoi que ce soit.

Créer une tâche

Fixé sur gemini-omni-flash-text-to-video
Durée

Auto laisse le fournisseur choisir la durée ; l'estimation ci-dessus suppose 10 secondes.

Format d'image
Estimation : ~$0.87059.1102 cr
Prêt
Prêt
Historique

Les résultats sont conservés 24 heures — téléchargez ce que vous voulez garder.

Votre historique de génération apparaîtra ici

Connaissez votre coût de test Gemini Omni Flash avant d'ajouter des crédits.

Gemini Omni Flash est facturé aux tokens, pas à la seconde. La facturation finale utilise toujours les tokens réellement renvoyés par le modèle.

Coût du premier test

Texte-vers-vidéo · 3 s · 720p
-15%Facturation minimale
Crédits18.0961

Un échantillon de 3 s en 720p

Coût approx.$0.267

Environ 35 tests avec 10 $ de crédits.

Dans le Playground, choisissez Texte-vers-vidéo, réglez la durée sur 3 s et envoyez un prompt court sans média d'entrée - c'est la requête valide la moins chère de cette page. La sortie est toujours en 720p : le coût varie avec la durée, pas avec la résolution.

Guide du budget de test

Choisissez un montant selon le nombre de tests prévus.
Ajouter des crédits
$10
Environ 35 échantillons

Valider un prompt et confirmer la logique de facturation

$50
Environ 187 échantillons

Itérer un storyboard complet sur les quatre routes

$100
Environ 375 échantillons

Production en lot pour une campagne de vidéos courtes

Exemples de coûts courants

Itération de promptTexte-vers-vidéo · 3 s
~$0.267-15%
~18.0961 cr·~$0.314 prix officiel
Plan ancré sur référencesRéférence-vers-vidéo · 5 s · 3 images
~$0.447-15%
~30.344 cr·~$0.525 prix officiel
Montage finalTexte-vers-vidéo · 10 s (ou Auto)
~$0.870-15%
~59.1063 cr·~$1.023 prix officiel

Estimations uniquement. Gemini Omni Flash est facturé aux tokens : la facturation finale utilise toujours l'usage réellement renvoyé par le modèle. La durée Auto est réservée à 10 s puis régularisée sur les secondes réellement produites.

Tarification du modèle

Tarification du modèleFacturation par token

Gemini Omni Flash facture par token sur trois catégories : sortie vidéo, entrée (prompt + média), et autre sortie (tokens de réflexion). Les frais finaux reflètent toujours l'usage réellement renvoyé par le modèle.

Sortie vidéo
Images vidéo et audio générés · Sortie
$0.015 / 1K tokens-15%
1.0115 cr / 1K tokens$0.018 prix officiel
Entrée
Texte du prompt, images de référence et vidéo d'entrée · Entrée
$0.0013 / 1K tokens-15%
0.0867 cr / 1K tokens$0.0015 prix officiel
Autre sortie
Tokens de réflexion et raisonnement interne · Sortie
$0.0077 / 1K tokens-15%
0.5202 cr / 1K tokens$0.0090 prix officiel

Les tarifs affichés sont par 1 000 tokens. Le coût réel de chaque requête est calculé à partir des valeurs d'usage renvoyées dans la réponse API.

Estimez votre propre requête Gemini Omni Flash

Gemini Omni Flash API sur EvoLink

Utilisez Gemini Omni Flash sur EvoLink pour le texte-vers-vidéo, l’image-vers-vidéo, les références-vers-vidéo et l’édition vidéo via une API vidéo unifiée. Les discussions publiques présentent souvent Gemini Omni comme un équivalent vidéo de Nano Banana, car il combine création vidéo multimodale et édition conversationnelle pour les workflows de vidéos courtes. Sur EvoLink, la valeur pratique est l’accès API : model IDs EvoLink, workflow async par tâches, support callback, visibilité d’usage basée sur les tokens et la même API key que pour Veo, Seedance, Kling et d’autres modèles vidéo.

Entrée
Texte, images ou une vidéo d'entrée
Sortie
MP4 720p avec audio natif
Durée
3-10 s, ou Auto
Résolution
720p (fixe)
Références
Jusqu'à 6 images de référence

Que pouvez-vous construire avec Gemini Omni API ?

Text to Video

gemini-omni-flash-text-to-video

Generate a 720p video from a prompt with 3-10 second or Auto duration.

Image to Video

gemini-omni-flash-image-to-video

Animate one input image with a prompt and 3-10 second or Auto duration.

Reference to Video

gemini-omni-flash-reference-to-video

Use 1-6 reference images to guide a 3-10 second or Auto-duration video.

Video Edit

gemini-omni-flash-video-edit

Edit one MP4 input video with a natural-language instruction.

Édition vidéo par chat

Générez un clip avec Gemini Omni, puis affinez-le en conversation — « rends l'éclairage plus chaud », « remplace la voiture rouge ». Le workflow est conçu pour l’édition itérative tout en préservant la scène, l’identité du sujet et le mouvement dans la limite de ce que la route sélectionnée prend en charge.

  • · Affinement multi-tour dans un seul fil de conversation
  • · Continuité de scène pendant les edits
  • · Moins de régénération complète

Remplacement d'objets et réécriture de scène

Remplacez un objet dans le cadre, supprimez un élément indésirable ou réécrivez une scène tout en préservant l'identité et le mouvement. Idéal pour l'itération de créas publicitaires et le rendu de variantes produit sans outils de montage externes.

  • · Remplacement ou suppression d'objets dans le cadre
  • · Préservation de l'identité et du mouvement
  • · Itération de créas publicitaires et variantes produit

Workflow avec image de référence

Fournissez une image de référence et Gemini Omni ancre l'identité du personnage, l'éclairage et les couleurs sur l'ensemble de la vidéo générée. Combinez avec l'édition par chat pour affiner des plans spécifiques sans perdre la cohérence visuelle.

  • · Ancrage de l'identité du personnage depuis l'image de référence
  • · Éclairage et couleurs cohérents entre les clips
  • · Combinaison avec l'édition par chat pour l'affinement

Génération vidéo avec support audio

Les routes Gemini Omni Flash peuvent renvoyer des vidéos courtes avec audio lorsque le mode sélectionné le prend en charge, ce qui réduit le besoin d’ajouter un pipeline TTS ou sound design séparé dès la première génération.

  • · Sortie vidéo avec audio si prise en charge
  • · Utile pour les premiers concepts de vidéos courtes
  • · Moins de pipeline audio séparé

Deux façons d’utiliser Gemini Omni Flash : API EvoLink ou Agent

Utilisez l’API EvoLink pour intégrer le modèle à un produit ou traiter des lots, ou appelez-la depuis Codex, Claude ou Gemini pour des workflows créatifs et de développement rapides. Les deux méthodes partagent la même clé API EvoLink, le même solde, les mêmes routes de modèle et le même historique de tâches.

Option 1

Intégrer avec l’API EvoLink

Idéal pour : backends produit, tâches par lots, workflows automatisés

Appelez l’API vidéo unifiée d’EvoLink depuis votre serveur et contrôlez l’ID du modèle, les paramètres, la file de tâches, les callbacks et le stockage des résultats.

  1. 1Tester le rendu et le coût avec un brief réel dans le Playground
  2. 2Créer une clé API EvoLink dans la console
  3. 3Choisir l’ID de modèle adapté à votre tâche parmi les cartes de routes ci-dessus
  4. 4Soumettre la tâche et récupérer le résultat par polling ou callback HTTPS
Option 2

Appeler l’API avec un Agent

Idéal pour : création et développement dans Codex, Claude et Gemini

Donnez à l’Agent l’objectif, les ressources et les critères de validation. Il choisit la route, construit la requête, suit la tâche et renvoie le résultat sans vous obliger à coder chaque étape.

  1. 1Définir EVOLINK_API_KEY dans l’environnement local, jamais dans le code ni dans un prompt
  2. 2Décrire l’objectif, les références et les paramètres clés
  3. 3Demander à l’Agent d’appeler une route Gemini Omni Flash et d’enregistrer le task ID
  4. 4Laisser l’Agent suivre l’état final, télécharger le résultat et expliquer les échecs

Ce que les équipes construisent avec l'API Gemini Omni Flash

Quatre workflows pour quatre routes. La différence porte sur la forme de l'entrée, pas sur un palier de qualité - choisissez selon le matériel dont vous disposez.

Variantes publicitaires courtes à partir d'un brief

Générez 3 à 10 secondes à partir du seul prompt, puis itérez sur la formulation au lieu de retourner. L'audio natif rend le premier passage relisable sans étape TTS ou sound design séparée.

Animer une photo produit

L'image-vers-vidéo prend exactement une image d'entrée et ajoute un mouvement et un éclairage contrôlés tout en conservant le sujet. Utile quand la photographie produit est validée mais qu'il n'y a pas de budget vidéo.

Scènes cohérentes à partir de références

La référence-vers-vidéo accepte 1 à 6 images pour ancrer un personnage, une palette ou un style sur plusieurs plans. L'ordre n'a pas de signification ici - l'ensemble est lu comme un tout.

Retouches conversationnelles sur un plan existant

L'édition vidéo réécrit objets, style ou lumière dans un MP4 de 10 secondes maximum. Durée et format suivent l'entrée : la sortie reste directement interchangeable avec le montage d'origine.

API Gemini Omni Flash : exemple de code et gestion des erreurs

Cet exemple montre le flux exécutable minimal : créer une tâche, enregistrer le task ID retourné, puis effectuer un polling ou attendre un callback HTTPS. Consultez l’onglet API pour tous les paramètres et formats de réponse.

Voir la documentation API complète
cURL
curl -X POST https://api.evolink.ai/v1/videos/generations \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-omni-flash-text-to-video",
    "prompt": "A cinematic wide shot of a glass greenhouse at sunrise, slow camera push in",
    "duration": 8,
    "aspect_ratio": "16:9",
    "callback_url": "https://your-domain.com/webhooks/video"
  }'

# Save the returned task ID, then query:
curl https://api.evolink.ai/v1/tasks/{task_id} \
  -H "Authorization: Bearer $EVOLINK_API_KEY"

Échec de validation des paramètres

Vérifiez chaque valeur avec les cartes de paramètres ci-dessus : plages, options autorisées, nombre de ressources et formats de fichiers doivent correspondre à la route choisie.

Problème d’authentification ou de solde

Vérifiez le jeton Authorization Bearer, le solde disponible et la facturation de la tâche dans la console.

Contenu ou ressource refusé

Vérifiez les droits à l’image, les éléments de marque, le texte lisible, le contenu sensible et la conformité des ressources.

Tâche échouée ou expirée

Une tâche Gemini Omni Flash dont l’état final est « échoué » n’est pas facturée. Conservez le task ID et identifiez s’il s’agit d’un problème de validation, de modération ou d’exécution avant de relancer.

Callback non reçu

callback_url doit être une URL HTTPS publique, et non localhost ou une adresse de réseau privé. Conservez toujours le task ID comme solution de repli pour le polling.

Gemini Omni vs Veo 3.1 vs Seedance 2.0 — Comparaison côte à côte

Trois modèles couramment présélectionnés pour les workflows vidéo en production en 2026. Tous trois accessibles via une seule API key EvoLink.

FonctionnalitéGemini OmniVeo 3.1Seedance 2.0
Prix EvoLinkBasé sur les tokensÀ partir de $0.04/sÀ partir de $0.045/s
Qualité720p720p / 1080p, upscaling 4K selon disponibilité480p / 720p / 1080p
Audio natifOuiOuiOui
Contrôle de référenceTexte + image + édition par chatTexte + imageTexte + image + vidéo + audio
Durée vidéo3-10s / AutoClips courts avec Extend pour scènes plus longues si pris en charge4–15s
ÉditionNative par chat, multi-tourOrienté générationMode V2V
Idéal pourWorkflows à forte éditionBase cinématiqueProduction avec références multimodales

Comment intégrer Gemini Omni API

Trois étapes pour votre première tâche vidéo Gemini Omni. Même pattern d'intégration que Veo 3.1, Seedance 2.0 et Kling 3.0.

1

Étape 1 — Obtenez votre API key

Inscrivez-vous sur EvoLink.ai et générez votre API key depuis le tableau de bord. Aucun projet Google Cloud requis.

2

Étape 2 — Soumettez une tâche de génération

Envoyez un POST à /v1/videos/generations avec l’un des noms de modèle Gemini Omni Flash et votre prompt. Utilisez duration pour les modes de génération de 3 à 10 secondes ou Auto, image_urls pour image-vers-vidéo ou références-vers-vidéo, video_urls pour l’édition vidéo, et éventuellement callback_url pour la notification de fin. L’API traite la requête de manière asynchrone et retourne un task_id.

3

Étape 3 — Récupérez le résultat vidéo

Utilisez le task_id pour interroger l'endpoint de statut, ou attendez le webhook callback_url. Quand le statut passe à completed, vous recevez une URL de téléchargement pour le MP4 généré. Les liens sont valides 24 heures.

Capacités de Gemini Omni API

Spécifications techniques pour les workflows vidéo en production.

Édition

Édition vidéo par chat

Affinement multi-tour dans un workflow conversationnel, avec une continuité de scène dépendante de la route sélectionnée et de la qualité des entrées.

Sortie

720p, clips de 3-10s / Auto

Sortie 720p avec des clips configurables de 3 à 10 secondes ou Auto pour les modes de génération. Auto est estimé à 10 secondes. L’édition vidéo accepte une entrée MP4 jusqu’à 10 secondes.

Modes

Text-to-Video et Image-to-Video

T2V à partir de prompts et I2V avec image de référence en entrée. L'édition par chat s'applique aux résultats des deux modes.

Audio

Sortie vidéo avec support audio

Les sorties de vidéo courte peuvent inclure de l’audio lorsque la route Gemini Omni Flash sélectionnée le prend en charge.

Cohérence

Cohérence des personnages en contexte long

Conçu pour une meilleure continuité dans les workflows multi-input et fortement édités ; validez la cohérence avec vos propres prompts de production.

Workflow

API async avec task_id et callback

Soumettez une tâche, recevez un ID, interrogez le statut ou configurez une callback_url. Même cycle de vie que les autres modèles vidéo EvoLink.

Exemple de coût — Estimations tarifaires Gemini Omni

100 × clips de 3-10s/Auto pour un batch réseaux sociaux

Utiliser les tarifs actuels du Pricing

1 000 × clips de 3-10s/Auto/mois à l'échelle production

Utiliser les tarifs actuels du Pricing

1 génération + 3 éditions en workflow multi-tour

Utiliser les tarifs actuels du Pricing

Consultez l’onglet Pricing ci-dessus pour les tarifs actuels basés sur les tokens. Sélectionnez le workflow en modifiant le paramètre model.

Comparaison de Gemini Omni — Tous les modèles avec une seule API key EvoLink

Gemini Omni est surtout intéressant pour le workflow : entrées multimodales, édition conversationnelle et route EvoLink pratique pour le tester à côté de Veo, Seedance et Kling avec une seule API key.

Workflow d'édition natif par chat

Gemini Omni est orienté vers l’édition vidéo conversationnelle, tandis que Veo 3.1 et Seedance 2.0 sont généralement évalués d’abord comme routes de génération. Pour l’affinement multi-tour, c’est la différence de workflow à tester.

Cohérence des personnages en contexte long

Gemini Omni est présenté comme bénéficiant du contexte et des connaissances de Gemini pour la continuité dans les workflows multi-input et fortement édités. Évaluez ce comportement avec vos propres prompts de storyboard ou de vidéo courte.

Pas de projet Google Cloud — Même pattern async que Veo et Seedance

Aucune configuration GCP, pas de facturation Vertex, pas d'approbation de région séparée. Si vous exécutez déjà de la génération vidéo via EvoLink, ajouter Gemini Omni se fait en changeant un seul paramètre — même format de requête, même cycle de vie des tâches que Veo 3.1, Seedance 2.0 et Kling.

Famille de modèles vidéo Gemini

Comparez les routes vidéo de Google sous un seul compte EvoLink et une seule clé API, puis choisissez selon la durée du plan, la résolution et le coût.

Comparer tous les modèles Gemini
Gemini Omni Flash API

Gemini Omni Flash

Modèle actuel

Cette page. Quatre routes en 720p avec audio natif, durée de 3-10 s ou Auto, et édition vidéo conversationnelle.

Gemini Omni 1.1 Flash API

Gemini Omni 1.1 Flash

La génération Omni plus récente : de 360p au 4K suréchantillonné, contrôle des première et dernière images, plus édition et extension vidéo.

Voir l'API
Veo 3.1 API

Veo 3.1

Le modèle vidéo cinématographique de Google avec audio natif, pour des plans plus longs et plus fidèles.

Voir l'API

Autres modèles vidéo sur EvoLink en dehors de Gemini Omni Flash

Quand Gemini Omni Flash n'est pas le choix par défaut, utilisez le même brief pour comparer résolution, durée de plan, audio, stabilité du mouvement et coût total du projet.

Seedance 2.5 API

Seedance 2.5

Pour des plans de 4 à 30 secondes avec jusqu'à 50 références multimodales ; comparez le taux de plans exploitables sur les clips longs.

Voir l'API
MiniMax H3 API

MiniMax H3

Pour des clips 2K détaillés de 4 à 15 secondes ; comparez son taux de plans exploitables avec le même brief.

Voir l'API
Kling 3.0 API

Kling 3.0

Pour la génération créative, l'action et la vidéo multi-plans ; un recours de production en dehors de la famille Gemini.

Voir l'API
Topaz Video Upscale API

Topaz Video Upscale

Quand le mouvement et la composition sont déjà exploitables mais que l'image manque de netteté, utilisez Topaz pour récupérer du détail et suréchantillonner en 1x, 2x ou 4x.

Voir l'API

Questions fréquentes sur Gemini Omni API

Qu'est-ce que Gemini Omni et en quoi diffère-t-il de Veo 3.1 ?

Gemini Omni est la famille de modèles vidéo multimodaux annoncée par Google lors de Google I/O 2026. Omni Flash est discuté comme une route de vidéo courte pour les entrées texte, image, vidéo et audio. Par rapport à Veo 3.1, Gemini Omni est surtout intéressant pour l'édition conversationnelle et les workflows multi-input ; Veo reste une base solide pour la génération cinématique.

Combien coûte Gemini Omni API sur EvoLink ?

La facturation suit les usage tokens retournés par l’API, avec des compteurs séparés pour input, video output et other output. Consultez le tableau des tarifs ci-dessus pour les prix actuels.

Ai-je besoin d'un projet Google Cloud pour utiliser Gemini Omni via EvoLink ?

Non. EvoLink fournit l'accès via une seule API key. Aucun projet Google Cloud, pas de facturation Vertex, pas d'approbation de région séparée. Même authentification que Veo 3.1 et Seedance 2.0 sur EvoLink.

Quels modes Gemini Omni Flash sont pris en charge ?

Quatre modes sont disponibles : gemini-omni-flash-text-to-video, gemini-omni-flash-image-to-video, gemini-omni-flash-reference-to-video et gemini-omni-flash-video-edit. Tous partagent le même endpoint vidéo asynchrone.

Gemini Omni supporte-t-il callback_url et les webhooks ?

Oui. Passez une callback_url (HTTPS) lors de la soumission de la tâche et EvoLink peut envoyer des mises à jour par POST lorsque la tâche atteint un état final. L’interrogation de l’endpoint de statut fonctionne également si vous ne fournissez pas de callback URL.

Comment gérer les tâches Gemini Omni échouées ?

Les tâches échouées retournent un statut failed avec un motif d'erreur. Pour un retry applicatif, inspectez l’erreur, conservez les paramètres d’origine pour le diagnostic et resoumettez uniquement lorsque le problème d’entrée ou le défaut temporaire est clair.

Puis-je éditer une vidéo précédemment générée avec Gemini Omni ?

Oui — c’est l’une des principales différences de workflow de Gemini Omni. Utilisez une instruction d’édition en langage naturel et validez dans quelle mesure la route sélectionnée préserve la scène, l’identité du sujet et le mouvement entre les itérations.

Quelle est la durée maximale d'un clip avec Gemini Omni ?

Les modes de génération prennent en charge des clips configurables de 3 à 10 secondes ou Auto. Auto est estimé à 10 secondes pour la réservation. L’édition vidéo accepte une entrée MP4 jusqu’à 10 secondes. Pour des narrations plus longues, enchaînez plusieurs clips en exploitant la cohérence des personnages en contexte long.

Gemini Omni supporte-t-il l'image-to-video ?

Oui. Passez une URL d'image de référence et Gemini Omni l'utilise comme ancrage d'identité pour la vidéo générée.

Comment Gemini Omni se compare-t-il à Seedance 2.0 et Veo 3.1 ?

Seedance 2.0 présente de solides signaux de benchmark et de références multimodales, tandis que Veo 3.1 reste une base cinématique forte avec des workflows Flow et Extend avancés. Gemini Omni se différencie par l'édition conversationnelle, la génération multi-input et l'itération de vidéos courtes.

Puis-je accéder à tous les modèles vidéo Google via une seule API key EvoLink ?

Oui. EvoLink expose Gemini Omni, Veo 3.1, Nano Banana 2 et le reste de la famille Gemini via une seule API key. Changez simplement le paramètre model.