MiniMax H3 (Hailuo 3) est disponible sur EvoLinkEssayer avec 10 crédits gratuits

Prompts MiniMax H3 et exemples vidéo

Parcourez 12 prompts vérifiés avec résultats MiniMax H3 réels, entrées requises et variables réutilisables. Copiez un modèle ou envoyez-le au Playground EvoLink.

MiniMax H3 est aussi appelé Hailuo 3, Hailuo 3.0 ou Hailuo 03.

Mode de génération

Cas d’usage

12 prompts sur 12

Teaser de science-fiction généré avec MiniMax H3 : une silhouette isolée devant un vaste portail cosmique circulaire tandis qu’un titre émerge de l’obscuritéRÉFÉRENCE MULTIMODALE
15s16:92 médias de référence

Cinéma & VFX

Teaser mystère de science-fiction

Teaser cinématographique à deux références : une image fixe l’atmosphère, l’autre le personnage, puis le prompt pilote travelling, titre et son.

Voir les détails

Prompt complet (original anglais vérifié)

Realistic cinematic look, high-contrast lighting, and a tight pace. Use Figure 1 as the overall atmosphere and style reference, and Figure 2 as the protagonist reference. Shot 1 — Ultra-wide establishing shot. A huge circular cosmic gateway nearly fills the frame. The person is only a tiny figure seen from behind before the gateway, positioned toward the lower right. The ground is wet and reflective, and the center of the gateway is pitch black. The camera slowly pushes forward. A large title fades in from the edge of the darkness, blurred at first and then sharp: "THE STARS WERE LISTENING". Use an extremely condensed, heavy, all-caps typeface in dark red mixed with rust red, with subtle grain and misted edges. Audio: a deep low-frequency pulse, faint metallic vibrations in the distance, and a soft hit as the text becomes sharp. → Hard cut.

Éléments à fournir

  • Image 1 : la planche d’atmosphère et de style — décor, palette et étalonnage dont le plan doit hériter.
  • Image 2 : le personnage principal, cadré assez large pour que le visage et la silhouette restent lisibles quand il n’occupe qu’une petite part du cadre.
  • Un texte de titre que vous voulez réellement incruster : H3 restitue exactement ce que vous écrivez — restez court et vérifiez l’orthographe.

Pourquoi il fonctionne

  • Chaque référence a une seule fonction — l’Image 1 pour l’atmosphère, l’Image 2 pour le personnage — le modèle n’a donc jamais à deviner laquelle porte le look.
  • Le plan est décrit comme un seul travelling avant continu avec un unique événement (le titre qui devient net) : exactement ce que 15 secondes peuvent porter.
  • Le son est écrit en trois couches précises (pulsation grave, vibrations métalliques lointaines, un impact sur le titre) plutôt qu’en « musique cinématographique » vague.

Variables à remplacer

  • texte du titre et traitement typographique
  • portail ou point de repère du plan d’ensemble
  • couleur du titre
  • nappe sonore
  • comportement de la coupe finale

Contraintes

  • Désignez les assets par leur position dans le tableau — « Figure 1 », « Figure 2 » — en suivant l’ordre de image_urls. La syntaxe @image1 ne fait pas partie de ce contrat d’API.
  • Le prompt publié est volontairement un point de départ : il se termine sur une coupe franche pour que vous puissiez enchaîner votre propre second plan.

Réglages

Référence multimodale · 15s · 16:9 · 2 médias de référence

Clip texte-vers-vidéo généré avec MiniMax H3 : une cuisine au crépuscule filmée à l’épaule pendant qu’une créature lumineuse dessinée à la main se déplace entre les accessoiresTEXTE VERS VIDÉO
15s16:9Aucun média de référence

Cinéma & VFX

Créature lumineuse dans la cuisine

Modèle texte-vers-vidéo mêlant prise de vue réelle et animation dessinée, avec défauts de caméra et exclusions précises.

Voir les détails

Prompt complet (original anglais vérifié)

15-second, 16:9 landscape video. Blend live-action footage of a small kitchen at dusk with hand-drawn glowing animation. The last light of sunset lingers by the window. The lived-in kitchen contains an old wooden table, a half-washed mug, a slightly fogged glass bottle, and a hanging dishcloth. Give the footage subtle one-handed smartphone shake, hesitant close-range focusing, exposure fluctuations caused by backlight, and slightly coarse noise in the shadows. It should not look carefully arranged like an advertisement; instead, it should feel like someone hurriedly captured an unbelievable event at home. Do not show huge eyes, gaping mouths, fangs, threatening or lunging movements, sudden black frames, or jump scares. Use only kitchen room tone, cloth rubbing, the soft clink of a mug, water dripping from the faucet, the camera operator's footsteps and quiet breathing, plus gentle electronic sounds and tiny calls from the hand-drawn creature.

Éléments à fournir

  • Rien à téléverser — cette route ne prend que le prompt.
  • La durée et le format d’image se règlent dans les paramètres de la requête, pas seulement dans le texte du prompt.

Pourquoi il fonctionne

  • Les défauts de la caméra sont nommés — tremblement à une main, mise au point hésitante, variations d’exposition en contre-jour, bruit grossier dans les ombres. C’est ce qui vend « filmé à la va-vite chez soi » plutôt que « publicité ».
  • Une liste d’interdits courte et explicite (pas d’yeux immenses, pas de crocs, pas d’attaque, pas de jump scare) empêche une créature mignonne de glisser vers l’horreur.
  • La direction sonore nomme chaque source séparément : son de la pièce, tissu, tasse, robinet, pas, respiration, plus les sons de la créature.

Variables à remplacer

  • pièce et moment de la journée
  • design et comportement de la créature
  • accessoires sur la table
  • défauts de caméra visibles
  • couches sonores

Contraintes

  • Le prompt annonce sa longueur et son cadrage dans le texte ; l’API a tout de même besoin de duration et aspect_ratio comme champs de requête.
  • Les consignes négatives fonctionnent mieux en liste courte et explicite. Empiler des dizaines d’interdits consomme le budget nécessaire à l’action.

Réglages

Texte vers vidéo · 15s · 16:9 · Aucun média de référence

Bande-annonce verticale générée avec MiniMax H3 : un vampire et une héroïne humaine dans un intérieur de château éclairé à la bougieRÉFÉRENCE MULTIMODALE
15s9:162 médias de référence

Mini-série & narration

Mini-série romantique de vampires

Accroche verticale : une image verrouille les deux rôles, une autre le lieu, et le prompt se concentre sur la relation, le rythme et les cadrages.

Voir les détails

Prompt complet (original anglais vérifié)

Generate a 15-second, 9:16 vertical trailer segment for an international live-action vampire romance short drama. Use Figure 1 as the appearance reference for the male and female leads, and Figure 2 as the scene reference. Keep both leads' identities consistent, with a realistic live-action look and premium short-drama production quality. Story: an innocent human heroine accidentally enters a forbidden area of an old castle and awakens a sleeping aristocratic vampire. He discovers that she carries an aura connected to an ancient war, which sparks a powerful urge to control her and a dangerous fascination with her. She fears him but does not completely submit, resisting his pressure. Overall style: an international ReelShort / DramaBox vampire-romance trailer. Dark romance, dangerous attraction, fate, intense control, brooding oppression, and a striking reversal. Keep the visuals premium, restrained, and tightly paced, like the opening 15-second hook of a hit short drama. No gore, cheap horror, Halloween aesthetic, or modern street feel. Format: 9:16 vertical composition for TikTok / ReelShort / DramaBox. Use primarily medium close-ups, close-ups, and extreme close-ups, emphasizing faces, eye contact, pressure, and relationship tension within the vertical frame.

Éléments à fournir

  • Image 1 : les deux rôles principaux ensemble, pour que le modèle les lise comme un casting cohérent.
  • Image 2 : le décor — l’intérieur du château, sa lumière et ses matières.
  • Une prémisse en une phrase et un retournement émotionnel explicite ; une accroche de 15 secondes porte un retournement, pas un épisode entier.

Pourquoi il fonctionne

  • Nommer la référence de genre (bande-annonce ReelShort / DramaBox) transmet rythme, étalonnage et conventions de cadrage en quelques mots.
  • Le vocabulaire de cadrage est fixé — plan taille, gros plan, très gros plan — et c’est ce qui rend un format vertical haut de gamme plutôt qu’à l’étroit.
  • La liste d’exclusions (pas de gore, pas d’horreur bon marché, pas d’esthétique Halloween, pas d’ambiance rue contemporaine) écarte les quatre dérives habituelles du genre.

Variables à remplacer

  • références d’apparence des rôles principaux
  • lieu
  • prémisse et retournement
  • look de la plateforme visée
  • combinaison des cadrages

Contraintes

  • Le format vertical se demande via aspect_ratio sur la route de référence, pas en écrivant « 9:16 » dans le prompt.
  • L’identité tient bien mieux quand les deux rôles arrivent sur une seule image plutôt que sur deux portraits recadrés séparément.

Réglages

Référence multimodale · 15s · 9:16 · 2 médias de référence

Publicité verticale pour des lunettes générée avec MiniMax H3 : deux mannequins dans un studio blanc sans raccord portant des lunettes enveloppantes futuristesRÉFÉRENCE MULTIMODALE
15s9:163 médias de référence

Marque & publicité produit

Campagne de lunettes futuristes

Publicité mode à trois images, chacune responsable du visuel principal, des visages ou du design produit.

Voir les détails

Prompt complet (original anglais vérifié)

Generate a vertical screen 9:16 high-end fashion glasses commercial, taking overall reference to the storyboard rhythm, editing speed, white studio texture and cool fashion atmosphere of the given video. The picture is a minimalist white booth, a seamless white background, a strong sense of high-end advertising, and a clean, simple, handsome, avant-garde, international first-line fashion blockbuster texture. Key visual character reference picture 1, two full-body female models, one black female model and one European and American model, maintain their high-end clothing, body posture, white studio light and shadow, fashion show temperament and overall cool attitude. Both of them wear futuristic high-end glasses. The design of the glasses refers to Figure 3, emphasizing the covered curved surface, sharp geometric cat-eye/goggle hybrid outline, mirror reflection, streamlined temples, and the texture of high-end fashion accessories. Please refer to Figure 2 for the appearance details of the two characters.

Éléments à fournir

  • Image 1 : le visuel clé — mannequins en pied, garde-robe, lumière de studio et attitude.
  • Image 2 : le détail des visages, pour que les deux personnages restent identiques d’un plan à l’autre.
  • Image 3 : le produit, photographié assez nettement pour que sa silhouette et ses matières survivent à un montage rapide.
  • Un fond de studio sans raccord que vous acceptez de garder sur tout le clip.

Pourquoi il fonctionne

  • Trois références avec trois fonctions explicites : c’est exactement le schéma pour lequel la route de référence est conçue ; l’ambiguïté est ce qui fait échouer les prompts multi-images.
  • Le produit est décrit par sa géométrie — courbure enveloppante, contour hybride cat-eye/masque, surface miroir, branches profilées — et pas seulement par son nom.
  • Un studio blanc uni retire toute variance du fond, pour que le budget aille au produit et aux mannequins.

Variables à remplacer

  • catégorie de produit
  • casting des mannequins
  • couleur du studio
  • rythme de montage
  • garde-robe

Contraintes

  • Le prompt publié demande aussi le rythme d’une vidéo donnée. Le jeu d’assets diffusé pour ce cas contient trois images : traitez cette ligne comme une consigne de style, ou joignez votre propre clip en Video 1.
  • Jusqu’à 9 images, 3 vidéos et 3 clips audio par requête de référence, dans la limite de 12 fichiers au total ; l’audio ne peut jamais être le seul type de référence.

Réglages

Référence multimodale · 15s · 9:16 · 3 médias de référence

Animation en pâte à modeler générée avec MiniMax H3 : un renard en argile franchit un canyon de lave pendant que la caméra passe sous luiPREMIÈRE / DERNIÈRE IMAGE
10s16:91 média de référence

Personnage & mouvement

Renard en argile sautant un canyon

Une image de départ devient une action unique, avec un mouvement de caméra décrit aussi précisément que le saut.

Voir les détails

Prompt complet (original anglais vérifié)

Claymation style. A sprinting fox reaches the edge of a cliff and launches without hesitation, making a dramatically tense, heroic slow-motion leap across a vast lava canyon. While the fox is airborne, the camera rushes at high speed beneath its belly in a sweeping dynamic move, fully revealing the terrifying depth of the chasm and the fox's clay body at maximum extension in midair.

Éléments à fournir

  • Une image de départ qui porte déjà le style — ici le renard en argile et sa matière.
  • Une action que vous voulez voir arriver. Pas trois.

Pourquoi il fonctionne

  • Le prompt décrit le changement, pas l’image. L’image de départ contient déjà l’apparence, donc chaque mot achète du mouvement.
  • La caméra reçoit sa propre consigne — un passage à grande vitesse sous le ventre du renard — et c’est ce qui transforme un saut en plan.
  • Nommer le moment de bascule (« extension maximale en plein vol ») donne au modèle une pose cible autour de laquelle construire le timing.

Variables à remplacer

  • personnage et style de matière
  • environnement et danger
  • trajectoire de caméra
  • accent du ralenti

Contraintes

  • La route image-vers-vidéo déduit le format de sortie de l’image d’entrée et rejette aspect_ratio.
  • Ne redécrivez pas ce que l’image de départ montre déjà : répéter l’apparence statique est la façon la plus courante de gaspiller un prompt image-vers-vidéo.

Réglages

Première / dernière image · 10s · 16:9 · 1 média de référence

Montage vidéo généré avec MiniMax H3 : dans un clip source, le journal, la chaise, les lunettes de soleil et la voiture en feu ont été remplacés ou supprimésRÉFÉRENCE MULTIMODALE
10s16:91 média de référence

Montage & transformation

Montage de scène multi-éléments

Six modifications séparées d’un clip source, écrites comme une liste cible → résultat sans redécrire la scène.

Voir les détails

Prompt complet (original anglais vérifié)

Replace the newspaper in the reference video with a green-covered book; change the chair the character is sitting on to a red sofa; remove the sunglasses worn by the character to retain a clear face; remove the car burning effect to keep the vehicle in a normal state; change the photo the character takes out of his arms to a small black book; and add a tree on the left side of the screen

Éléments à fournir

  • Video 1 : le clip à modifier, 2 à 15 secondes, MP4 ou MOV, H.264 ou H.265, jusqu’à 50 Mo.
  • Une liste de modifications, chacune indiquant quoi changer et en quoi.

Pourquoi il fonctionne

  • Chaque consigne est une paire — cible plus résultat — et ne laisse rien à l’interprétation (« le journal » devient « un livre à couverture verte »).
  • Les suppressions indiquent l’état final voulu (« retirer les lunettes de soleil pour dégager le visage »), ce qui évite un trou là où se trouvait l’objet.
  • Il n’y a aucune description de scène, donc le modèle traite le clip source comme la vérité et n’applique que les écarts.

Variables à remplacer

  • nombre de modifications
  • objets remplacés
  • effets supprimés
  • éléments ajoutés

Contraintes

  • EvoLink expose trois routes H3 ; le travail de montage passe par reference-to-video avec le clip source en Video 1.
  • La durée de la vidéo de référence est facturée : coupez la source sur la portion utile avant de la téléverser.
  • Indiquez ce qui doit rester intact quand une modification jouxte un élément auquel vous tenez — les zones non mentionnées sont à la merci du modèle.

Réglages

Référence multimodale · 10s · 16:9 · 1 média de référence

Transition d’interface de visual novel générée avec MiniMax H3 entre une image d’ouverture et une image de fin fixéesPREMIÈRE / DERNIÈRE IMAGE
15s16:92 médias de référence

Mini-série & narration

Transition de visual novel otome

Les première et dernière images fixent les extrémités ; le texte ne décrit que la transition et l’évolution émotionnelle.

Voir les détails

Prompt complet (original anglais vérifié)

Use the first image as the opening frame and the second image as the exact final frame to generate an otome visual-novel interface transition. Overall feel: a premium Chinese otome romance-interaction interface capturing an intimate moment before and after a performance. Transition naturally from "choose to watch his performance" to "Han Xu is drawn in by the heroine's words and reacts with intrigued interest." UI text, choices, and dialogue boxes should appear with refined otome-game presentation. Keep the transition silky smooth and the emotion suggestive yet restrained.

Éléments à fournir

  • Image 1 : l’image d’ouverture, avec l’état de son interface.
  • Image 2 : exactement l’image de fin sur laquelle vous voulez atterrir.
  • Une phrase décrivant le changement émotionnel entre les deux états.

Pourquoi il fonctionne

  • Les deux extrémités sont verrouillées : le modèle résout une interpolation au lieu d’une composition, la voie la plus fiable vers un plan prévisible.
  • Le prompt nomme la transition émotionnelle (« choisir de regarder sa performance » → « happée et intriguée ») au lieu d’énumérer des images, si bien que le jeu porte le raccord.
  • Demander que les éléments d’interface s’animent dans le langage du genre évite que l’UI soit redessinée.

Variables à remplacer

  • images d’ouverture et de fin
  • arc émotionnel entre les deux
  • style de présentation de l’interface
  • vitesse de transition

Contraintes

  • Envoyez les deux images en image_start et image_end sur la route image-vers-vidéo ; la route de référence n’accepte pas ces champs.
  • Plus les deux images se ressemblent en cadrage et en lumière, plus l’interpolation est douce. Deux compositions sans rapport produisent une coupe, pas une transition.

Réglages

Première / dernière image · 15s · 16:9 · 2 médias de référence

Transfert de mouvement généré avec MiniMax H3 : deux personnages référencés exécutent une chorégraphie street dance copiée d’une vidéo de référenceRÉFÉRENCE MULTIMODALE
10s16:93 médias de référence

Personnage & mouvement

Transfert de mouvement street dance

Une consigne très courte transfère la chorégraphie d’une vidéo vers deux personnages fournis en images.

Voir les détails

Prompt complet (original anglais vérifié)

Have the characters perform street dance following the movements in Video 1. Use Figure 1 and Figure 2 as the character references.

Éléments à fournir

  • Image 1 et Image 2 : les deux personnages, une référence en pied nette pour chacun.
  • Video 1 : le mouvement à copier, 2 à 15 secondes, avec l’interprète entièrement dans le cadre.

Pourquoi il fonctionne

  • Le prompt est court parce que ce sont les références qui portent l’information : la vidéo possède le mouvement, les images possèdent les identités.
  • Chaque asset est désigné par sa position dans le tableau : aucune ambiguïté sur la référence qui fournit quoi.
  • Rien d’autre n’est demandé. Ni lumière, ni caméra, ni style — chaque consigne supplémentaire entrerait en concurrence avec le mouvement à copier.

Variables à remplacer

  • personnages
  • chorégraphie source
  • environnement
  • nombre d’interprètes

Contraintes

  • La durée totale des vidéos de référence doit rester sous 15 secondes, chaque clip faisant 2 à 15 secondes entre 23,976 et 60 ips.
  • Les vidéos de référence doivent être en MP4 ou MOV avec H.264 ou H.265, jusqu’à 50 Mo chacune, le corps JSON complet restant sous 64 Mo.

Réglages

Référence multimodale · 10s · 16:9 · 3 médias de référence

Remplacement de dialogue généré avec MiniMax H3 : la réplique d’un personnage a été remplacée par une nouvelle réplique issue d’un clip audio de référenceRÉFÉRENCE MULTIMODALE
10s16:92 médias de référence

Audio natif & dialogue

Remplacement du dialogue et du jeu

Remplace une réplique en citant mot pour mot l’ancienne et la nouvelle, avec une modification limitée du jeu.

Voir les détails

Prompt complet (original anglais vérifié)

Replace the girl's line in Video 1, "We can't be together. It's not that we don't love each other; we truly can't make it to the end," with the line from Audio 1: "Don't go, okay? This time, let's not let go of each other." Slightly adjust the corresponding performance.

Éléments à fournir

  • Video 1 : le clip contenant la réplique à remplacer.
  • Audio 1 : la nouvelle réplique, WAV ou MP3, jusqu’à 15 Mo et 15 secondes.
  • Les deux répliques écrites mot pour mot dans le prompt.

Pourquoi il fonctionne

  • Citer la réplique sortante indique exactement quel segment du clip traiter, au lieu de « le dialogue vers le milieu ».
  • Citer la réplique entrante donne une cible à la synchronisation labiale au lieu de la déduire du seul audio.
  • « Ajuster légèrement le jeu correspondant » accorde une permission bornée de modifier l’interprétation — bornée, pour que le reste de la prise survive.

Variables à remplacer

  • clip source
  • réplique remplacée
  • nouvelle réplique et voix
  • ampleur autorisée du changement de jeu

Contraintes

  • L’audio ne peut jamais être le seul type de référence ; il doit arriver avec une image ou une vidéo.
  • L’audio et la vidéo de référence sont chacun plafonnés à 15 secondes de durée totale par requête.
  • Dites ce qui reste fixe. Le cadrage, les costumes et l’arrière-plan dérivent si le prompt ne parle que de la réplique.

Réglages

Référence multimodale · 10s · 16:9 · 2 médias de référence

Clip de référence vocale généré avec MiniMax H3 : un personnage prononce une réplique écrite avec le timbre issu d’un clip audio de référenceRÉFÉRENCE MULTIMODALE
10s16:92 médias de référence

Audio natif & dialogue

Référence vocale « Suis le vent »

Le prompt audio minimal : la phrase exacte et un clip qui définit le timbre de la voix.

Voir les détails

Prompt complet (original anglais vérifié)

Character dialogue: "Follow the wind, live free. Leave worries behind, enjoy the moment." Use Audio 1 as the voice-timbre reference.

Éléments à fournir

  • Video 1 : le personnage qui prononcera la réplique.
  • Audio 1 : un échantillon propre de la voix cible, 2 à 15 secondes, idéalement sans musique dessous.
  • La réplique exacte, écrite intégralement.

Pourquoi il fonctionne

  • Le dialogue est cité plutôt que paraphrasé, ce qui donne au timing et à la synchronisation labiale quelque chose de concret sur quoi s’accrocher.
  • Audio 1 se voit confier une seule fonction étroite — le timbre — au lieu d’être livré comme une « bande-son » générale.
  • Rien d’autre n’est spécifié, donc le clip de référence garde le contrôle total du cadrage et du jeu.

Variables à remplacer

  • réplique
  • référence vocale
  • clip du personnage
  • débit

Contraintes

  • Une référence vocale transfère le timbre, pas l’accent, l’émotion ni le rythme ; écrivez-les dans le prompt si cela compte.
  • De la musique ou plusieurs locuteurs dans l’audio de référence dégradent le résultat — fournissez une voix isolée.

Réglages

Référence multimodale · 10s · 16:9 · 2 médias de référence

Plan de scène généré avec MiniMax H3 : deux magiciens échangent la couleur de leur costume dans un nuage de fumée pendant que le rideau passe du rouge au bleuPREMIÈRE / DERNIÈRE IMAGE
7s16:91 média de référence

Montage & transformation

Permutation des costumes de magiciens

Test de suivi d’instructions : deux costumes s’échangent, un détail reste identique et le fond change de couleur au bon moment.

Voir les détails

Prompt complet (original anglais vérifié)

Two magicians stand onstage facing the audience and perform a "swap" trick. They wave their wands at the same time, and a cloud of smoke rises. When it clears, their suit colors have switched: the person on the left wears a white suit, and the person on the right now wears a black suit, while both magicians' glove colors remain unchanged. They bow to thank the audience. The red curtain behind them closes, transitioning from deep red to deep blue.

Éléments à fournir

  • Une image de départ montrant les deux artistes, leurs costumes et la scène.
  • Un état avant/après clair pour tout ce qui doit être échangé.

Pourquoi il fonctionne

  • L’échange est masqué par un événement — le nuage de fumée — ce qui donne au modèle un moment légitime pour opérer le changement plutôt que de morpher à l’image.
  • Ce qui ne doit pas changer (la couleur des gants) est écrit juste à côté de ce qui change : c’est exactement ainsi qu’on empêche un montage de déborder.
  • Le plan se termine sur un état défini : le salut, le rideau qui se ferme, la couleur qui se pose sur un bleu profond.

Variables à remplacer

  • artistes et costumes
  • le détail qui reste fixe
  • événement qui masque l’échange
  • transition de couleur finale

Contraintes

  • La route image-vers-vidéo déduit le format de l’image d’entrée et rejette le champ aspect_ratio.
  • Tout attribut non mentionné est à la merci du modèle. Si un détail doit survivre au changement, écrivez-le.

Réglages

Première / dernière image · 7s · 16:9 · 1 média de référence

Film produit généré avec MiniMax H3 : un casque circum-aural haut de gamme tourne au-dessus d’un socle réfléchissant dans un studio noirTEXTE VERS VIDÉO
15s16:9Aucun média de référence

Marque & publicité produit

Présentation d’un casque haut de gamme

Film produit de 15 secondes en quatre blocs chronométrés, chacun avec son mouvement de caméra et son objectif.

Voir les détails

Prompt complet (original anglais vérifié)

Create a 15-second luxury cinematic product showcase for premium wireless over-ear headphones. 0–4s: Begin with an extreme macro tracking shot moving across the soft memory-foam ear cushion, fine fabric texture, brushed-metal hinge and precision-machined controls. A narrow light band travels across the surface, revealing realistic materials against a deep black studio background. 4–8s: Pull back into a three-quarter hero view. The headphones rotate slowly above a glossy reflective pedestal. The ear cups pivot naturally while the adjustable headband extends slightly, demonstrating flexible construction and comfort. Maintain exact symmetry, stable geometry and consistent proportions. 8–12s: Transition into an elegant exploded-view reveal. The ear cushion, acoustic driver, internal sound chamber, control ring and outer shell separate smoothly in perfect alignment. Subtle luminous sound waves pulse outward from the driver while the camera performs a restrained side orbit. 12–15s: Every component reconnects seamlessly. The headphones settle into a centered front-facing hero composition as soft rim lighting defines the silhouette. Complete a gentle dolly-in toward the ear cups. Premium technology-commercial finish, controlled reflections, realistic shadows, shallow depth of field, crisp surface detail, stable product shape, no hands, no distortion, no onscreen text.

Éléments à fournir

  • Rien à téléverser — le texte vers vidéo ne prend que le prompt.
  • Un produit que vous savez décrire par ses matières et son mécanisme, pas seulement par son nom.

Pourquoi il fonctionne

  • Le temps est découpé en 0–4 s, 4–8 s, 8–12 s et 12–15 s : le modèle reçoit une liste de plans plutôt qu’une liste de souhaits.
  • Chaque bloc bouge la caméra différemment — travelling macro, recul, orbite latérale, avancée — et c’est ce qui fait lire le clip comme monté plutôt que flottant.
  • La dernière ligne est une liste d’interdits (pas de mains, pas de déformation, pas de texte à l’écran) qui couvre les trois échecs habituels des rendus produit.

Variables à remplacer

  • produit
  • matières et finition
  • durée de chaque bloc
  • fond et éclairage
  • présence ou non de la vue éclatée

Contraintes

  • La durée est un entier de 4 à 15 secondes défini dans la requête ; la somme des blocs du prompt doit y correspondre.
  • Les blocs chronométrés sont une direction, pas une timeline stricte. Pas plus de quatre pour un clip de 15 secondes.
  • Ce clip a été publié par son auteur en 720p ; les routes H3 sur EvoLink produisent du 2K.

Réglages

Texte vers vidéo · 15s · 16:9 · Aucun média de référence

Le framework de prompt MiniMax H3

H3 comprend les références ordonnées et génère son propre audio. Écrivez pour le workflow choisi plutôt qu’avec une formule générique.

La structure d’un prompt H3

Objectif → références ordonnées → identité du sujet → actions chronologiques → trajectoire de caméra → audio ou dialogue → éléments à conserver → état final. Cette structure évite d’oublier le son et la fin.

Texte vers vidéo

Décrivez une chronologie réalisable : le sujet, quelques actions, un seul mouvement de caméra continu et des couches séparées pour le dialogue, l’ambiance et la musique.

Première / dernière image

Les images définissent déjà l’apparence. Décrivez seulement la transformation, le mouvement de caméra, ce qui doit rester identique et l’état final.

Références multimodales

Attribuez une seule fonction à chaque fichier et citez sa position : Image 1 pour le personnage, Image 2 pour le lieu, Video 1 pour le mouvement et Audio 1 pour la voix.

Modifier une vidéo existante

Créez deux listes : « Modifier » avec cible → résultat et « Conserver » pour les éléments intacts. Envoyez uniquement l’extrait utile comme Video 1.

Audio et dialogue

Citez mot pour mot les répliques. Limitez la référence vocale au timbre, puis précisez séparément l’accent, l’émotion et le rythme.

Diagnostic des échecs

Sept erreurs fréquentes dans un prompt H3 et la correction à appliquer.

La vidéo ignore une partie du prompt
Cause probableTrop de sujets, de styles et d’événements se disputent la même durée.
CorrectionGardez un sujet, un lieu et seulement les actions que la durée peut contenir.
La caméra dérive ou se contredit
Cause probableDeux mouvements incompatibles sont demandés dans le même plan.
CorrectionUtilisez une seule trajectoire continue ; présentez le second mouvement comme un nouveau plan.
Une référence contrôle le mauvais élément
Cause probableLe rôle des fichiers n’est pas défini.
CorrectionCitez chaque fichier par sa position et donnez-lui une seule fonction.
L’histoire est trop rapide
Cause probableUne intrigue complète est comprimée dans un clip court.
CorrectionPrévoyez environ une action toutes les trois à quatre secondes ; dix secondes suffisent pour deux ou trois actions.
Rien ne bouge vraiment
Cause probableLe prompt décrit l’apparence au lieu du changement.
CorrectionUtilisez des verbes : que se passe-t-il, dans quel ordre et comment le plan se termine-t-il ?
La modification déborde de la zone demandée
Cause probableAucune zone ni propriété à conserver n’est indiquée.
CorrectionListez les visages, vêtements, arrière-plans et cadrages qui doivent rester identiques.
Le son devient confus
Cause probableDialogue, ambiance et musique sont demandés sans hiérarchie.
CorrectionDésignez la couche principale, baissez les autres et laissez de l’espace au dialogue.

FAQ des prompts MiniMax H3

MiniMax H3 et Hailuo 3 désignent-ils le même modèle ?

Oui. MiniMax H3 est aussi appelé Hailuo 3, Hailuo 3.0 ou Hailuo 03. EvoLink emploie MiniMax H3 et propose trois routes : texte vers vidéo, image vers vidéo et référence vers vidéo.

Puis-je utiliser ces prompts sans coder ?

Oui. « Utiliser ce prompt » envoie le prompt anglais vérifié au Playground MiniMax H3 avec le bon workflow. Vous ajoutez ensuite les fichiers de référence.

Quelle peut être la durée d’une vidéo MiniMax H3 ?

Les trois routes acceptent une durée entière de 4 à 15 secondes et produisent actuellement du 2K. La durée affichée sur chaque carte correspond à l’exemple publié.

Combien de références un prompt peut-il utiliser ?

La route de référence accepte jusqu’à 9 images, 3 vidéos et 3 audios, dans la limite de 12 fichiers au total : un ensemble complet 9 + 3 + 3 est donc refusé. Une image ou une vidéo est obligatoire ; l’audio seul est refusé. Chaque vidéo ou audio doit durer de 2 à 15 secondes.

Pourquoi les prompts mentionnent-ils « Image 1 » ou « Video 1 » ?

L’API associe les fichiers selon leur position dans image_urls, video_urls et audio_urls. Ces mentions anglaises conservées dans le prompt vérifié attribuent un rôle à un fichier précis.

D’où viennent les prompts et les vidéos ?

Chaque carte indique sa source. Les exemples officiels utilisent une version anglaise vérifiée du prompt chinois ; les exemples communautaires renvoient vers la publication originale sur X.

Puis-je envoyer ces prompts par API ?

Oui. Le même prompt anglais fonctionne dans le Playground et dans le champ prompt de l’API. Le guide MiniMax H3 couvre les requêtes, tâches asynchrones, callbacks et erreurs.

Choisissez un prompt et générez

Chaque prompt correspond à une route MiniMax H3 active sur EvoLink. Envoyez-le au Playground ou utilisez la même requête via l’API unifiée.