MiniMax H3(Hailuo 3)が EvoLink に登場無料10クレジットで試す

MiniMax H3プロンプトと動画例

実際のMiniMax H3出力、必要な入力、置き換え可能な変数を備えた検証済みプロンプト12件を掲載。テンプレートをコピーするか、EvoLink Playgroundに直接送信できます。

MiniMax H3はHailuo 3、Hailuo 3.0、Hailuo 03とも呼ばれます。

生成モード

用途

12件中12件のプロンプト

MiniMax H3 で生成したSF予告編:巨大な円形の宇宙ゲートの前に立つ小さな人影と、暗闇から浮かび上がるタイトルマルチモーダル参照
15s16:9参照素材 2件

シネマティック・VFX

SFミステリー予告編

2枚の参照画像で雰囲気と主人公を固定し、プロンプトでプッシュイン、タイトル、音響を制御する予告編です。

詳細を表示

完全なプロンプト(検証済み英語原文)

Realistic cinematic look, high-contrast lighting, and a tight pace. Use Figure 1 as the overall atmosphere and style reference, and Figure 2 as the protagonist reference. Shot 1 — Ultra-wide establishing shot. A huge circular cosmic gateway nearly fills the frame. The person is only a tiny figure seen from behind before the gateway, positioned toward the lower right. The ground is wet and reflective, and the center of the gateway is pitch black. The camera slowly pushes forward. A large title fades in from the edge of the darkness, blurred at first and then sharp: "THE STARS WERE LISTENING". Use an extremely condensed, heavy, all-caps typeface in dark red mixed with rust red, with subtle grain and misted edges. Audio: a deep low-frequency pulse, faint metallic vibrations in the distance, and a soft hit as the text becomes sharp. → Hard cut.

必要な入力

  • 画像1:雰囲気とスタイルの基準。カットに引き継ぎたい環境、配色、カラーグレーディングを含めます。
  • 画像2:主人公の参照。人物が画面内で小さくなっても顔とシルエットが判別できる大きさで撮影します。
  • 実際に焼き込みたいタイトル文字。H3 は書いたとおりに文字を描画しようとするため、短くし綴りを正確にします。

機能する理由

  • 参照素材ごとに役割が1つだけ与えられています(画像1が雰囲気、画像2が人物)。どちらがルックを決めるかをモデルが推測せずに済みます。
  • カットは1回の連続プッシュインと1つの出来事(タイトルが鮮明になる)だけで構成されており、15秒が実際に支えられる情報量に収まっています。
  • 音は「映画的な劇伴」といった曖昧な指定ではなく、低域のパルス、遠くの金属的な振動、文字が鮮明になる瞬間の打撃音という3層で書かれています。

置き換え可能な変数

  • タイトル文字と書体処理
  • 設定ショットのゲートやランドマーク
  • タイトルの色
  • 環境音のベッド
  • 終わりのカットの扱い

制約

  • 素材は配列上の位置で指定します(「Figure 1」「Figure 2」)。image_urls の並び順と一致させてください。@image1 という記法はこの API 契約には含まれません。
  • 公開されているプロンプトは意図的に途中で止めた出発点です。ハードカットで終わるため、2つ目のカットを自分で続けられます。

設定

マルチモーダル参照 · 15s · 16:9 · 参照素材 2件

MiniMax H3 で生成したテキスト動画:夕暮れの台所を手持ちで撮影し、手描きの光る生きものが小道具の間を動く様子テキストから動画
15s16:9参照素材なし

シネマティック・VFX

光る台所の生きもの

実写の台所と手描き発光アニメを組み合わせ、カメラの不完全さと禁止要素を明記したテキスト動画テンプレートです。

詳細を表示

完全なプロンプト(検証済み英語原文)

15-second, 16:9 landscape video. Blend live-action footage of a small kitchen at dusk with hand-drawn glowing animation. The last light of sunset lingers by the window. The lived-in kitchen contains an old wooden table, a half-washed mug, a slightly fogged glass bottle, and a hanging dishcloth. Give the footage subtle one-handed smartphone shake, hesitant close-range focusing, exposure fluctuations caused by backlight, and slightly coarse noise in the shadows. It should not look carefully arranged like an advertisement; instead, it should feel like someone hurriedly captured an unbelievable event at home. Do not show huge eyes, gaping mouths, fangs, threatening or lunging movements, sudden black frames, or jump scares. Use only kitchen room tone, cloth rubbing, the soft clink of a mug, water dripping from the faucet, the camera operator's footsteps and quiet breathing, plus gentle electronic sounds and tiny calls from the hand-drawn creature.

必要な入力

  • アップロードは不要です。このルートはプロンプトのみで動作します。
  • 尺とアスペクト比はプロンプト文ではなくリクエストのパラメータで指定します。

機能する理由

  • 片手持ちの手ぶれ、迷いのあるピント合わせ、逆光による露出の揺れ、暗部の粗いノイズと、カメラの欠点が具体的に指定されています。これが「広告」ではなく「家で慌てて撮った」質感を生みます。
  • 巨大な目、牙、飛びかかる動き、ジャンプスケアを禁じる短い明示リストが、かわいい生きものがホラーへ流れるのを防ぎます。
  • 音の指示が発生源ごとに分かれています:部屋の空気音、布、マグカップ、蛇口、足音、呼吸、そして生きもの自身の声。

置き換え可能な変数

  • 部屋と時間帯
  • 生きもののデザインと動き
  • テーブル上の小道具
  • カメラのどの不完全さを見せるか
  • 音のレイヤー

制約

  • プロンプト内に尺と画面比が書かれていますが、API には duration と aspect_ratio をリクエスト項目として別途渡す必要があります。
  • 否定指示は短く明示的なリストが最も有効です。禁止事項を積み上げるほど、動作の記述に使える予算が削られます。

設定

テキストから動画 · 15s · 16:9 · 参照素材なし

MiniMax H3 で生成した縦型ショートドラマ予告:ろうそくの灯る城の内部にいる吸血鬼の主役と人間のヒロインマルチモーダル参照
15s9:16参照素材 2件

ショートドラマ・物語

吸血鬼ロマンス・ショートドラマ

1枚で主役2人、別の1枚で場所を固定し、関係性、テンポ、画角に集中する縦型フックです。

詳細を表示

完全なプロンプト(検証済み英語原文)

Generate a 15-second, 9:16 vertical trailer segment for an international live-action vampire romance short drama. Use Figure 1 as the appearance reference for the male and female leads, and Figure 2 as the scene reference. Keep both leads' identities consistent, with a realistic live-action look and premium short-drama production quality. Story: an innocent human heroine accidentally enters a forbidden area of an old castle and awakens a sleeping aristocratic vampire. He discovers that she carries an aura connected to an ancient war, which sparks a powerful urge to control her and a dangerous fascination with her. She fears him but does not completely submit, resisting his pressure. Overall style: an international ReelShort / DramaBox vampire-romance trailer. Dark romance, dangerous attraction, fate, intense control, brooding oppression, and a striking reversal. Keep the visuals premium, restrained, and tightly paced, like the opening 15-second hook of a hit short drama. No gore, cheap horror, Halloween aesthetic, or modern street feel. Format: 9:16 vertical composition for TikTok / ReelShort / DramaBox. Use primarily medium close-ups, close-ups, and extreme close-ups, emphasizing faces, eye contact, pressure, and relationship tension within the vertical frame.

必要な入力

  • 画像1:主役2人が一緒に写った参照。モデルが2人を1つのキャスティングとして読み取れます。
  • 画像2:ロケーションの基準。城内部の光と素材感を含めます。
  • 一文の設定と、明示された感情の反転。15秒のフックが支えられるのは1回の反転であり、1話分の物語ではありません。

機能する理由

  • ジャンルの参照(ReelShort / DramaBox 風の予告編)を指定するだけで、テンポ、カラー、構図の慣習を少ない語数で伝えられます。
  • ミディアムクローズアップ、クローズアップ、エクストリームクローズアップと画角の語彙を固定しています。縦型が窮屈ではなく高品質に見えるのはこの指定によります。
  • 除外リスト(流血、安いホラー、ハロウィン風、現代の街の雰囲気)が、このジャンルが崩れる典型的な4パターンを潰しています。

置き換え可能な変数

  • 主役の外見参照
  • ロケーション
  • 設定と反転
  • 想定プラットフォームの見え方
  • 画角の組み合わせ

制約

  • 縦型出力は参照ルートの aspect_ratio で指定します。プロンプトに「9:16」と書くだけでは指定になりません。
  • 主役2人が1枚に収まった画像のほうが、個別に切り出した2枚のポートレートより同一性が安定します。

設定

マルチモーダル参照 · 15s · 9:16 · 参照素材 2件

MiniMax H3 で生成した縦型アイウェア広告:シームレスな白いスタジオで未来的なラップアラウンド型メガネを着用した2人のモデルマルチモーダル参照
15s9:16参照素材 3件

ブランド・商品広告

未来的なアイウェア広告

キービジュアル、モデルの顔、製品デザインを3枚の画像で分担するファッション広告です。

詳細を表示

完全なプロンプト(検証済み英語原文)

Generate a vertical screen 9:16 high-end fashion glasses commercial, taking overall reference to the storyboard rhythm, editing speed, white studio texture and cool fashion atmosphere of the given video. The picture is a minimalist white booth, a seamless white background, a strong sense of high-end advertising, and a clean, simple, handsome, avant-garde, international first-line fashion blockbuster texture. Key visual character reference picture 1, two full-body female models, one black female model and one European and American model, maintain their high-end clothing, body posture, white studio light and shadow, fashion show temperament and overall cool attitude. Both of them wear futuristic high-end glasses. The design of the glasses refers to Figure 3, emphasizing the covered curved surface, sharp geometric cat-eye/goggle hybrid outline, mirror reflection, streamlined temples, and the texture of high-end fashion accessories. Please refer to Figure 2 for the appearance details of the two characters.

必要な入力

  • 画像1:キービジュアル。モデルの全身、衣装、スタジオ照明、佇まいを含みます。
  • 画像2:2人の顔のディテール。カットをまたいでも同一人物に保つために使います。
  • 画像3:製品。速いカットでもシルエットと素材感が残るよう、十分に鮮明に撮影します。
  • 動画全体を通して維持できるシームレスなスタジオ背景。

機能する理由

  • 3つの参照に3つの明確な役割を割り当てるのは、参照ルートが本来想定している使い方です。多画像プロンプトが崩れる原因は曖昧さにあります。
  • 製品は名前だけでなく形状で記述されています:包み込む曲面、キャットアイとゴーグルを混ぜた鋭い輪郭、ミラー反射、流線型のテンプル。
  • 単一素材の白いスタジオは背景のばらつきを排除し、モデルの処理能力を製品と人物に集中させます。

置き換え可能な変数

  • 製品カテゴリ
  • モデルのキャスティング
  • スタジオの色
  • 編集の速さ
  • 衣装

制約

  • 公開プロンプトは参照動画のテンポにも言及していますが、このケースで公開されている素材は画像3枚です。この一文はスタイル指示として扱うか、自分の映像を Video 1 として追加してください。
  • 参照リクエストは画像9枚、動画3本、音声3本まで、かつ合計12ファイルが上限です。音声だけを参照素材にすることはできません。

設定

マルチモーダル参照 · 15s · 9:16 · 参照素材 3件

MiniMax H3 で生成したクレイアニメ:溶岩の渓谷を飛び越えるクレイの狐と、その下を通り抜けるカメラ先頭/末尾フレーム
10s16:9参照素材 1件

キャラクター・動作

クレイ・フォックスの渓谷ジャンプ

1枚の開始画像を1つの明確な動作にし、カメラ経路も同じ精度で記述します。

詳細を表示

完全なプロンプト(検証済み英語原文)

Claymation style. A sprinting fox reaches the edge of a cliff and launches without hesitation, making a dramatically tense, heroic slow-motion leap across a vast lava canyon. While the fox is airborne, the camera rushes at high speed beneath its belly in a sweeping dynamic move, fully revealing the terrifying depth of the chasm and the fox's clay body at maximum extension in midair.

必要な入力

  • スタイルをすでに含んだ開始画像。ここではクレイの狐とその質感です。
  • 起こしたい動作を1つ。3つではありません。

機能する理由

  • プロンプトは絵ではなく変化を書いています。開始フレームが見た目をすでに担っているので、すべての語が動きに使われます。
  • カメラに独自の指示(狐の腹の下を高速で通り抜ける動き)が与えられており、これが単なるジャンプを「ショット」に変えています。
  • ピークの瞬間(「空中で最大限に伸びた状態」)を名指しすることで、モデルにタイミングを組み立てる目標ポーズを与えています。

置き換え可能な変数

  • キャラクターと素材のスタイル
  • 環境と危険要素
  • カメラ経路
  • スローモーションの強調点

制約

  • 画像から動画のルートは入力画像から出力比率を決定し、aspect_ratio は受け付けません。
  • 開始フレームがすでに示している内容を書き直さないでください。静的な見た目の繰り返しは、このルートのプロンプトを最も無駄にする書き方です。

設定

先頭/末尾フレーム · 10s · 16:9 · 参照素材 1件

MiniMax H3 で生成した動画編集:元クリップの新聞、椅子、サングラス、炎上する車が置換または削除された状態マルチモーダル参照
10s16:9参照素材 1件

編集・変換

複数要素のシーン編集

元動画に6つの変更を「対象 → 結果」で列挙し、シーン自体は説明し直しません。

詳細を表示

完全なプロンプト(検証済み英語原文)

Replace the newspaper in the reference video with a green-covered book; change the chair the character is sitting on to a red sofa; remove the sunglasses worn by the character to retain a clear face; remove the car burning effect to keep the vehicle in a normal state; change the photo the character takes out of his arms to a small black book; and add a tree on the left side of the screen

必要な入力

  • Video 1:編集対象のクリップ。2〜15秒、MP4 または MOV、H.264 または H.265、50 MB まで。
  • 編集リスト。各項目に「何を」「どう変えるか」を明記します。

機能する理由

  • すべての指示が「対象+結果」の組になっており、解釈の余地がありません(「新聞」が「緑の表紙の本」になる)。
  • 削除指示は望ましい最終状態も併記しています(「サングラスを外して顔をはっきりさせる」)。これにより、物があった場所に穴が残るのを防ぎます。
  • シーンの描写が一切ないため、モデルは元クリップを事実として扱い、差分だけを適用します。

置き換え可能な変数

  • 編集項目の数
  • 置き換える物
  • 取り除く効果
  • 追加する要素

制約

  • EvoLink が提供する H3 のルートは3つで、編集系の作業は元クリップを Video 1 とする reference-to-video で行います。
  • 参照動画の長さは課金対象です。アップロード前に必要な範囲だけに切り詰めてください。
  • 変更対象の隣に残したいものがある場合は、変わらない部分を明示してください。書かれていない領域はモデルが自由に扱えます。

設定

マルチモーダル参照 · 10s · 16:9 · 参照素材 1件

MiniMax H3 で生成したビジュアルノベルのインターフェース遷移:固定した開始フレームと最終フレームの間の変化先頭/末尾フレーム
15s16:9参照素材 2件

ショートドラマ・物語

乙女ビジュアルノベルのトランジション

先頭と末尾フレームを固定し、その間の過程と感情変化だけをテキストで指定します。

詳細を表示

完全なプロンプト(検証済み英語原文)

Use the first image as the opening frame and the second image as the exact final frame to generate an otome visual-novel interface transition. Overall feel: a premium Chinese otome romance-interaction interface capturing an intimate moment before and after a performance. Transition naturally from "choose to watch his performance" to "Han Xu is drawn in by the heroine's words and reacts with intrigued interest." UI text, choices, and dialogue boxes should appear with refined otome-game presentation. Keep the transition silky smooth and the emotion suggestive yet restrained.

必要な入力

  • 画像1:UI の状態を含む開始フレーム。
  • 画像2:着地させたい正確な最終フレーム。
  • 2つの状態の間で起きる感情変化を一文で。

機能する理由

  • 両端が固定されているため、モデルは構図ではなく補間を解きます。予測可能なショットを得る最も確実な方法です。
  • フレームを列挙するのではなく感情の変化(「彼のパフォーマンスを見ることを選ぶ」→「引き込まれて興味を示す」)を名指ししているため、演技がカットを支えます。
  • インターフェース要素をジャンルの流儀でアニメーションさせるよう指定することで、UI が描き直されるのを防いでいます。

置き換え可能な変数

  • 開始フレームと終了フレーム
  • 2つの間の感情の起伏
  • UI の見せ方
  • トランジションの速度

制約

  • 2枚は画像から動画のルートで image_start と image_end として送ります。参照ルートはこれらの項目を受け付けません。
  • 2枚の構図と照明が近いほど補間は滑らかになります。無関係な構図同士では、トランジションではなくカットになります。

設定

先頭/末尾フレーム · 15s · 16:9 · 参照素材 2件

MiniMax H3 で生成したモーション転写:参照動画から複製したストリートダンスを踊る2人の参照キャラクターマルチモーダル参照
10s16:9参照素材 3件

キャラクター・動作

ストリートダンスのモーション転写

参照動画の振付を、画像で2人のキャラクターとして与える短いプロンプトです。

詳細を表示

完全なプロンプト(検証済み英語原文)

Have the characters perform street dance following the movements in Video 1. Use Figure 1 and Figure 2 as the character references.

必要な入力

  • 画像1と画像2:2人のキャラクター。それぞれ全身が写ったきれいな参照を1枚ずつ。
  • Video 1:複製したい動き。2〜15秒で、演者が全身フレーム内に収まっているもの。

機能する理由

  • 情報は参照素材が担っているため、プロンプトは短くて済みます。動画が動きを、画像が同一性を持っています。
  • 各素材が配列上の位置で指定されているので、どの参照が何を供給するかが曖昧になりません。
  • 他には何も要求していません。照明もカメラもスタイルも指定しないのは、余計な指示が転写したい動きと競合するからです。

置き換え可能な変数

  • キャラクター
  • 元となる振付
  • 環境
  • 演者の人数

制約

  • 参照動画の合計時間は15秒以内、各クリップは2〜15秒、23.976〜60 FPS である必要があります。
  • 参照動画は MP4 または MOV で H.264 または H.265、1本あたり50 MB まで、JSON 全体は 64 MB 未満に収めます。

設定

マルチモーダル参照 · 10s · 16:9 · 参照素材 3件

MiniMax H3 で生成した台詞の置き換え:登場人物の台詞が参照音声の新しい台詞に差し替えられた状態マルチモーダル参照
10s16:9参照素材 2件

ネイティブ音声・台詞

台詞と演技の置き換え

元の台詞と新しい台詞を逐語的に引用し、演技の変化幅を限定します。

詳細を表示

完全なプロンプト(検証済み英語原文)

Replace the girl's line in Video 1, "We can't be together. It's not that we don't love each other; we truly can't make it to the end," with the line from Audio 1: "Don't go, okay? This time, let's not let go of each other." Slightly adjust the corresponding performance.

必要な入力

  • Video 1:置き換える台詞が含まれるクリップ。
  • Audio 1:新しい台詞。WAV または MP3 で、15 MB・15秒まで。
  • 新旧どちらの台詞もプロンプト内に一字一句書き出します。

機能する理由

  • 元の台詞を引用することで、「中盤あたりの台詞」ではなく、クリップのどの区間を処理するかを正確に指定できます。
  • 新しい台詞を引用すると、リップシンクが音声からの推測ではなく明確な目標を持てます。
  • 「対応する演技を少しだけ調整する」という書き方が、演技変更の許可に上限を設け、テイクの残りを保護します。

置き換え可能な変数

  • 元クリップ
  • 置き換える台詞
  • 新しい台詞と声
  • 演技をどこまで変えてよいか

制約

  • 音声だけを参照素材にすることはできません。必ず画像または動画と一緒に渡します。
  • 参照音声と参照動画は、1リクエストあたりそれぞれ合計15秒までです。
  • 固定したい要素を明記してください。台詞のことだけを書くと、構図、衣装、背景が動いてしまいます。

設定

マルチモーダル参照 · 10s · 16:9 · 参照素材 2件

MiniMax H3 で生成したボイス参照クリップ:参照音声の声色で書かれた台詞を話す登場人物マルチモーダル参照
10s16:9参照素材 2件

ネイティブ音声・台詞

「風のままに」ボイス参照

話す台詞と、その声色を定義する1本のクリップだけで構成する最小プロンプトです。

詳細を表示

完全なプロンプト(検証済み英語原文)

Character dialogue: "Follow the wind, live free. Leave worries behind, enjoy the moment." Use Audio 1 as the voice-timbre reference.

必要な入力

  • Video 1:台詞を話すキャラクター。
  • Audio 1:目標とする声のクリーンなサンプル。2〜15秒で、できれば音楽が重なっていないもの。
  • 話させたい台詞を一字一句書き出したもの。

機能する理由

  • 台詞が要約ではなく引用で書かれているため、タイミングとリップシンクに具体的な手がかりがあります。
  • Audio 1 には「声色」という限定的な役割だけが与えられており、一般的な「BGM」として渡されていません。
  • 他に何も指定していないため、構図と演技は参照クリップが完全に制御し続けます。

置き換え可能な変数

  • 台詞
  • ボイス参照
  • キャラクターのクリップ
  • 話す速さ

制約

  • ボイス参照が転写するのは声色であり、アクセント、感情、テンポは自動的には移りません。必要ならプロンプトに書いてください。
  • 参照音声に音楽や複数話者が混ざると品質が落ちます。単独の声だけを抽出して渡してください。

設定

マルチモーダル参照 · 10s · 16:9 · 参照素材 2件

MiniMax H3 で生成したステージ映像:煙の中でスーツの色を交換する2人のマジシャンと、赤から青へ変わる幕先頭/末尾フレーム
7s16:9参照素材 1件

編集・変換

マジシャンの衣装入れ替え

2着の衣装を入れ替え、1つの細部を保持し、背景色も指定タイミングで変える指示追従テストです。

詳細を表示

完全なプロンプト(検証済み英語原文)

Two magicians stand onstage facing the audience and perform a "swap" trick. They wave their wands at the same time, and a cloud of smoke rises. When it clears, their suit colors have switched: the person on the left wears a white suit, and the person on the right now wears a black suit, while both magicians' glove colors remain unchanged. They bow to thank the audience. The red curtain behind them closes, transitioning from deep red to deep blue.

必要な入力

  • 2人の演者、衣装、ステージが写った開始画像。
  • 入れ替わるものについて、変化の前後が明確であること。

機能する理由

  • 入れ替えを煙という出来事で隠しているため、モデルは画面上でモーフィングさせずに変化させる正当なタイミングを得られます。
  • 変えてはいけないもの(手袋の色)が、変えるもののすぐ隣に書かれています。編集範囲の広がりを防ぐのはこの書き方です。
  • ショットは明確な最終状態で終わります:お辞儀、閉じる幕、深い青に着地する色。

置き換え可能な変数

  • 演者と衣装
  • 固定したままにする細部
  • 入れ替えを隠す出来事
  • 最後の色変化

制約

  • 画像から動画のルートは入力画像からアスペクト比を決定し、aspect_ratio 項目を受け付けません。
  • 書かれていない属性はモデルが自由に扱えます。変化の中で残したい細部があるなら、必ず書き出してください。

設定

先頭/末尾フレーム · 7s · 16:9 · 参照素材 1件

MiniMax H3 で生成した製品映像:黒いスタジオの反射する台の上で回転する高級オーバーイヤーヘッドホンテキストから動画
15s16:9参照素材なし

ブランド・商品広告

高級ヘッドホンの製品ショーケース

15秒を4つの時間ブロックに分け、それぞれにカメラ動作と役割を与えた製品動画です。

詳細を表示

完全なプロンプト(検証済み英語原文)

Create a 15-second luxury cinematic product showcase for premium wireless over-ear headphones. 0–4s: Begin with an extreme macro tracking shot moving across the soft memory-foam ear cushion, fine fabric texture, brushed-metal hinge and precision-machined controls. A narrow light band travels across the surface, revealing realistic materials against a deep black studio background. 4–8s: Pull back into a three-quarter hero view. The headphones rotate slowly above a glossy reflective pedestal. The ear cups pivot naturally while the adjustable headband extends slightly, demonstrating flexible construction and comfort. Maintain exact symmetry, stable geometry and consistent proportions. 8–12s: Transition into an elegant exploded-view reveal. The ear cushion, acoustic driver, internal sound chamber, control ring and outer shell separate smoothly in perfect alignment. Subtle luminous sound waves pulse outward from the driver while the camera performs a restrained side orbit. 12–15s: Every component reconnects seamlessly. The headphones settle into a centered front-facing hero composition as soft rim lighting defines the silhouette. Complete a gentle dolly-in toward the ear cups. Premium technology-commercial finish, controlled reflections, realistic shadows, shallow depth of field, crisp surface detail, stable product shape, no hands, no distortion, no onscreen text.

必要な入力

  • アップロードは不要です。テキストから動画はプロンプトのみで動作します。
  • 名前だけでなく、素材と構造で説明できる製品。

機能する理由

  • 時間が 0–4秒、4–8秒、8–12秒、12–15秒 に分割されているため、モデルは願望リストではなくショットリストを受け取ります。
  • 各ブロックでカメラの動きが異なります(マクロ追従、引き、サイドオービット、ドリーイン)。これが「漂う映像」ではなく「編集された映像」に見せます。
  • 最後の一文が禁止リスト(手を写さない、歪ませない、画面文字を出さない)で、製品CGが失敗する典型的な3パターンを潰しています。

置き換え可能な変数

  • 製品
  • 素材と仕上げ
  • 各ブロックの時間配分
  • 背景と照明
  • 分解ビューを入れるかどうか

制約

  • 尺は4〜15秒の整数でリクエストに指定します。プロンプト内の時間ブロックの合計はこれと一致させてください。
  • 時間ブロックは演出指示であり、厳密なタイムラインではありません。15秒なら4つ以下に抑えます。
  • このクリップは作者が720pで公開したものです。EvoLink の H3 ルートは 2K を出力します。

設定

テキストから動画 · 15s · 16:9 · 参照素材なし

MiniMax H3プロンプトのフレームワーク

H3は順序付き参照を理解し、音声も生成します。汎用公式だけでなく、実際のワークフローに合わせて書きます。

H3プロンプトの基本構造

目的 → 順序付き参照 → 主体とアイデンティティ → 時系列の動作 → カメラ経路 → 音声または台詞 → 保持する要素 → 最終状態の順で書きます。音と終わりの指定を忘れにくくなります。

テキストから動画

クリップ内で完了できる時系列を書きます。主体、少数の動作、1本の連続したカメラ経路、台詞・環境音・音楽の層を分けて指定します。

先頭 / 末尾フレーム

外観は画像で決まっています。間の変化、カメラ動作、保持する内容、最後の状態だけを記述します。

マルチモーダル参照

各アセットに1つだけ役割を与え、配列順で呼びます。Image 1はキャラクター、Image 2は場所、Video 1はモーション、Audio 1は声色に使います。1リクエストの合計は12ファイルまでです。

既存クリップの編集

「変更」は対象 → 結果、「保持」は変えない内容として2つのリストに分けます。必要な範囲だけをVideo 1として送ります。

音声と台詞

話してほしい台詞をそのまま引用します。声の参照は声色のみに使い、アクセント、感情、ペースは別に指定します。

失敗パターンの診断

H3プロンプトで起きやすい7つの問題と修正方法です。

プロンプトの半分が無視される
主な原因短い時間に主体、スタイル、イベントを詰め込みすぎています。
修正主体1つ、場所1つ、時間内に収まる動作だけに絞ります。
カメラが流れたり矛盾したりする
主な原因同じショットに相反するカメラ動作が書かれています。
修正1ショット1経路にし、2つ目の動きはカット後の新しいショットとして書きます。
別の参照が間違った要素を制御する
主な原因アセットごとの役割が明記されていません。
修正配列順で各アセットを指定し、1つの役割だけを与えます。
ストーリーが急ぎすぎて伝わらない
主な原因短い動画に完全な物語を押し込んでいます。
修正3〜4秒に1つの動作を目安にします。10秒なら2〜3つが適切です。
ほとんど動かない
主な原因変化ではなく外観だけを説明しています。
修正何が、どの順序で動き、最後にどんな状態になるかを動詞で書きます。
指定外の領域まで変更される
主な原因保持する領域や属性が定義されていません。
修正顔、衣装、背景、構図など、同じに保つものを列挙します。
音声が混ざって不明瞭になる
主な原因台詞、環境音、音楽に優先順位がありません。
修正主役の音を1つ決め、他は小さくし、台詞が入る部分に余白を作ります。

MiniMax H3プロンプト FAQ

MiniMax H3とHailuo 3は同じモデルですか?

はい。MiniMax H3はHailuo 3、Hailuo 3.0、Hailuo 03とも呼ばれます。EvoLinkではMiniMax H3の名称を使い、テキスト動画、画像動画、参照動画の3ルートを提供します。

コードを書かずに使えますか?

はい。「このプロンプトを使う」を押すと、検証済みの英語プロンプトと対応ワークフローがPlaygroundに送られます。参照ファイルはそこで追加します。

MiniMax H3の動画は何秒ですか?

3ルートとも4〜15秒の整数を指定でき、現在の出力は2Kです。カードの時間は公開されたサンプルに対応します。

1つのプロンプトで何個の参照を使えますか?

参照ルートは最大9枚の画像、3本の動画、3本の音声を受け付けますが、合計12ファイルが上限です(9+3+3のフルセットは拒否されます)。画像または動画が少なくとも1つ必要で、音声だけは使えません。動画と音声は2〜15秒です。

なぜプロンプトに「Image 1」や「Video 1」と書くのですか?

APIはimage_urls、video_urls、audio_urls内の位置で参照を識別します。検証済みプロンプト内の英語表記は、特定のアセットに役割を割り当てます。

プロンプトと動画の出典はどこですか?

各カードに出典を表示します。MiniMax公式例は中国語原文の検証済み英語版を使い、コミュニティ例はXの元投稿へリンクします。

これらのプロンプトをAPIで使えますか?

はい。同じ英語プロンプトをPlaygroundとAPIのpromptフィールドで使えます。APIガイドでリクエスト、非同期タスク、コールバック、エラーを解説しています。

プロンプトを選んで生成

すべてのプロンプトがEvoLinkの稼働中MiniMax H3ルートに対応します。Playgroundへ送るか、統合APIで同じリクエストを構築できます。