Skip to main content
POST

授权

Authorization
string
header
必填

##所有接口均需要使用Bearer Token进行认证##

获取 API Key:

访问 API Key 管理页面 获取您的 API Key

使用时在请求头中添加:

请求体

application/json
model
enum<string>
必填

视频生成模型名称。

可用选项:
minimax-h3-text-to-video,
minimax-h3-image-to-video,
minimax-h3-reference-to-video
示例:

"minimax-h3-text-to-video"

prompt
string
必填

描述期望生成的视频内容,必填且不能为空。

提示词要求:

  • 支持中文和英文
  • 最长 7000 字符(中文和英文均按字符计)
  • 提示词过长时,模型可能忽略部分细节

不同模型的用法:

  • Text-to-Video:描述场景、主体、动作、镜头和氛围,不接受任何媒体字段
  • Image-to-Video:描述首帧/尾帧中的主体如何运动以及镜头如何变化;使用 image_start 和/或 image_end
  • Reference-to-Video:描述如何使用参考素材;使用 Image 1Image 2Video 1Audio 1 等名称引用素材,不要使用 Seedance 风格的 @image1@video1。编号从 1 开始,并与各 URL 数组中的顺序一致
Required string length: 1 - 7000
示例:

"电影级画面:一名宇航员站在月球基地的观景窗前,镜头缓慢推进,远处地球从地平线上升起。"

image_start
string<uri>

首帧图片的 HTTP(S) URL。

适用模型:

  • 仅适用于 minimax-h3-image-to-video
  • 文生视频和参考生视频不支持此参数

组合规则:

  • image_startimage_end 至少传入一个
  • 仅传 image_start:首帧图生视频
  • 同时传入两者:首尾帧图生视频
  • 首帧最多 1 张,本字段为单个 URL

图片要求:

  • 支持格式:JPG、JPEG、PNG、WEBP、HEIC、HEIF
  • 单张大小:不超过 30MB
  • 图片宽度和高度:均为 2565760 px
  • 宽高比(宽/高):0.42.5
  • URL 必须使用 HTTP(S),且可由服务端直接访问
  • 整个 JSON 请求体大小不超过 64MB;不接受 Base64 或 mm_file:// 输入
示例:

"https://cdn.hailuoai.com/prod/hailuo_demo/testsets/H3_AA_I2VA/gallery/sr_v17_variants_seed42_43_20260724/inputs/4a3a90bf9100_KDmcbkhzYo5sjjxr9FqcVmWVnzb.png"

image_end
string<uri>

尾帧图片的 HTTP(S) URL。

适用模型:

  • 仅适用于 minimax-h3-image-to-video
  • 文生视频和参考生视频不支持此参数

组合规则:

  • image_endimage_start 至少传入一个
  • 仅传 image_end:尾帧图生视频,模型生成自然运动并在该画面结束
  • 同时传入两者:首尾帧图生视频
  • 尾帧最多 1 张,本字段为单个 URL

图片要求:

  • 支持格式:JPG、JPEG、PNG、WEBP、HEIC、HEIF
  • 单张大小:不超过 30MB
  • 图片宽度和高度:均为 2565760 px
  • 宽高比(宽/高):0.42.5
  • URL 必须使用 HTTP(S),且可由服务端直接访问
  • 整个 JSON 请求体大小不超过 64MB;不接受 Base64 或 mm_file:// 输入
示例:

"https://images.unsplash.com/photo-1515003197210-e0cd71810b5f?auto=format&fit=crop&w=1920&q=85"

image_urls
string<uri>[]

参考图片的 HTTP(S) URL 数组,默认为 [],最多 9 张。

适用模型:

  • 仅适用于 minimax-h3-reference-to-video
  • 图生视频请改用 image_start / image_end
  • 文生视频不支持此参数

角色与编号:

  • 所有图片均作为 reference_image 使用
  • 数组第 1 项对应提示词中的 Image 1,第 2 项对应 Image 2,依此类推

图片要求:

  • 支持格式:JPG、JPEG、PNG、WEBP、HEIC、HEIF
  • 单张大小:不超过 30MB
  • 图片宽度和高度:均为 2565760 px
  • 宽高比(宽/高):0.42.5
  • URL 必须使用 HTTP(S),且可由服务端直接访问
  • 整个 JSON 请求体大小不超过 64MB;不接受 Base64 或 mm_file:// 输入

组合规则:

  • image_urlsvideo_urlsaudio_urls 至少传入其中一项
  • 三类参考素材总数不超过 12 个(参考图片 + 参考视频 + 参考音频)
  • 三者全部为空会返回参数错误;纯文本生成请改用 minimax-h3-text-to-video
Maximum array length: 9
示例:
video_urls
string<uri>[]

参考视频的 HTTP(S) URL 数组,默认为 [],最多 3 个。

适用模型:

  • 仅适用于 minimax-h3-reference-to-video
  • 文生视频和图生视频不支持此参数

角色与编号:

  • 所有视频均作为 reference_video 使用
  • 数组第 1 项对应提示词中的 Video 1,第 2 项对应 Video 2,依此类推

视频要求:

  • 支持容器格式:MP4(.mp4)、MOV(.mov
  • 视频编码:H.264/AVC、H.265/HEVC
  • 视频内音频编码:AAC、MP3
  • 单个大小:不超过 50MB
  • 单个时长:215 秒;所有参考视频总时长不超过 15
  • 视频宽度和高度:均为 2565760 px
  • 宽高比(宽/高):0.42.5
  • 帧率:23.97660 FPS
  • URL 必须使用 HTTP(S),且可由服务端直接访问
  • 整个 JSON 请求体大小不超过 64MB;不接受 Base64 或 mm_file:// 输入

计费说明:

  • 参考视频的输入时长会计入费用

组合规则:

  • image_urlsvideo_urlsaudio_urls 至少传入其中一项
  • 三类参考素材总数不超过 12 个(参考图片 + 参考视频 + 参考音频)
  • 三者全部为空会返回参数错误;纯文本生成请改用 minimax-h3-text-to-video
Maximum array length: 3
示例:
audio_urls
string<uri>[]

参考音频的 HTTP(S) URL 数组,默认为 [],最多 3 段。

适用模型:

  • 仅适用于 minimax-h3-reference-to-video
  • 文生视频和图生视频不支持此参数

角色与编号:

  • 所有音频均作为 reference_audio 使用
  • 数组第 1 项对应提示词中的 Audio 1,第 2 项对应 Audio 2,依此类推

音频要求:

  • 支持格式:WAV、MP3
  • 单段大小:不超过 15MB
  • 单段时长:215 秒;所有参考音频总时长不超过 15
  • URL 必须使用 HTTP(S),且可由服务端直接访问
  • 整个 JSON 请求体大小不超过 64MB;不接受 Base64 或 mm_file:// 输入

计费说明:

  • 参考音频不计入计费时长

组合规则:

  • 支持仅传 audio_urls,无需搭配参考图片或参考视频
  • 三类参考素材总数不超过 12 个(参考图片 + 参考视频 + 参考音频)
  • 三者全部为空会返回参数错误;纯文本生成请改用 minimax-h3-text-to-video
Maximum array length: 3
示例:
duration
integer
默认值:4

输出视频时长(秒),默认为 4 秒。

适用模型:

  • 适用于全部 3 个 Minimax H3 模型

取值限制:

  • 仅支持 415 之间的整数,包括 415
  • 不支持小数、数字字符串、auto-1
  • 输出时长与计费直接相关
必填范围: 4 <= x <= 15
示例:

4

quality
enum<string>
默认值:768p

输出视频分辨率,默认为 768p

适用模型:

  • 适用于全部 3 个 Minimax H3 模型

可选值:

  • 768p:默认值
  • 2k

注意:

  • 不传该参数时按 768p 出片;需要 2K 输出请显式传 quality="2k"
  • 输出码率、帧率、视频编码和音频编码由平台决定,当前不提供对应请求参数
可用选项:
768p,
2k
示例:

"768p"

aspect_ratio
enum<string>

输出视频宽高比。

适用模型及默认值:

  • minimax-h3-text-to-video:仅支持显式宽高比,默认为 16:9
  • minimax-h3-reference-to-video:支持下列全部选项,默认为 adaptive
  • minimax-h3-image-to-video:模型根据输入图像自动适配输出宽高比,请勿传入此参数

可选值:

  • adaptive:仅适用于参考生视频,模型根据参考素材和提示词自动选择合适的宽高比
  • 16:9:横屏
  • 21:9:超宽屏
  • 4:3:横向标准画幅
  • 1:1:方形
  • 3:4:纵向标准画幅
  • 9:16:竖屏
可用选项:
adaptive,
16:9,
21:9,
4:3,
1:1,
3:4,
9:16
示例:

"16:9"

callback_url
string<uri>

任务完成后的 HTTPS 回调地址。

适用模型:

  • 适用于全部 3 个 Minimax H3 模型

回调时机:

  • 任务完成(completed)或失败(failed)时触发
  • 在计费确认完成后发送

安全限制:

  • 仅支持 HTTPS 协议
  • 禁止回调到内网 IP 地址(127.0.0.1、10.x.x.x、172.16-31.x.x、192.168.x.x 等)
  • URL 长度不超过 2048 字符

回调机制:

  • 超时时间:10
  • 失败后最多重试 3 次(分别在失败后 1/2/4 秒重试)
  • 回调响应体格式与任务查询接口返回格式一致
  • 返回 2xx 状态码视为成功,其他状态码触发重试
Pattern: ^https://
示例:

"https://your-domain.com/webhooks/video-task-completed"

响应

视频生成任务创建成功

created
integer

任务创建时间戳

示例:

1761313744

id
string

任务ID

示例:

"task-unified-1774857405-abc123"

model
string

实际使用的模型名称

示例:

"minimax-h3-text-to-video"

object
enum<string>

任务的具体类型

可用选项:
video.generation.task
progress
integer

任务进度百分比 (0-100)

必填范围: 0 <= x <= 100
示例:

0

status
enum<string>

任务状态

可用选项:
pending,
processing,
completed,
failed
示例:

"pending"

task_info
object

视频任务详细信息

type
enum<string>

任务的输出类型

可用选项:
text,
image,
audio,
video
示例:

"video"

usage
object

使用量和计费信息