Guía completa de parámetros de Minimax H3
API unificada para toda la serie Minimax H3. Selecciona el modo de generación con el parámetro model.
3 modos de generación:
| Modo | ID del modelo | Recursos de entrada |
|---|---|---|
| Text-to-Video | minimax-h3-text-to-video | Solo prompt |
| Image-to-Video | minimax-h3-image-to-video | prompt + image_start y/o image_end |
| Reference-to-Video | minimax-h3-reference-to-video | prompt + image_urls / video_urls / audio_urls |
Capacidades comunes:
- Duración de salida de
4a15segundos; resolución768p(predeterminada) o2k - Procesamiento asíncrono; utiliza el ID de tarea devuelto para consultar la tarea
- Las tareas de Minimax H3 no se pueden cancelar
- Las URL de los vídeos generados son válidas durante 24 horas; guarda el resultado cuanto antes
Autorizaciones
##Todas las interfaces requieren autenticacion mediante Bearer Token##
Obtener API Key:
Visite la Pagina de gestion de API Key para obtener su API Key
Agregue en el encabezado de la solicitud al usar:
Cuerpo
Nombre del modelo de generación de vídeo.
minimax-h3-text-to-video, minimax-h3-image-to-video, minimax-h3-reference-to-video "minimax-h3-text-to-video"
Describe el vídeo que quieres generar. Este campo es obligatorio y no puede estar vacío.
Requisitos del prompt:
- Se admiten chino e inglés
- Longitud máxima:
7000caracteres (tanto el chino como el inglés se cuentan por caracteres) - Un prompt demasiado largo puede hacer que el modelo omita algunos detalles
Uso según el modelo:
- Text-to-Video: Describe la escena, el sujeto, la acción, la cámara y la atmósfera; no envíes campos multimedia
- Image-to-Video: Describe cómo deben moverse los sujetos del primer/último fotograma y cómo debe cambiar la cámara; utiliza
image_starty/oimage_end - Reference-to-Video: Describe cómo usar los recursos de referencia. Haz referencia a ellos como
Image 1,Image 2,Video 1,Audio 1, etc.; no uses nombres de estilo Seedance como@image1o@video1. La numeración empieza en1y sigue el orden de cada matriz de URL
1 - 7000"Escena cinematográfica: un astronauta permanece ante la ventana de observación de una base lunar mientras la cámara avanza lentamente y la Tierra aparece sobre el horizonte lejano."
Modelos aplicables:
- Solo
minimax-h3-image-to-video - Los modelos de texto a vídeo y de referencia a vídeo no admiten este parámetro
URL HTTP(S) de la imagen del primer fotograma.
Reglas de combinación:
- Proporciona al menos uno de
image_starteimage_end - Solo
image_start: generación desde el primer fotograma - Ambos campos: generación entre el primer y el último fotograma
- Máximo
1primer fotograma; este campo acepta una URL
Requisitos de imagen:
- Formatos: JPG, JPEG, PNG, WEBP, HEIC, HEIF
- Tamaño: máximo
30MB - Anchura y altura: de
256a5760px cada una - Relación anchura/altura:
0.4–2.5 - La URL debe usar HTTP(S) y ser accesible directamente por el servicio
- El cuerpo JSON completo no debe superar
64MB; no se aceptan entradas Base64 nimm_file://
"https://cdn.hailuoai.com/prod/hailuo_demo/testsets/H3_AA_I2VA/gallery/sr_v17_variants_seed42_43_20260724/inputs/4a3a90bf9100_KDmcbkhzYo5sjjxr9FqcVmWVnzb.png"
Modelos aplicables:
- Solo
minimax-h3-image-to-video - Los modelos de texto a vídeo y de referencia a vídeo no admiten este parámetro
URL HTTP(S) de la imagen del último fotograma.
Reglas de combinación:
- Proporciona al menos uno de
image_endeimage_start - Solo
image_end: el modelo genera un movimiento natural que termina en este fotograma - Ambos campos: generación entre el primer y el último fotograma
- Máximo
1último fotograma; este campo acepta una URL
Requisitos de imagen:
- Formatos: JPG, JPEG, PNG, WEBP, HEIC, HEIF
- Tamaño: máximo
30MB - Anchura y altura: de
256a5760px cada una - Relación anchura/altura:
0.4–2.5 - La URL debe usar HTTP(S) y ser accesible directamente por el servicio
- El cuerpo JSON completo no debe superar
64MB; no se aceptan entradas Base64 nimm_file://
"https://images.unsplash.com/photo-1515003197210-e0cd71810b5f?auto=format&fit=crop&w=1920&q=85"
Modelos aplicables:
- Solo
minimax-h3-reference-to-video - Los modelos de texto a vídeo y de imagen a vídeo no admiten este parámetro
Matriz de URL HTTP(S) de imágenes de referencia. El valor predeterminado es []; máximo 9 imágenes.
Función y numeración:
- Todas las imágenes se usan como
reference_image - El primer elemento es
Image 1, el segundoImage 2, etc.
Requisitos de imagen:
- Formatos: JPG, JPEG, PNG, WEBP, HEIC, HEIF
- Tamaño: máximo
30MBpor imagen - Anchura y altura: de
256a5760px cada una - Relación anchura/altura:
0.4–2.5 - Las URL deben usar HTTP(S) y ser accesibles directamente por el servicio
- El cuerpo JSON completo no debe superar
64MB; no se aceptan entradas Base64 nimm_file://
Reglas de combinación:
- Proporciona al menos uno de
image_urls,video_urlsoaudio_urls - El total de los tres tipos de referencia no puede superar los
12elementos (imágenes + vídeos + audios de referencia) - Si los tres están vacíos se devuelve un error de parámetro; usa
minimax-h3-text-to-videopara generar solo con texto
9Modelos aplicables:
- Solo
minimax-h3-reference-to-video - Los modelos de texto a vídeo y de imagen a vídeo no admiten este parámetro
Matriz de URL HTTP(S) de vídeos de referencia. El valor predeterminado es []; máximo 3 vídeos.
Función y numeración:
- Todos los vídeos se usan como
reference_video - El primer elemento es
Video 1, el segundoVideo 2, etc.
Requisitos de vídeo:
- Contenedores: MP4 (
.mp4), MOV (.mov) - Códecs de vídeo: H.264/AVC, H.265/HEVC
- Códecs de audio incluidos: AAC, MP3
- Tamaño: máximo
50MBpor vídeo - Duración:
2–15segundos por clip; duración total de los vídeos de referencia de hasta15segundos - Anchura y altura: de
256a5760px cada una - Relación anchura/altura:
0.4–2.5 - Frecuencia de fotogramas:
23.976–60FPS - Las URL deben usar HTTP(S) y ser accesibles directamente por el servicio
- El cuerpo JSON completo no debe superar
64MB; no se aceptan entradas Base64 nimm_file://
Facturación:
- La duración de entrada de los vídeos de referencia es facturable
Reglas de combinación:
- Proporciona al menos uno de
image_urls,video_urlsoaudio_urls - El total de los tres tipos de referencia no puede superar los
12elementos (imágenes + vídeos + audios de referencia) - Si los tres están vacíos se devuelve un error de parámetro; usa
minimax-h3-text-to-videopara generar solo con texto
3Modelos aplicables:
- Solo
minimax-h3-reference-to-video - Los modelos de texto a vídeo y de imagen a vídeo no admiten este parámetro
Matriz de URL HTTP(S) de audios de referencia. El valor predeterminado es []; máximo 3 clips.
Función y numeración:
- Todos los clips se usan como
reference_audio - El primer elemento es
Audio 1, el segundoAudio 2, etc.
Requisitos de audio:
- Formatos: WAV, MP3
- Tamaño: máximo
15MBpor clip - Duración:
2–15segundos por clip; duración total de los audios de referencia de hasta15segundos - Las URL deben usar HTTP(S) y ser accesibles directamente por el servicio
- El cuerpo JSON completo no debe superar
64MB; no se aceptan entradas Base64 nimm_file://
Facturación:
- La duración del audio de referencia no se factura
Reglas de combinación:
audio_urlspuede usarse por sí solo; no se requiere imagen ni vídeo de referencia- El total de los tres tipos de referencia no puede superar los
12elementos (imágenes + vídeos + audios de referencia) - Si los tres están vacíos se devuelve un error de parámetro; usa
minimax-h3-text-to-videopara generar solo con texto
3Duración del vídeo de salida en segundos. El valor predeterminado es 4 segundos.
Restricciones de valor:
- Solo se admiten enteros de
4a15, ambos inclusive - No se admiten decimales, cadenas numéricas,
autoni-1 - La duración de salida afecta directamente a la facturación
Modelos aplicables:
- Los 3 modelos Minimax H3
4 <= x <= 154
Resolución del vídeo de salida. El valor predeterminado es 768p.
Valores disponibles:
768p: valor predeterminado2k
Notas:
- Si se omite el parámetro, la salida es
768p; para 2K hay que enviarquality="2k"de forma explícita - La plataforma determina la tasa de bits, la frecuencia de fotogramas y los códecs de vídeo y audio; no se pueden configurar
Modelos aplicables:
- Los 3 modelos Minimax H3
768p, 2k "768p"
Relación de aspecto del vídeo de salida.
Modelos aplicables y valores predeterminados:
minimax-h3-text-to-video: solo relaciones de aspecto explícitas; valor predeterminado16:9minimax-h3-reference-to-video: admite todas las opciones siguientes; valor predeterminadoadaptiveminimax-h3-image-to-video: el modelo adapta automáticamente la relación de aspecto del vídeo de salida a la imagen de entrada; no envíes este parámetro en solicitudes de imagen a vídeo
Valores disponibles:
adaptive: solo para referencia a vídeo; el modelo selecciona una relación adecuada a partir de los recursos de referencia y el prompt16:9: Horizontal21:9: Ultraancha4:3: Horizontal estándar1:1: Cuadrada3:4: Vertical estándar9:16: Vertical
adaptive, 16:9, 21:9, 4:3, 1:1, 3:4, 9:16 "16:9"
Direccion de callback HTTPS despues de completar la tarea
Momento del callback:
- Se activa cuando la tarea se completa (completed) o falla (failed)
- Se envia despues de confirmar la facturacion
Restricciones de seguridad:
- Solo admite protocolo HTTPS
- Prohibido el callback a direcciones IP de red interna (127.0.0.1, 10.x.x.x, 172.16-31.x.x, 192.168.x.x, etc.)
- La longitud de la URL no debe exceder
2048caracteres
Mecanismo de callback:
- Tiempo de espera:
10segundos - Maximo
3reintentos despues del fallo (reintentos a los1/2/4segundos despues del fallo) - El formato del cuerpo de respuesta del callback es consistente con el formato de retorno de la interfaz de consulta de tareas
- Un codigo de estado 2xx se considera exitoso, otros codigos de estado activan reintentos
Modelos aplicables:
- Los 3 modelos Minimax H3
^https://"https://your-domain.com/webhooks/video-task-completed"
Respuesta
Tarea de generacion de video creada exitosamente
Marca de tiempo de creacion de la tarea
1761313744
ID de la tarea
"task-unified-1774857405-abc123"
Nombre del modelo utilizado
"minimax-h3-text-to-video"
Tipo especifico de la tarea
video.generation.task Porcentaje de progreso de la tarea (0-100)
0 <= x <= 1000
Estado de la tarea
pending, processing, completed, failed "pending"
Informacion detallada de la tarea de video
Tipo de salida de la tarea
text, image, audio, video "video"
Informacion de uso y facturacion