Gemini Omni 1.1 Flash 全参数总览
- Gemini Omni 1.1 Flash 通过统一的
POST /v1/videos/generations入口提供五种视频任务 - 文生视频:
gemini-omni-1.1-flash-text-to-video,仅需文本提示词 - 图生视频:
gemini-omni-1.1-flash-image-to-video,支持 1 张首帧图或 2 张首尾帧图 - 参考生视频:
gemini-omni-1.1-flash-reference-to-video,支持参考图和最多 3 个参考视频 - 视频编辑:
gemini-omni-1.1-flash-video-edit,需要 1 个输入视频,可额外传入最多 10 张参考图,quality默认auto - 视频扩展:
gemini-omni-1.1-flash-video-extend,需要 1 个最长 30 秒的视频,可额外传入最多 10 张参考图,quality默认auto,duration表示追加秒数 - 画面比例: 默认
auto;视频编辑和视频扩展仅允许auto - 原生音频: 模型自动生成同步音频,无需额外开关
- 异步处理模式,使用返回的任务 ID 进行查询
- 生成的视频链接有效期为 24 小时,请尽快保存
授权
请求体
模型名称。必须根据输入素材和任务类型选择对应的模型 ID:
gemini-omni-1.1-flash-text-to-video:文生视频gemini-omni-1.1-flash-image-to-video:图生视频(首帧或首尾帧)gemini-omni-1.1-flash-reference-to-video:参考生视频gemini-omni-1.1-flash-video-edit:视频编辑gemini-omni-1.1-flash-video-extend:视频扩展
gemini-omni-1.1-flash-text-to-video, gemini-omni-1.1-flash-image-to-video, gemini-omni-1.1-flash-reference-to-video, gemini-omni-1.1-flash-video-edit, gemini-omni-1.1-flash-video-extend "gemini-omni-1.1-flash-text-to-video"
描述生成、编辑或续写目标的文本提示词,支持中英文。
使用建议:
- 清楚描述主体、动作、场景、镜头运动和需要保持不变的内容
- 负面要求直接写入提示词(例如
No dialogue、不要出现文字),本模型不提供独立的负面提示词参数
"一颗玻璃弹珠在木质轨道上快速滚动,最后落入水中溅起水花"
图片输入数组
- 图生视频:必填,支持 1~2 张;1 张为首帧,2 张为首帧和尾帧
- 参考生视频:必填,公开建议最多 10 张参考图
- 视频编辑:可选,最多 10 张参考图
- 视频扩展:可选,最多 10 张参考图
- 文生视频:不支持图片输入
仅支持 HTTP/HTTPS 图片 URL;格式支持 png、jpeg、webp
1 - 10 elements视频输入数组
- 参考生视频:可选,公开建议最多 3 个,每个时长不超过 10 秒
- 视频编辑:必填且仅支持 1 个,时长不超过 10 秒
- 视频扩展:必填且仅支持 1 个,时长不超过 30 秒
- 文生视频和图生视频:不支持视频输入
1 - 3 elements视频分辨率
可选值:
360p:横屏 640×360 / 竖屏 360×640720p:横屏 1280×720 / 竖屏 720×12801080p:横屏 1920×1080 / 竖屏 1080×19204k:横屏 3840×2160 / 竖屏 2160×3840auto:仅视频编辑和视频扩展支持,表示跟随输入视频分辨率
默认值:
- 文生视频、图生视频、参考生视频:
720p - 视频编辑、视频扩展:
auto
计费说明: 视频按输出 token 计费;选择具体分辨率时,输入和输出视频 token 都会按最终输出分辨率折算。
360p, 720p, 1080p, 4k, auto "720p"
视频时长
- 文生视频、图生视频、参考生视频:
3~10秒整数,默认3 - 视频编辑:仅允许
auto,默认auto,输出时长跟随输入视频 - 视频扩展:
3~10秒整数,默认3,表示追加秒数
3 <= x <= 103
视频宽高比,默认为 auto
取值说明:
16:9:横向画面9:16:竖向画面auto:由模型根据提示词和输入素材决定画面比例,此为默认值
视频编辑和视频扩展仅允许 auto,输出比例跟随输入视频。
16:9, 9:16, auto "auto"
任务完成后的HTTPS回调地址
回调时机:
- 任务完成(completed)、失败(failed)或取消(cancelled)时触发
- 在计费确认完成后发送
安全限制:
- 仅支持HTTPS协议
- 禁止回调到内网IP地址(127.0.0.1、10.x.x.x、172.16-31.x.x、192.168.x.x等)
- URL长度不超过
2048字符
回调机制:
- 超时时间:
10秒 - 失败后最多重试
3次(会分别在失败的1秒/2秒/4秒后进行重试) - 回调响应体格式与任务查询接口返回的格式一致
- 回调地址若返回2xx状态码视为成功,其他状态码会触发重试
"https://your-domain.com/webhooks/video-task-completed"
响应
视频任务创建成功
任务创建时间戳
1757169743
任务ID
"task-unified-1757169743-7cvnl5zw"
实际使用的模型名称
"gemini-omni-1.1-flash-text-to-video"
任务的具体类型
video.generation.task 任务进度百分比 (0-100)
0 <= x <= 1000
任务状态。创建接口恒返回 processing(内部 pending 状态对客户端统一投影为 processing)
pending, processing, completed, failed "processing"
视频任务详细信息
任务的输出类型
text, image, audio, video "video"
使用量和计费信息