Gemini Omni 1.1 Flash 视频编辑
- Gemini Omni 1.1 Flash (gemini-omni-1.1-flash-video-edit) 模型支持视频编辑模式,基于一段输入视频、可选参考图片与文本提示词生成编辑后的视频
- 视频输入: 通过
video_urls传入,必填且仅支持 1 个视频,输入视频时长不超过 10 秒 - 参考图片: 可通过
image_urls额外传入,最多 10 张 - 分辨率:
quality支持360p、720p、1080p、4k、auto,默认auto;auto跟随输入视频,具体分辨率可用于升高或降低输出清晰度 - 时长:
duration支持输入,但仅允许auto,默认值也是auto;输出时长跟随输入视频 - 画面比例:
aspect_ratio支持输入,但仅允许auto,默认值也是auto;输出比例跟随输入视频 - 编辑指令: 通过
prompt描述期望的编辑效果 - 原生音频: 模型自动为画面生成同步音频,无需额外参数
- 负面描述: 直接写入
prompt,本模型不提供独立的负面提示词参数 - 异步处理模式,使用返回的任务 ID 进行查询
- 生成的视频链接有效期为 24 小时,请尽快保存
授权
请求体
模型名称,固定为 gemini-omni-1.1-flash-video-edit
gemini-omni-1.1-flash-video-edit "gemini-omni-1.1-flash-video-edit"
视频编辑的文本提示词,描述期望的编辑效果,支持中英文
使用建议:
- 描述要改变的元素与保持不变的部分(例如「让光线更温暖,其余保持不变」)
- 负面要求直接写入提示词(例如
No dialogue、不要出现文字),本模型不提供独立的负面提示词参数
"让画面光线更温暖,其余保持不变"
待编辑视频数组,仅支持 1 个
输入要求:
- 当前仅支持 HTTP/HTTPS 视频 URL
- 格式:mp4
- 时长:不超过
10秒(无下限,1~2 秒的短视频同样可用)
1 element参考图片数组,可选,最多支持 10 张,可与待编辑视频一同使用,用于约束主体、风格或元素
支持形式:
- HTTP/HTTPS 图片 URL
格式要求: 支持 png、jpeg、webp
计费说明: 每张参考图都会计入输入 token
1 - 10 elements输出视频分辨率,默认为 auto
可选值:
360p:短边 360720p:短边 7201080p:短边 10804k:短边 2160auto:跟随输入视频分辨率,此为默认值
显式选择具体分辨率时,可以升高或降低输出分辨率。
计费说明: 输入与输出视频 token 都会按最终输出分辨率折算,分辨率越高费用越高。
360p, 720p, 1080p, 4k, auto "auto"
支持输入,但仅允许 auto,默认值也是 auto。输出时长跟随输入视频。
auto "auto"
支持输入,但仅允许 auto,默认值也是 auto。输出画面比例跟随输入视频。
auto "auto"
任务完成后的HTTPS回调地址
回调时机:
- 任务完成(completed)、失败(failed)或取消(cancelled)时触发
- 在计费确认完成后发送
安全限制:
- 仅支持HTTPS协议
- 禁止回调到内网IP地址(127.0.0.1、10.x.x.x、172.16-31.x.x、192.168.x.x等)
- URL长度不超过
2048字符
回调机制:
- 超时时间:
10秒 - 失败后最多重试
3次(会分别在失败的1秒/2秒/4秒后进行重试) - 回调响应体格式与任务查询接口返回的格式一致
- 回调地址若返回2xx状态码视为成功,其他状态码会触发重试
"https://your-domain.com/webhooks/video-task-completed"
响应
视频任务创建成功
任务创建时间戳
1757169743
任务ID
"task-unified-1757169743-7cvnl5zw"
实际使用的模型名称
"gemini-omni-1.1-flash-video-edit"
任务的具体类型
video.generation.task 任务进度百分比 (0-100)
0 <= x <= 1000
任务状态。创建接口恒返回 processing(内部 pending 状态对客户端统一投影为 processing)
pending, processing, completed, failed "processing"
视频任务详细信息
任务的输出类型
text, image, audio, video "video"
使用量和计费信息