通过 EvoLink API 接入
适合:产品后端、批量任务、自动化工作流
在你的服务端直接调用 EvoLink 统一视频 API,自己控制模型 ID、参数、任务队列、callback 和结果存储。
- 1在 Playground 用真实 brief 验证效果和成本
- 2在控制台创建 EvoLink API Key
- 3按上方路由卡选择与任务匹配的模型 ID
- 4提交任务,通过轮询或 HTTPS callback 获取结果
通过 EvoLink 统一视频 API 接入 Gemini Omni Flash(也常被搜作 Gemini Omni、Omni Flash)。集成前可先测试文生视频、图生视频、参考生视频以及对话式视频编辑。
选一种模式、写一段提示词,花钱之前先看预估费用。
创建任务
已锁定 gemini-omni-flash-text-to-videoAuto 由服务方决定时长;上方预估按 10 秒计算。
结果只保留 24 小时,需要留存的请及时下载。
Gemini Omni Flash 按 token 计费,不按秒计费。最终扣费一律以模型实际返回的 token 用量为准。
一条 3 秒 720p 样片
10 美元额度约可测 35 次。
在 Playground 里选「文生视频」,把 Duration 设为 3 秒,发一条不带输入素材的短提示词--这是本页最便宜的合法请求。输出恒为 720p,所以成本随时长变化,不随分辨率变化。
验证一条提示词,确认计费口径
在四条路由上完整迭代一个分镜脚本
短视频投放的批量生产
仅为预估。Gemini Omni Flash 按 token 计费,最终扣费一律以模型实际返回的用量为准。Auto 时长按 10 秒预扣,按实际生成秒数结算并退回差额。
Gemini Omni Flash 按三类 token 计费:视频输出、输入(提示词 + 素材)、其他输出(思考 token)。最终扣费一律以模型实际返回的用量为准。
| 项目 | 规则 | 费率 | 计费方式 |
|---|---|---|---|
| 视频输出每 1K tokens | 生成的视频帧与音频 | $0.015 / 1K tokens-15% 1.0115 cr / 1K tokens$0.018 官方价 | 输出 |
| 输入每 1K tokens | 提示词文本、参考图片和输入视频 | $0.0013 / 1K tokens-15% 0.0867 cr / 1K tokens$0.0015 官方价 | 输入 |
| 其他输出每 1K tokens | 思考 token 与内部推理 | $0.0077 / 1K tokens-15% 0.5202 cr / 1K tokens$0.0090 官方价 | 输出 |
显示的费率为每 1000 个 token。每个请求的实际扣费根据 API 响应中返回的用量值计算。
通过 EvoLink 的统一视频 API 使用 Gemini Omni Flash,实现文生视频、图生视频、参考图生视频和视频编辑。外部讨论常把 Gemini Omni 理解为“视频版 Nano Banana”,因为它把多模态视频创作和对话式编辑带入短视频工作流。 在 EvoLink 上,这个页面聚焦实际 API 接入:EvoLink model ID、异步任务工作流、callback 支持、token 用量可见性,以及与 Veo、Seedance、Kling 等视频模型共用同一个 API key。
gemini-omni-flash-text-to-videoGenerate a 720p video from a prompt with 3-10 second or Auto duration.
gemini-omni-flash-image-to-videoAnimate one input image with a prompt and 3-10 second or Auto duration.
gemini-omni-flash-reference-to-videoUse 1-6 reference images to guide a 3-10 second or Auto-duration video.
gemini-omni-flash-video-editEdit one MP4 input video with a natural-language instruction.
用 Gemini Omni 生成一段视频,然后在对话中逐步精修——「让光线更暖一些」「把红色汽车替换掉」。这个工作流面向迭代式编辑,并尽量在所选路由能力范围内保留周围场景、主体身份和运动连贯性。
替换画面中的物体、移除多余元素,或在保留身份和运动的前提下改写场景。适用于广告创意迭代和产品变体渲染,无需外部编辑工具。
传入一张参考图,Gemini Omni 会在生成视频中锚定角色身份、光线和色彩。结合对话式编辑,可在不破坏视觉一致性的前提下精修特定镜头。
在所选模式支持的情况下,Gemini Omni Flash 路由可以返回带音频的短视频输出,减少首轮生成中额外拼接 TTS 或音效流程的工作。
需要嵌入产品、运行批量任务时,直接使用 EvoLink API;需要快速创作、试验或让 Agent 完成接入时,可在 Codex、Claude 或 Gemini 中调用。两种方式共用 EvoLink API Key、余额、模型路由和任务记录。
适合:产品后端、批量任务、自动化工作流
在你的服务端直接调用 EvoLink 统一视频 API,自己控制模型 ID、参数、任务队列、callback 和结果存储。
适合:Codex、Claude、Gemini 中的创作与开发任务
把输出目标、素材和验收标准交给 Agent,它可以选择路由、组装请求、跟踪任务并返回结果,不需要你手写每一步。
四种工作流对应四条路由。它们的差别是输入形态不同,不是画质档位不同--按手里有什么素材来选。
只靠提示词生成 3-10 秒片段,之后改措辞而不是重拍。自带原生音频,首轮产出就能直接过审,不用另接 TTS 或音效流程。
图生视频接收恰好 1 张输入图,在保持主体的前提下添加受控的运镜与光线。适合已有审过的产品图、但没有视频预算的场景。
参考生视频接收 1-6 张图,用来在多个生成镜头之间固定人物、配色或风格。这里顺序没有语义,整组图作为一个整体被读取。
视频编辑改写一条 10 秒以内 MP4 里的物体、风格或光线。时长与画面比例跟随输入,所以输出能直接替换回原始剪辑。
示例展示最短可运行流程:创建任务、保存返回的 task ID,然后轮询或等待 HTTPS callback。完整参数与响应字段见 API 标签页。
curl -X POST https://api.evolink.ai/v1/videos/generations \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-omni-flash-text-to-video",
"prompt": "A cinematic wide shot of a glass greenhouse at sunrise, slow camera push in",
"duration": 8,
"aspect_ratio": "16:9",
"callback_url": "https://your-domain.com/webhooks/video"
}'
# Save the returned task ID, then query:
curl https://api.evolink.ai/v1/tasks/{task_id} \
-H "Authorization: Bearer $EVOLINK_API_KEY"对照上方参数卡逐项检查:取值范围、可选枚举、素材数量和文件类型必须与所选路由一致。
检查 Authorization Bearer Token,并在控制台确认可用余额与任务计费。
检查肖像权、品牌素材、可读文字、敏感内容以及输入素材的合规性。
Gemini Omni Flash 任务最终状态为失败时不扣费。保留 task ID,查看最终状态,先判断是校验、审核还是执行环节出错,再决定是否重试。
callback_url 必须是公网 HTTPS 地址,不能是 localhost 或内网地址。始终保留 task ID 作为轮询兜底。
2026 年生产级视频工作流中最常被候选的三个模型,均可通过一个 EvoLink API key 访问。
| 功能 | Gemini Omni | Veo 3.1 | Seedance 2.0 |
|---|---|---|---|
| EvoLink 价格 | 按 token 计费 | $0.04/秒起 | $0.045/秒起 |
| 画质 | 720p | 720p / 1080p,部分场景支持 4K upscale | 480p / 720p / 1080p |
| 原生音频 | 支持 | 支持 | 支持 |
| 参考控制 | 文本 + 图片 + 对话编辑 | 文本 + 图片 | 文本 + 图片 + 视频 + 音频 |
| 视频时长 | 3-10 秒 / Auto | 短片段,可在支持时用 Extend 扩展长镜头 | 4–15s |
| 编辑能力 | 对话式编辑工作流 | 以生成为主 | V2V 模式 |
| 最适合 | 短视频编辑和多输入工作流 | 电影级基准 | 多模态参考生产 |
三步完成你的第一个 Gemini Omni 视频任务,接入模式与 Veo 3.1、Seedance 2.0、Kling 3.0 一致。
在 EvoLink.ai 注册并在控制台生成你的 API key,无需 Google Cloud 项目。
向 /v1/videos/generations 发送 POST 请求,指定一个 Gemini Omni Flash 模型名并填写 prompt。生成模式可用 duration 设置 3-10 秒或 Auto,图生视频/参考图生视频传 image_urls,视频编辑传 video_urls,可选 callback_url 接收完成通知。API 异步处理并返回 task_id。
使用 task_id 轮询状态接口,或等待 callback_url webhook 回调。当状态变为 completed 时,你将获得生成的 MP4 下载链接,链接有效期 24 小时。
面向生产视频工作流的技术规格。
编辑
在对话式工作流中进行多轮精修,场景连续性取决于所选路由和输入质量。
输出
生成模式支持 720p、3-10 秒或 Auto 片段;Auto 按 10 秒预估。视频编辑模式接收一个最长 10 秒的 MP4 输入。
模式
支持 T2V 文本提示生成和 I2V 参考图输入。对话编辑适用于两种模式的输出。
音频
在所选 Gemini Omni Flash 路由支持时,短视频输出可以包含音频。
一致性
面向多输入和重编辑工作流中的连续性表现设计;用于生产前请用自己的 prompt 验证一致性。
工作流
提交任务后获取 ID,轮询状态或配置 callback_url。与 EvoLink 其他视频模型的生命周期一致。
100 × 3-10s/Auto 片段(社交媒体批量生成)
按当前 Pricing 标签页费率估算
1,000 × 3-10s/Auto 片段/月(生产规模)
按当前 Pricing 标签页费率估算
1 次生成 + 3 次编辑(多轮工作流)
按当前 Pricing 标签页费率估算
请以上方 Pricing 标签中的当前 token 计费价格为准。通过切换 model 参数选择不同工作流。
Gemini Omni 的看点不只是原始画质,而是工作流:多模态输入、对话式编辑,以及通过 EvoLink 用同一个 API key 与 Veo、Seedance、Kling 并行评估的接入路径。
Gemini Omni 的定位更偏对话式视频编辑,而 Veo 3.1 和 Seedance 2.0 通常首先作为生成路由来评估。对于多轮精修,这是需要重点测试的工作流差异。
Gemini Omni 被认为受益于 Gemini 的上下文和世界知识,适合评估多输入、重编辑工作流中的连续性表现。建议用自己的分镜或短视频 prompt 做实测。
无需 GCP 配置、无需 Vertex 计费、无需单独的区域审批。如果你已通过 EvoLink 运行视频生成,接入 Gemini Omni 只需改一个参数 — 请求结构、任务生命周期与 Veo 3.1、Seedance 2.0、Kling 完全一致。
在同一个 EvoLink 账号与 API Key 下横向对比 Google 的视频路由,按镜头时长、分辨率和成本选择。

Gemini Omni Flash
当前模型当前页。四条路由,720p 自带原生音频,3-10 秒或 Auto 时长,支持对话式视频编辑。


当 Gemini Omni Flash 不是默认选择时,用同一份 brief 对比分辨率、镜头时长、音频、运动稳定性和项目总成本。




Gemini Omni 是 Google 在 Google I/O 2026 发布的多模态视频模型家族,Omni Flash 被外部讨论为支持文本、图片、视频和音频输入的短视频路线。相比 Veo 3.1,Gemini Omni 更值得关注的是对话式编辑和多输入工作流;Veo 仍然是强电影级生成基线。
费用按 API 返回的 usage tokens 计费,包含 input、video output 和 other output 三类 token 维度。请查看上方定价表了解当前费率。
不需要。EvoLink 通过一个 API key 提供访问,无需 Google Cloud 项目、无需 Vertex 计费、无需单独的区域审批。认证方式与 EvoLink 上的 Veo 3.1 和 Seedance 2.0 完全一致。
当前支持四种模式:gemini-omni-flash-text-to-video、gemini-omni-flash-image-to-video、gemini-omni-flash-reference-to-video 和 gemini-omni-flash-video-edit。它们共享同一个异步视频 API 端点。
支持。提交任务时传入 callback_url(HTTPS),任务进入终态时 EvoLink 可以向你的端点发送 POST 请求。如果不提供 callback_url,也可以轮询任务状态接口。
失败任务会返回 failed 状态并附带错误原因。应用层重试时,建议先检查错误、保留原始参数用于排查,并只在确认是输入问题或临时故障后重新提交。
可以 — 这是 Gemini Omni 的主要工作流差异之一。使用自然语言编辑指令后,需要验证所选路由在多轮迭代中对周围场景、主体身份和运动连贯性的保留效果。
生成模式支持 3-10 秒或 Auto 片段;Auto 预留估算按 10 秒计算。视频编辑模式接收一个最长 10 秒的 MP4 输入。对于更长的叙事,可利用长上下文角色一致性将多个片段串联起来。
支持。传入参考图 URL,Gemini Omni 会将其作为生成视频的身份锚点。
Seedance 2.0 有较强的 benchmark 和多模态参考信号,Veo 3.1 仍是强电影级生成基线,并在 Flow 与扩展工作流上有优势。Gemini Omni 的差异化在于开发者正在评估它的对话式编辑、多输入生成和短视频迭代能力。
可以。EvoLink 通过单一 API key 提供 Gemini Omni、Veo 3.1、Nano Banana 2 以及 Gemini 全系列模型的统一访问。切换模型只需更改 model 参数。
Figures are pre-bill estimates. Actual charges follow the upstream usage tokens returned by the model.