GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

Gemini Omni Flash API

通过 EvoLink 统一视频 API 接入 Gemini Omni Flash(也常被搜作 Gemini Omni、Omni Flash)。集成前可先测试文生视频、图生视频、参考生视频以及对话式视频编辑。

Google视频生成可用
视频输出 token 低至 $0.015 / 1K tokens$0.018 官方价-15%
文生视频图生视频参考生视频对话式视频编辑原生音频
生产路由已上线
模型特点
3-10 秒或 Auto 智能时长 · 720p 直出 · 自带原生音频
适用场景
短视频广告、物体替换、参考图锚定场景、对话式修改
输入
文本、图片,或 1 条输入视频
输出
带原生音频的 720p 视频

在浏览器里直接试 Gemini Omni Flash。

选一种模式、写一段提示词,花钱之前先看预估费用。

创建任务

已锁定 gemini-omni-flash-text-to-video
时长

Auto 由服务方决定时长;上方预估按 10 秒计算。

画面比例
预估:~$0.87059.1102 cr
就绪
就绪
历史记录

结果只保留 24 小时,需要留存的请及时下载。

生成历史会显示在这里

先算清 Gemini Omni Flash 的测试成本,再充值。

Gemini Omni Flash 按 token 计费,不按秒计费。最终扣费一律以模型实际返回的 token 用量为准。

首次测试成本

文生视频 · 3 秒 · 720p
-15%最低消费
积分18.0961

一条 3 秒 720p 样片

约合费用$0.267

10 美元额度约可测 35 次。

在 Playground 里选「文生视频」,把 Duration 设为 3 秒,发一条不带输入素材的短提示词--这是本页最便宜的合法请求。输出恒为 720p,所以成本随时长变化,不随分辨率变化。

测试预算参考

按预计的测试次数选择充值金额。
充值
$10
约 35 条样片

验证一条提示词,确认计费口径

$50
约 187 条样片

在四条路由上完整迭代一个分镜脚本

$100
约 375 条样片

短视频投放的批量生产

常见费用示例

提示词迭代文生视频 · 3 秒
~$0.267-15%
~18.0961 cr·~$0.314 官方价
参考图锚定镜头参考生视频 · 5 秒 · 3 张图
~$0.447-15%
~30.344 cr·~$0.525 官方价
成片交付文生视频 · 10 秒(或 Auto)
~$0.870-15%
~59.1063 cr·~$1.023 官方价

仅为预估。Gemini Omni Flash 按 token 计费,最终扣费一律以模型实际返回的用量为准。Auto 时长按 10 秒预扣,按实际生成秒数结算并退回差额。

模型定价

模型定价Token 计费

Gemini Omni Flash 按三类 token 计费:视频输出、输入(提示词 + 素材)、其他输出(思考 token)。最终扣费一律以模型实际返回的用量为准。

视频输出
生成的视频帧与音频 · 输出
$0.015 / 1K tokens-15%
1.0115 cr / 1K tokens$0.018 官方价
输入
提示词文本、参考图片和输入视频 · 输入
$0.0013 / 1K tokens-15%
0.0867 cr / 1K tokens$0.0015 官方价
其他输出
思考 token 与内部推理 · 输出
$0.0077 / 1K tokens-15%
0.5202 cr / 1K tokens$0.0090 官方价

显示的费率为每 1000 个 token。每个请求的实际扣费根据 API 响应中返回的用量值计算。

估算你自己的 Gemini Omni Flash 请求

EvoLink 上的 Gemini Omni Flash API

通过 EvoLink 的统一视频 API 使用 Gemini Omni Flash,实现文生视频、图生视频、参考图生视频和视频编辑。外部讨论常把 Gemini Omni 理解为“视频版 Nano Banana”,因为它把多模态视频创作和对话式编辑带入短视频工作流。 在 EvoLink 上,这个页面聚焦实际 API 接入:EvoLink model ID、异步任务工作流、callback 支持、token 用量可见性,以及与 Veo、Seedance、Kling 等视频模型共用同一个 API key。

输入
文本、图片,或 1 条输入视频
输出
带原生音频的 720p MP4
时长
3-10 秒,或 Auto
分辨率
720p(固定)
参考素材
最多 6 张参考图

Gemini Omni API 能做什么?

Text to Video

gemini-omni-flash-text-to-video

Generate a 720p video from a prompt with 3-10 second or Auto duration.

Image to Video

gemini-omni-flash-image-to-video

Animate one input image with a prompt and 3-10 second or Auto duration.

Reference to Video

gemini-omni-flash-reference-to-video

Use 1-6 reference images to guide a 3-10 second or Auto-duration video.

Video Edit

gemini-omni-flash-video-edit

Edit one MP4 input video with a natural-language instruction.

对话式视频编辑

用 Gemini Omni 生成一段视频,然后在对话中逐步精修——「让光线更暖一些」「把红色汽车替换掉」。这个工作流面向迭代式编辑,并尽量在所选路由能力范围内保留周围场景、主体身份和运动连贯性。

  • · 在同一对话线程中多轮精修
  • · 编辑时尽量保持场景连续性
  • · 减少从头重新生成的工作

物体替换与场景改写

替换画面中的物体、移除多余元素,或在保留身份和运动的前提下改写场景。适用于广告创意迭代和产品变体渲染,无需外部编辑工具。

  • · 替换或移除画面中的物体
  • · 保留角色身份和运动轨迹
  • · 广告创意和产品变体快速迭代

参考图工作流

传入一张参考图,Gemini Omni 会在生成视频中锚定角色身份、光线和色彩。结合对话式编辑,可在不破坏视觉一致性的前提下精修特定镜头。

  • · 从参考图锚定角色身份
  • · 跨片段保持光线和色彩一致
  • · 结合对话编辑进一步精修

支持音频的视频生成

在所选模式支持的情况下,Gemini Omni Flash 路由可以返回带音频的短视频输出,减少首轮生成中额外拼接 TTS 或音效流程的工作。

  • · 支持时输出带音频的视频
  • · 适合短视频概念首轮生成
  • · 减少独立音频流程工作

两种方式接入 Gemini Omni Flash:EvoLink API 或 Agent

需要嵌入产品、运行批量任务时,直接使用 EvoLink API;需要快速创作、试验或让 Agent 完成接入时,可在 Codex、Claude 或 Gemini 中调用。两种方式共用 EvoLink API Key、余额、模型路由和任务记录。

方式一

通过 EvoLink API 接入

适合:产品后端、批量任务、自动化工作流

在你的服务端直接调用 EvoLink 统一视频 API,自己控制模型 ID、参数、任务队列、callback 和结果存储。

  1. 1在 Playground 用真实 brief 验证效果和成本
  2. 2在控制台创建 EvoLink API Key
  3. 3按上方路由卡选择与任务匹配的模型 ID
  4. 4提交任务,通过轮询或 HTTPS callback 获取结果
方式二

在 Agent 中调用

适合:Codex、Claude、Gemini 中的创作与开发任务

把输出目标、素材和验收标准交给 Agent,它可以选择路由、组装请求、跟踪任务并返回结果,不需要你手写每一步。

  1. 1在本地环境变量中设置 EVOLINK_API_KEY,不要写进代码或 Prompt
  2. 2描述输出目标、参考素材和关键参数
  3. 3让 Agent 调用 Gemini Omni Flash 路由并保存 task ID
  4. 4让 Agent 轮询到最终状态、下载结果并报告失败原因

团队用 Gemini Omni Flash API 做什么

四种工作流对应四条路由。它们的差别是输入形态不同,不是画质档位不同--按手里有什么素材来选。

从一份 brief 产出短视频广告变体

只靠提示词生成 3-10 秒片段,之后改措辞而不是重拍。自带原生音频,首轮产出就能直接过审,不用另接 TTS 或音效流程。

让产品静态图动起来

图生视频接收恰好 1 张输入图,在保持主体的前提下添加受控的运镜与光线。适合已有审过的产品图、但没有视频预算的场景。

用参考图锁定人物一致性

参考生视频接收 1-6 张图,用来在多个生成镜头之间固定人物、配色或风格。这里顺序没有语义,整组图作为一个整体被读取。

对已有片段做对话式修改

视频编辑改写一条 10 秒以内 MP4 里的物体、风格或光线。时长与画面比例跟随输入,所以输出能直接替换回原始剪辑。

Gemini Omni Flash API 代码示例与错误处理

示例展示最短可运行流程:创建任务、保存返回的 task ID,然后轮询或等待 HTTPS callback。完整参数与响应字段见 API 标签页。

查看完整 API 文档
cURL
curl -X POST https://api.evolink.ai/v1/videos/generations \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-omni-flash-text-to-video",
    "prompt": "A cinematic wide shot of a glass greenhouse at sunrise, slow camera push in",
    "duration": 8,
    "aspect_ratio": "16:9",
    "callback_url": "https://your-domain.com/webhooks/video"
  }'

# Save the returned task ID, then query:
curl https://api.evolink.ai/v1/tasks/{task_id} \
  -H "Authorization: Bearer $EVOLINK_API_KEY"

参数校验失败

对照上方参数卡逐项检查:取值范围、可选枚举、素材数量和文件类型必须与所选路由一致。

鉴权或余额问题

检查 Authorization Bearer Token,并在控制台确认可用余额与任务计费。

内容或素材被拒

检查肖像权、品牌素材、可读文字、敏感内容以及输入素材的合规性。

任务失败或超时

Gemini Omni Flash 任务最终状态为失败时不扣费。保留 task ID,查看最终状态,先判断是校验、审核还是执行环节出错,再决定是否重试。

未收到 callback

callback_url 必须是公网 HTTPS 地址,不能是 localhost 或内网地址。始终保留 task ID 作为轮询兜底。

Gemini Omni vs Veo 3.1 vs Seedance 2.0 — 详细对比

2026 年生产级视频工作流中最常被候选的三个模型,均可通过一个 EvoLink API key 访问。

功能Gemini OmniVeo 3.1Seedance 2.0
EvoLink 价格按 token 计费$0.04/秒起$0.045/秒起
画质720p720p / 1080p,部分场景支持 4K upscale480p / 720p / 1080p
原生音频支持支持支持
参考控制文本 + 图片 + 对话编辑文本 + 图片文本 + 图片 + 视频 + 音频
视频时长3-10 秒 / Auto短片段,可在支持时用 Extend 扩展长镜头4–15s
编辑能力对话式编辑工作流以生成为主V2V 模式
最适合短视频编辑和多输入工作流电影级基准多模态参考生产

如何接入 Gemini Omni API

三步完成你的第一个 Gemini Omni 视频任务,接入模式与 Veo 3.1、Seedance 2.0、Kling 3.0 一致。

1

Step 1 — 获取 API Key

在 EvoLink.ai 注册并在控制台生成你的 API key,无需 Google Cloud 项目。

2

Step 2 — 提交生成任务

向 /v1/videos/generations 发送 POST 请求,指定一个 Gemini Omni Flash 模型名并填写 prompt。生成模式可用 duration 设置 3-10 秒或 Auto,图生视频/参考图生视频传 image_urls,视频编辑传 video_urls,可选 callback_url 接收完成通知。API 异步处理并返回 task_id。

3

Step 3 — 获取视频结果

使用 task_id 轮询状态接口,或等待 callback_url webhook 回调。当状态变为 completed 时,你将获得生成的 MP4 下载链接,链接有效期 24 小时。

Gemini Omni API 能力总览

面向生产视频工作流的技术规格。

编辑

对话式视频编辑

在对话式工作流中进行多轮精修,场景连续性取决于所选路由和输入质量。

输出

720p,3-10 秒 / Auto 片段

生成模式支持 720p、3-10 秒或 Auto 片段;Auto 按 10 秒预估。视频编辑模式接收一个最长 10 秒的 MP4 输入。

模式

文生视频与图生视频

支持 T2V 文本提示生成和 I2V 参考图输入。对话编辑适用于两种模式的输出。

音频

支持音频的视频输出

在所选 Gemini Omni Flash 路由支持时,短视频输出可以包含音频。

一致性

长上下文角色一致性

面向多输入和重编辑工作流中的连续性表现设计;用于生产前请用自己的 prompt 验证一致性。

工作流

异步 API — 支持 Task ID 和回调

提交任务后获取 ID,轮询状态或配置 callback_url。与 EvoLink 其他视频模型的生命周期一致。

费用示例 — Gemini Omni 定价预估

100 × 3-10s/Auto 片段(社交媒体批量生成)

按当前 Pricing 标签页费率估算

1,000 × 3-10s/Auto 片段/月(生产规模)

按当前 Pricing 标签页费率估算

1 次生成 + 3 次编辑(多轮工作流)

按当前 Pricing 标签页费率估算

请以上方 Pricing 标签中的当前 token 计费价格为准。通过切换 model 参数选择不同工作流。

为什么开发者选择在 EvoLink 上使用 Gemini Omni

Gemini Omni 的看点不只是原始画质,而是工作流:多模态输入、对话式编辑,以及通过 EvoLink 用同一个 API key 与 Veo、Seedance、Kling 并行评估的接入路径。

对话原生编辑工作流

Gemini Omni 的定位更偏对话式视频编辑,而 Veo 3.1 和 Seedance 2.0 通常首先作为生成路由来评估。对于多轮精修,这是需要重点测试的工作流差异。

长上下文角色一致性

Gemini Omni 被认为受益于 Gemini 的上下文和世界知识,适合评估多输入、重编辑工作流中的连续性表现。建议用自己的分镜或短视频 prompt 做实测。

无需 Google Cloud 项目 — 与 Veo、Seedance 相同的异步模式

无需 GCP 配置、无需 Vertex 计费、无需单独的区域审批。如果你已通过 EvoLink 运行视频生成,接入 Gemini Omni 只需改一个参数 — 请求结构、任务生命周期与 Veo 3.1、Seedance 2.0、Kling 完全一致。

Gemini 视频模型家族

在同一个 EvoLink 账号与 API Key 下横向对比 Google 的视频路由,按镜头时长、分辨率和成本选择。

对比全部 Gemini 模型
Gemini Omni Flash API

Gemini Omni Flash

当前模型

当前页。四条路由,720p 自带原生音频,3-10 秒或 Auto 时长,支持对话式视频编辑。

Gemini Omni 1.1 Flash API

Gemini Omni 1.1 Flash

更新一代 Omni:360p 到升采样 4K,支持首尾帧控制,另有视频编辑与视频延长。

查看 API
Veo 3.1 API

Veo 3.1

Google 的电影级视频模型,自带原生音频,适合更长、更高保真的镜头。

查看 API

Gemini Omni Flash 之外的其他视频模型

当 Gemini Omni Flash 不是默认选择时,用同一份 brief 对比分辨率、镜头时长、音频、运动稳定性和项目总成本。

Seedance 2.5 API

Seedance 2.5

适合 4-30 秒镜头、最多 50 个多模态参考素材;在长片段上对比可用镜头率。

查看 API
MiniMax H3 API

MiniMax H3

适合 4-15 秒的精细 2K 片段;用同一份 brief 对比可用镜头率。

查看 API
Kling 3.0 API

Kling 3.0

适合创意生成、动作和多镜头视频;Gemini 家族之外的生产兜底路由。

查看 API
Topaz Video Upscale API

Topaz Video Upscale

镜头的运动和构图已经可用、只是发虚时,用 Topaz 做细节恢复与 1x / 2x / 4x 升采样。

查看 API

Gemini Omni API 常见问题

Gemini Omni 是什么?和 Veo 3.1 有什么区别?

Gemini Omni 是 Google 在 Google I/O 2026 发布的多模态视频模型家族,Omni Flash 被外部讨论为支持文本、图片、视频和音频输入的短视频路线。相比 Veo 3.1,Gemini Omni 更值得关注的是对话式编辑和多输入工作流;Veo 仍然是强电影级生成基线。

在 EvoLink 上使用 Gemini Omni API 多少钱?

费用按 API 返回的 usage tokens 计费,包含 input、video output 和 other output 三类 token 维度。请查看上方定价表了解当前费率。

通过 EvoLink 使用 Gemini Omni 需要 Google Cloud 项目吗?

不需要。EvoLink 通过一个 API key 提供访问,无需 Google Cloud 项目、无需 Vertex 计费、无需单独的区域审批。认证方式与 EvoLink 上的 Veo 3.1 和 Seedance 2.0 完全一致。

Gemini Omni Flash 支持哪些模式?

当前支持四种模式:gemini-omni-flash-text-to-video、gemini-omni-flash-image-to-video、gemini-omni-flash-reference-to-video 和 gemini-omni-flash-video-edit。它们共享同一个异步视频 API 端点。

Gemini Omni 支持 callback_url 和 webhook 吗?

支持。提交任务时传入 callback_url(HTTPS),任务进入终态时 EvoLink 可以向你的端点发送 POST 请求。如果不提供 callback_url,也可以轮询任务状态接口。

Gemini Omni 任务失败了怎么办?

失败任务会返回 failed 状态并附带错误原因。应用层重试时,建议先检查错误、保留原始参数用于排查,并只在确认是输入问题或临时故障后重新提交。

能对之前生成的视频进行编辑吗?

可以 — 这是 Gemini Omni 的主要工作流差异之一。使用自然语言编辑指令后,需要验证所选路由在多轮迭代中对周围场景、主体身份和运动连贯性的保留效果。

Gemini Omni 的最大视频时长是多少?

生成模式支持 3-10 秒或 Auto 片段;Auto 预留估算按 10 秒计算。视频编辑模式接收一个最长 10 秒的 MP4 输入。对于更长的叙事,可利用长上下文角色一致性将多个片段串联起来。

Gemini Omni 支持图生视频吗?

支持。传入参考图 URL,Gemini Omni 会将其作为生成视频的身份锚点。

Gemini Omni 和 Seedance 2.0、Veo 3.1 相比如何?

Seedance 2.0 有较强的 benchmark 和多模态参考信号,Veo 3.1 仍是强电影级生成基线,并在 Flow 与扩展工作流上有优势。Gemini Omni 的差异化在于开发者正在评估它的对话式编辑、多输入生成和短视频迭代能力。

能用一个 EvoLink API key 访问所有 Google 视频模型吗?

可以。EvoLink 通过单一 API key 提供 Gemini Omni、Veo 3.1、Nano Banana 2 以及 Gemini 全系列模型的统一访问。切换模型只需更改 model 参数。