通过 EvoLink API 接入
适合:产品后端、批量任务、自动化工作流
在你的服务端直接调用 EvoLink 统一视频 API,自己控制模型 ID、参数、任务队列、callback 和结果存储。
- 1在 Playground 用真实 brief 验证效果和成本
- 2在控制台创建 EvoLink API Key
- 3按输入类型选对模型 ID —— 五条路由接受的素材各不相同
- 4提交任务并通过轮询或 HTTPS callback 获取结果
选一条路由、写好提示词,生成前就能看到预估花费。
生成视频
五条路由走的是同一个异步视频接口。生成结果保留 24 小时,需要的请及时下载。
Gemini Omni 1.1 Flash 按 token 计费,不是按秒。实际扣费一律按上游真实返回的 token 数结算。
首次测试成本
文生视频 · 5 秒 · 360p一条 5 秒 360p 样片
10 美元额度约可测 66 次。
调提示词用 360p,确认质量用 720p,4K 留给成片交付 —— 同样时长下 4K 是 720p 的 3 倍价。
测试预算参考
按你预计要测多少次来选。够做一轮初步验证。
够反复打磨提示词。
够跑完接入前的完整评测。
按文生视频估算,已包含 thinking token 的预留。输入图片与输入视频另按输入单价计费。
每次请求按 token 结算,落在视频输出、输入、思考三个 SKU 上,以上游实际返回的 token 数为准。
| Token 类型 | 覆盖什么 | 单价 | 计费口径 |
|---|---|---|---|
| 视频输出每 1K tokens | 生成的视频及其同步音频。720p 每秒产生 5,792 个 token。 | $0.015 / 1K tokens-15% 1.0115 cr / 1K tokens$0.018 官方价 | 输出 token |
| 输入每 1K tokens | 提示词文本、输入图片与输入视频,合计计算。 | $0.0013 / 1K tokens-15% 0.0867 cr / 1K tokens$0.0015 官方价 | 输入 token |
| Thinking token每 1K tokens | 模型内部推理消耗,一般每次请求几百个 token。 | $0.0077 / 1K tokens-15% 0.5202 cr / 1K tokens$0.0090 官方价 | 输出 token |
扣费按上游真实返回的 token 逐档结算,所以最终金额与估算会有小幅出入。已登录用户看到的是自己所属价格分组的单价。
gemini-omni-1.1-flash-text-to-videoNative audio included. 360p and 1080p and 4K scale the output tokens by 1/3, 1.5 and 3 against 720p; final charges use actual token usage.
Gemini Omni 1.1 Flash 是 Google 已 GA 的多模态视频生成模型,稳定 Gemini API 模型 ID 为 gemini-omni-1.1-flash。EvoLink 在同一个接口上提供五条任务路由:文生视频、图生视频、参考生视频、视频编辑和视频延长。生成与延长每次新增 3–10 秒,原生生成同步人声、音乐和音效;输出档位为 360p、720p,以及升采样 1080p 和 4K。
选对路由比堆参考素材更重要。同一个字段在不同路由下语义不同——image_urls 在图生视频里顺序有语义,在参考生视频里没有。
gemini-omni-1.1-flash-text-to-video只靠提示词生成 3–10 秒视频,自带同步音频,分辨率 360p 到 4K。
gemini-omni-1.1-flash-image-to-video传 1 张图把它当首帧动起来;传 2 张按顺序作为首帧和尾帧,模型在两者之间补全。
gemini-omni-1.1-flash-reference-to-video用最多 10 张参考图外加最多 3 条可选参考视频,约束人物、风格或构图。这里的顺序没有语义。
gemini-omni-1.1-flash-video-edit改写一条输入视频里的物体、风格或光线。时长和画面比例跟随输入;quality: auto 保持原分辨率,也可指定输出档位。
gemini-omni-1.1-flash-video-extend在末尾追加 3–10 秒,延续原有运动与镜头语言。duration 是追加的秒数,不是输出总长。
调稿用 360p、确认用 720p、交付用 4K。输出 token 相对 720p 分别是 1/3、1 倍、1.5 倍、3 倍。
人声、音乐、音效随视频一起生成,不额外收费。没有开关,也不接受音频输入。
两张有序图片定义镜头的起点和终点——已用 PSNR 比对返回帧验证过图序语义。
通过 task ID、轮询和 HTTPS callback 管理长耗时任务。结果链接有效期 24 小时。
需要嵌入产品、跑批量任务时直接用 EvoLink API;需要快速创作或让 Agent 完成接入时,可在 Codex、Claude 或 Gemini 中调用。两种方式共用同一把 API Key、余额、模型路由和任务记录。
适合:产品后端、批量任务、自动化工作流
在你的服务端直接调用 EvoLink 统一视频 API,自己控制模型 ID、参数、任务队列、callback 和结果存储。
适合:Codex、Claude、Gemini 中的创作和开发任务
把生成目标、素材与验收条件交给 Agent,让它选路由、组装请求、跟踪任务并返回结果,不用手写每一步接入代码。
这里只展示最短可运行流程:创建任务、保存返回的 task ID,然后轮询或等待 HTTPS callback。完整参数和响应结构请进入 API 标签查看。
curl -X POST https://api.evolink.ai/v1/videos/generations \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-omni-1.1-flash-text-to-video",
"prompt": "A premium product film with controlled camera motion",
"duration": 8,
"quality": "720p",
"aspect_ratio": "16:9",
"callback_url": "https://your-domain.com/webhooks/video"
}'
# Save the returned task ID, then query:
curl https://api.evolink.ai/v1/tasks/{task_id} \
-H "Authorization: Bearer $EVOLINK_API_KEY"生成和视频延长要求 duration 为 3–10 的整数;视频编辑要求 duration: auto。视频编辑和视频延长的 quality 可用 auto 或 360p/720p/1080p/4k,aspect_ratio 必须为 auto,并可额外带最多 10 张参考图。
seed、fps、负向提示词、生成数量、音频输入、generate_audio、人物生成开关、提示词增强和输出格式会被接收但忽略。负向描述请直接写进 prompt。
检查 Authorization Bearer Token,并在控制台确认当前余额与任务账单。
请保留 task ID,在控制台核对终态和账单记录,先确认是参数、审核还是执行失败,再决定是否重试。不要从提交响应推断最终费用结果。
callback_url 必须是公开 HTTPS URL,不能指向 localhost 或私有网段;同时要保存 task ID 作为轮询回退方案。
用同一份 brief、相同输入素材和统一验收标准,比较可用镜头率、重跑次数和项目总成本。选哪个取决于你要多长的镜头、以及是否真的需要那么高的分辨率。
| 选型维度 | Gemini Omni 1.1 Flash | 老版 Gemini Omni Flash | Seedance 2.5 |
|---|---|---|---|
| 更适合 | 需要 4K 升采样交付、首尾帧控制,或要延长已有片段的短镜头 | 已经在 720p 上调好的老版 Omni 工作流 | 长镜头、多参考素材、音频驱动的节奏控制 |
| 时长 | 3–10 秒;视频延长可再追加 3–10 秒 | 3–10 秒 | 4–30 秒 |
| 分辨率 | 360p / 720p / 1080p 升采样 / 4K 升采样 | 仅 720p | 480p / 720p / 1080p |
| 输入 | 文本、首尾帧、最多 10 张参考图 + 最多 3 条参考视频 | 文本、1 张图、最多 6 张参考图 | 文本、图片、视频与音频参考,最多 50 个素材 |
| 音频 | 原生生成、恒开、不接受音频输入 | 原生生成、恒开 | 原生生成、可开关、接受音频参考 |
| 成本判断 | 360p 是全家族最便宜的档;4K 是 720p 的 3 倍,交付分辨率要先定下来再做预算 | 只有一个 720p 单价,最好预估 | 按秒计费;长镜头下比较每条可用镜头的成本 |
生产环境接视频 API,难的从来不是发出第一个请求,而是上线之后持续管理模型选择、成本、参考素材、异步任务、callback、失败与备用路由。EvoLink 把这些收进一个视频接口和一个控制台,让团队先测后接,按可用镜头率和项目总成本来选路由。
五条路由共用 EvoLink 的认证、余额和任务体系。服务端只存一个 EVOLINK_API_KEY,按输入类型选对应的模型 ID。
之后要加 Seedance、MiniMax H3、Veo 或别的视频模型,不用再维护各家的账号、密钥、余额和认证代码。任务与计费框架不变,按时长、分辨率和用途切路由即可。
上游对超范围的时长是静默截断的——传 11 秒实际给 10 秒,传 2 秒实际给 3 秒,两种情况都不报错。EvoLink 直接拦下报错,不让你为一个没要过的时长付钱。
视频延长更容易踩:它的 duration 是「追加秒数」,不传的话上游默认追加 10 秒,是追加 3 秒的 3.3 倍价格。EvoLink 总是显式下发 duration。
输出 token 随分辨率线性放大:同样 10 秒,720p 约 57,920 个视频 token,4K 约 173,760 个。这是账单上最大一项的 3 倍差距。
定价区同时给出原始 token 单价和每个分辨率换算后的秒价,Playground 的估价也会随分辨率实时变化——决策发生在花钱之前,而不是之后。
请保存 task ID,在控制台核对终态、失败原因和账单记录,不要把「请求已创建」当成「视频已生成」。最终费用结果以账单记录为准。
视频生成是异步的。生产系统应使用轮询或公开 HTTPS callback,处理 callback 丢失、重复与超时,并在确认是参数、审核还是执行失败之后再重试。
在同一个 EvoLink 账号和 API Key 下比较 Google 的视频路由,按镜头时长、分辨率和成本选择。

本页。3–10 秒、360p 到 4K,支持首尾帧控制、视频编辑与延长。


当 Gemini Omni 1.1 Flash 不是默认选择时,用同一份 brief 比较分辨率、镜头时长、音频、动作稳定性和项目总成本。




关于可用性、模型 ID、价格、生成限制、模型选择和排错的高频问题。
可以。EvoLink 已提供文生视频、图生视频、参考生视频、视频编辑和视频延长五条 Gemini Omni 1.1 Flash 路由。你可以先在 Playground 验证效果,再用同一把 EvoLink API Key 接入。
分别是 gemini-omni-1.1-flash-text-to-video、gemini-omni-1.1-flash-image-to-video、gemini-omni-1.1-flash-reference-to-video、gemini-omni-1.1-flash-video-edit、gemini-omni-1.1-flash-video-extend。请按输入类型选路由:文生视频不接受任何媒体 URL,视频编辑和视频延长各需要恰好 1 条输入视频。
按 token 计费,分三档单价:视频输出、输入(提示词文本 + 输入图片 + 输入视频合计)、thinking token。输出 token 随分辨率和时长变化——720p 每秒 5,792 个,4K 每秒 17,376 个。定价区把这三档换算成了各分辨率的秒价。
不能。单次生成输出 3–10 秒,单次延长追加 3–10 秒。Google 的多轮流程每次最多追加 10 秒,累计上限为 40 秒,并读取末尾最多 10 秒作为上下文。EvoLink 已验证单次延长,尚未完整验证连续延长到 40 秒。
单次生成输出 3 到 10 秒,单次延长追加 3 到 10 秒,帧率均为 24fps。360p 和 720p 可直接输出,1080p 与 4K 为升采样;不传分辨率默认 720p。超出 3–10 秒的值上游会静默截断,所以 EvoLink 会直接拒绝。
顺序有语义:第 1 张是首帧,第 2 张是尾帧。只传 1 张就是把它当首帧动起来。不能单独只传尾帧——上游的图片对象没有角色标记,首帧还是尾帧完全由它在请求里的位置决定。
是在输入视频末尾追加的秒数,不是输出总长。3 秒输入配 duration=3,成片约 6 秒,且只对追加部分收输出费。EvoLink 总是显式下发 duration,因为不传的话上游默认追加 10 秒。
人声、音乐和音效会与视频一起生成,使用量按返回的视频 token 结算,没有单独的音频开关。注意它不接受音频文件作为输入。
Select endpoint
All APIs require Bearer Token authentication.
Authorization:
Bearer YOUR_API_KEY/v1/videos/generationsGenerate a 3-10 second video with natively synchronized audio from a text prompt, at 360p, 720p, 1080p, or 4K.
Processing is asynchronous. Use the returned task ID to query pending, processing, completed, or failed status. Result links stay valid for 24 hours.
modelstringRequiredDefault: gemini-omni-1.1-flash-text-to-videoFixed value: gemini-omni-1.1-flash-text-to-video
gemini-omni-1.1-flash-text-to-videopromptstringRequiredNon-empty text prompt. There is no separate negative-prompt parameter — write negative instructions directly into the prompt.
A cinematic product film with slow camera movementdurationintegerOptionalDefault: 5Output duration in seconds.
| Value | Description |
|---|---|
| 3-10 | Any integer from 3 through 10 |
5qualitystringOptionalDefault: 720pOutput resolution.
| Value | Description |
|---|---|
| 360p | 640×360 — 1/3 of the 720p output tokens |
| 720p | 1280×720 |
| 1080p | 1920×1080 — 1.5x the 720p output tokens |
| 4k | 3840×2160 — 3x the 720p output tokens |
720paspect_ratiostringOptionalDefault: autoOutput aspect ratio.
| Value | Description |
|---|---|
| auto | Select automatically |
| 16:9 | 16:9 |
| 9:16 | 9:16 |
16:9callback_urlstringOptionalOptional HTTPS callback URL for terminal task updates.
https://your-domain.com/webhooks/videoParameters that have no effect
n, fps, seed, negative_prompt, generate_audio, person_generation, enhance_prompt, output_format, content_filter, audio_urls and model_params are accepted but ignored, so one request body works across all five routes. Audio is generated natively and always included; the model does not accept audio files as input.
{
"model": "gemini-omni-1.1-flash-text-to-video",
"prompt": "A cinematic product film with slow camera movement",
"duration": 5,
"quality": "720p",
"aspect_ratio": "16:9"
}