Seedance 2.5 已上线 EvoLink立即体验

Wan 3.0 API

通过三个 EvoLink 模型 ID 调用上游 wan3.0-video,生成最长 30 秒视频。对比 480p–1080p 实时价格,并在浏览器中测试文生、图生或混合参考输入。

阿里巴巴-视频生成可用
480p 每秒低至 ~$0.055
3 个模型 ID480p / 720p / 1080p2-30 秒或自动参考图 / 视频 / 音频文档与网页按秒计费
生产路由暂无健康度数据
最适合
需要混合多种参考素材的视频生成
典型场景
广告片、产品视频、剧情镜头、风格迁移
输入
文本、首尾帧、图片、视频、音频、文档、网页
输出
MP4,最高 1080p,2-30 秒,音轨可选

在浏览器里试用 Wan 3.0

选一条路线,直接对 Wan 3.0 API 发起真实生成,写代码之前就能看到准确的积分花费。这里每一次运行都走生产环境的同一个接口和同一套计费。

创建视频

调用线上 API,从你自己的余额扣费
时长5s
清晰度
画面比例
音轨
预计花费 ~$0.5537.47 cr
就绪
历史记录
生成记录会显示在这里

Wan 3.0 API 价格

实时价格采用阿里云新加坡/国际区口径,按视频秒数计费。480p 是基准价,720p 是 2 倍,1080p 是 4 倍。参考视频秒数会加到输出时长上;参考图、音频、文档和网页不计费。

你的第一次测试

文生视频 480P 2 秒 —— 最便宜的一次请求,不带输入视频
最低收费
积分7.4942

480P 2 秒

约合$0.11

10 美元约能跑 91 次

创建任务时冻结积分,任务完成后按上游回执结算。任务失败全额退款。

充值

按默认参数,一笔预算能跑多少
去充值
$10
约 91 条视频

够把三条路线完整验证一遍

$50
约 454 条视频

够做一轮完整的创意迭代

$100
约 907 条视频

够跑一批小规模生产任务

常见花费示例

短片段文生视频 720P 5 秒
~$0.55
37.471 cr
完整片段文生视频 720P 30 秒
~$3.31
224.826 cr
带参考视频参考生视频 720P,输出 5 秒 + 输入 3 秒
~$0.88
59.9536 cr

与在线试用用的是同一个计算函数,按你所在用户组的实时单价算。参考视频秒数计费;参考图、参考音频、文档、网页不计费。

每秒单价

文生视频
wan3.0-text-to-video · 仅输出秒数
480P $0.055/s · 3.7471 cr/s
720P $0.110/s · 7.4942 cr/s
1080P $0.220/s · 14.9884 cr/s
图生视频
wan3.0-image-to-video · 仅输出秒数
480P $0.055/s · 3.7471 cr/s
720P $0.110/s · 7.4942 cr/s
1080P $0.220/s · 14.9884 cr/s
参考生视频
参考素材为图片、音频、文档或网页 · 仅输出秒数
480P $0.055/s · 3.7471 cr/s
720P $0.110/s · 7.4942 cr/s
1080P $0.220/s · 14.9884 cr/s
参考生视频
参考素材含视频 · 参考视频秒数 + 输出秒数
480P $0.055/s · 3.7471 cr/s
720P $0.110/s · 7.4942 cr/s
1080P $0.220/s · 14.9884 cr/s

首尾帧和参考图一律不计费——Wan 3.0 没有按张收费那一套。音轨开或关,价格完全相同。

单次最低收费按 480p × 2 秒计算,每条路线的当前价格以上方实时价格表为准。

自动时长(duration: -1)由模型决定长度,所以按 30 秒上限冻结积分——720p 下约 112.413 积分(约 $1.65)。实际只按生成出来的秒数收费,任务完成后差额退回。

Wan 3.0 实际怎么用

通义万相 3.0 是阿里的全能视频模型。它最有辨识度的地方是参考路线:一次请求可以同时带图片、视频、音频、一份文档和一个网页,提示词按编号逐个指代它们。

模型 ID
3 条路线,同一个上游模型
清晰度
480p / 720p / 1080p
时长
2-30 秒,或自动
计费
按秒计费,按路线实时定价

模型信息

决定你怎么调用它的那些字段,以及每一项对接入意味着什么。

三个模型 ID,同一个上游模型

wan3.0-text-to-video / wan3.0-image-to-video / wan3.0-reference-video

三个 EvoLink 模型 ID 都映射到阿里上游 wan3.0-video。上游不允许首尾帧和参考素材混用,因此需要按输入类型选择对应 ID。

默认清晰度

720p

上游默认是 1080p,而那一档是基准价的 4 倍。我们默认 720p,这样不传 quality 的请求不会稀里糊涂落到最贵的档位上。

时长

2-30 秒,或 -1 自动

自动时长把长度交给模型决定。因为下单时长度未知,会按 30 秒上限冻结积分,任务完成后把没用掉的退回。

参考素材

最多 10 张图、5 段视频、5 段音频、1 份文档、1 个网页

提示词里用「图1」「视频1」「音频1」指代,三类分别独立编号,顺序就是数组顺序。文档和网页二选一,不能同时给。

音轨

默认开启,可关闭

generate_audio 这个布尔值控制成片有没有声音,开关都是一个价。注意字段名:顶层 audio 不在请求结构里、会被丢弃,必须写 generate_audio。它和提供参考音频的 audio_urls 是两个完全不同的字段。

结果链接

约 24 小时有效

结果 URL 指向上游存储,我们不做转存。需要长期保留的内容请在失效前下载或转存。

Wan 3.0 API 主要参数

以下字段覆盖主要接入决策。各路线的完整请求与响应示例请查看 API Reference。

modelstring

根据输入选择文生、图生或参考生视频的 EvoLink 模型 ID。

默认值: 按路线选择

promptstring

描述场景、运动、镜头、音频,以及编号参考素材的用法。

默认值: 必填

qualityenum

可选 480p、720p 或 1080p,清晰度会改变每秒计费倍率。

默认值: 720p

durationinteger

设置 2–30 秒输出,或传 -1 让模型自动决定时长。

默认值: 5

aspect_ratioenum

输出画幅可选 adaptive、16:9、4:3、1:1、3:4 或 9:16。

默认值: adaptive

generate_audioboolean

开启或关闭生成视频的音轨,不改变视频秒价。

默认值: true

model_paramsobject

传入首尾帧,或编号的图片、视频、音频、文档和网页参考。

默认值: 按路线设置

callback_urlstring

通过 HTTPS 接收任务完成通知,无需只依赖轮询。

默认值: 可选

大家拿它做什么

参考路线是 Wan 3.0 与众不同的地方,下面多数场景都依赖它。

产品广告片

喂一张产品图,再配一段你想要的运镜参考视频,直接出一条产品形象保持一致的成片。

角色一致性

提供同一个角色的多张图片,让模型在整条片子里保持他的外观不跑偏。

风格迁移

用参考视频定运镜、用参考图定质感,再用提示词描述新场景。

从简报到视频

把 PPT 或 PDF 作为参考文档传进去,让模型直接按简报内容来做。

首尾帧补间

在图生视频路线上给出首帧和尾帧,让模型补出中间的运动过程。

长镜头

时长最长 30 秒,足够拍完一个完整场景,而不只是三秒循环。
浏览 AI 视频生成器

Wan 3.0 是不是适合你

实话实说它适合什么、什么情况下换一条路线更好。

适合

  • 需要在一次请求里混合多种参考素材
  • 需要突破常见 5-10 秒上限的更长时长
  • 需要一个明确的 480p 档位来降低迭代成本
  • 需要用文档或网页来驱动内容
  • 需要按秒计费、且没有按张收费的附加项

考虑别的路线

  • 需要中途取消任务——Wan 3.0 的任务不支持取消
  • 需要结果链接活过 24 小时且不想自己转存
  • 需要反向提示词或提示词扩写——Wan 3.0 这两个都砍了
  • 需要对已有视频做编辑或续写
  • 需要秒级出片,而不是分钟级
去在线试用

上生产之前

第一次接入最容易踩的四个坑。

1

24 小时内把结果存下来

结果 URL 是上游存储的带签名链接。把下载或转存写进任务完成的回调里,别等到事后再说。

2

给自动时长留足余额

duration: -1 会按 30 秒上限冻结,是 5 秒请求的 6 倍。差额虽然会退回,但余额校验是在下单时做的。

3

模型 ID 要和输入对上

每条路线只接受一种输入。把参考视频发给图生视频路线会直接 400,而不是静默忽略。

4

用轮询或回调

生成是异步的,可能要几分钟。轮询任务接口或注册 HTTPS 回调;任务一旦创建就无法取消。

值得知道的细节

参考编号看的是位置

图片、视频、音频各自独立编号,顺序就是数组顺序。调换数组顺序,提示词里的「图2」指的就是另一张了。

输入视频要计费

参考视频的秒数会先加到输出时长上,再乘清晰度倍率。输出 5 秒 + 参考视频 3 秒,按 8 秒计费。

两个参数被砍掉了

negative_prompt 和 prompt_extend 在 Wan 2.7 上有,Wan 3.0 没有。传了会 400 并指名是哪个字段。

为什么通过 EvoLink 调用

按秒计费,价格透明

按视频秒数计费,单价随清晰度递增。你的实际每秒单价见定价页。

一把 API Key

和平台上其他模型共用同一把 Key、同一个接口,不用单独开阿里云账号和业务空间。

一个余额

所有模型共用积分余额。任务失败自动全额退款。

内置任务追踪

轮询一个任务接口,或注册回调。冻结金额和实扣金额在日志里都看得到。

换模型不用重写

万相、Seedance、可灵、MiniMax 等共用同一套请求结构,换模型就是换一个字符串。

Wan 3.0

Wan 3.0

当前页面

当前一代。时长最长、三档清晰度、可用的参考素材种类也最多。

Wan 2.7

Wan 2.7

上一代。如果你需要反向提示词、提示词扩写或视频编辑,仍然要走它。

查看
Wan 2.6

Wan 2.6

更早一代,为存量接入和较轻的负载保留。

查看

其他视频模型

Seedance 2.0

Seedance 2.0

字节跳动的视频模型,多镜头叙事和参考能力都很强。

查看
Kling O3

Kling O3

快手的旗舰路线,运动控制和角色一致性表现突出。

查看
MiniMax H3

MiniMax H3

MiniMax 的 2K 路线,支持首尾帧控制和多模态参考。

查看

下一步

确定 Wan 3.0 合适之后,可以从这几个地方继续。

常见问题

Wan 3.0 API 是什么?

Wan 3.0(通义万相 3.0)是阿里的视频生成模型。EvoLink 提供文生、图生和参考生视频三个请求模型 ID,它们均映射到上游 wan3.0-video,并使用标准 /v1/videos/generations 接口。

为什么是三个模型 ID 而不是一个?

上游不允许在同一次请求里混用首尾帧和参考素材。把这条规则拆成三个模型 ID 之后,非法组合在结构上就传不出来,报错也会直接告诉你该换哪一个。

Wan 3.0 怎么收费?

按秒计费,每条路线的价格以上方实时价格表为准。480p 是基准价,720p 是 2 倍,1080p 是 4 倍;参考视频秒数会加到输出时长上。

默认清晰度是多少?

720p。上游默认是 1080p,但那一档是基准价的 4 倍,所以我们默认 720p——不传 quality 的请求不会稀里糊涂落到最贵的档位。

duration: -1 是什么意思?

把长度交给模型决定。因为创建任务时还不知道会出多长,所以按 30 秒上限冻结积分。实际只按生成出来的秒数收费,任务完成后差额退回。

结果链接能存多久?

约 24 小时。结果 URL 直接指向上游存储,我们不做转存,需要保留的内容请在任务完成的回调里就下载或转存。

参考图要收费吗?

不收。只有视频秒数计费——输出时长加上参考视频的秒数。参考图、参考音频、文档、网页全部免费。

generate_audio 和 audio_urls 有什么区别?

generate_audio 是布尔值,控制生成的视频有没有声音,开关同价。audio_urls 是参考生视频路线上的参考音频数组,作为素材供提示词用「音频1」「音频2」指代。注意顶层 audio 不被接受,开关必须写成 generate_audio。

提示词里怎么指代素材?

按编号,分类计数:图1..N、视频1..N、音频1..N,各自跟着自己那个数组的顺序。调换数组顺序,同一个编号指的就是另一个素材了。

可以取消正在跑的任务吗?

不可以。Wan 3.0 的任务一旦创建就无法取消。如果任务失败,冻结的积分会自动全额退回。

Wan 3.0 支持反向提示词吗?

不支持。negative_prompt 和 prompt_extend 在 Wan 2.7 上有,Wan 3.0 砍掉了。传了会返回 400 并指名不支持的字段——依赖这两个参数的话请继续用 Wan 2.7。

生成要多久?

通常是分钟级而不是秒级,取决于时长和清晰度。生成是异步的:轮询任务接口,或注册 HTTPS 回调等完成通知。