Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 每秒

Wan 3.0 —— 30 秒全模态 AI 视频生成模型

Wan 3.0 是阿里的新一代视频生成模型,现已开启公测。Wan 3.0 单次生成最长 30 秒的片段,文生视频、图生视频之外还能接收音频、视频乃至文档作为输入,并以细粒度参考控制稳住角色、声音与风格。Wan 3.0 即将上线 reAPI。

即将推出——该模型的 API 暂未开放。

你能用这个模型做什么

可以用这个模型构建并上线的真实工作流与生产级用例。

一次生成,讲完一个 30 秒的故事

多数视频生成模型停在 10 秒左右;据公布,Wan 3.0 单次生成最长可达 30 秒,足够容纳一个有起承转合的完整场景。你不必再拼接片段、和连贯性漂移较劲,只需一次性描述完整的叙事弧线,Wan 3.0 就以一镜到底的方式渲染出来。等接口正式开放,同样的单次生成能力会在 reAPI 上线。

预览 API 文档

什么都能喂给 Wan 3.0 —— 连文档也行

Wan 3.0 接收文字、图片、音频、视频四种基础模态,并且在 Wan 家族中首次支持文档:doc、xls、ppt、pdf 和 md 文件都能驱动一次生成。一份幻灯片变成产品讲解视频,一份报告变成带解说的摘要片段。Wan 3.0 把你手头已有的素材直接变成视频,省掉分镜这一步。

锁住角色、声音与风格

Wan 3.0 把参考生成推进到细粒度控制:据公布,角色、道具、声音、空间关系与风格都能跨镜头保持稳定。编辑也不止于重新渲染 —— Wan 3.0 支持修改片段的画面、剧情与对白。反复出现的角色和品牌视觉,能从这一次生成延续到下一次。

为什么选 reAPI

单次生成的代际跃迁

Wan 3.0 把 Wan 家族从短片段推到 30 秒的单次生成场景,并全面公布了音频、角色一致性与真实感渲染上的升级。如果你现在的流水线还在拼接 5 秒片段,Wan 3.0 会把这套流程压缩成一次请求。

全模态输入,视频输出

文字、图片、音频、视频和文档驱动的是同一个模型。Wan 3.0 按你提供的输入自动路由 —— 文生视频、图生视频、参考生视频和视频编辑不再是四个独立产品 —— 等 Wan 3.0 落地 reAPI,一次集成即可覆盖全部模式。

上线即按量付费

Wan 3.0 在这里开放时,计费遵循平台统一标准:按已完成的生成计价,随分辨率和时长缩放,失败任务自动退款。没有订阅制 —— 积分按量付费,且永不过期。

Wan 3.0 对比 Wan 2.7

Wan 3.0 是当前在售的 Wan 2.7 一代的后继者。下表把阿里在 Wan 3.0 公测时公布的内容,与 Wan 2.7 今天在 reAPI 上有文档记载的行为逐项对照 —— 一边是已公布的能力,另一边是已经在跑的能力。

能力
Wan 3.0(已公布)
reAPI 上的 Wan 2.7
状态
自 2026 年 8 月 6 日起公测;官方接口即将全面开放。即将上线 reAPI。
今天已在 reAPI 上线 —— Playground、API 文档与按秒定价齐备。
最长时长
单次生成最长 30 秒。
基础模式 2 到 15 秒;参考和编辑模式上限更短。
分辨率
480P、720P 和 1080P。
720P 和 1080P。
输入模态
文字、图片、音频、视频,外加文档:doc、xls、ppt、pdf、md。
文字、图片、音频和视频。
参考控制
细粒度:据公布,角色、道具、声音、空间关系与风格均可保持稳定。
参考图片、参考视频与各主体声音让主体保持一致。
视频编辑
据公布,可修改画面、剧情与对白。
依据提示词重新渲染源视频;audio_setting 控制配乐。

Wan 3.0 各行反映的是阿里 2026 年 8 月 6 日公测发布的内容,在接口正式可用前均属暂定。Wan 2.7 各行反映撰写时其在 reAPI 上有文档记载的行为。

三步做好接入 Wan 3.0 的准备

  1. step 01

    创建 API 密钥

    现在就注册并在控制台创建一个密钥,无需绑卡。同一个密钥可用于 reAPI 上的每一个模型,Wan 3.0 上线后同样适用。

    打开
  2. step 02

    预览请求形态

    API 文档预览里给出了 Wan 3.0 暂定的请求形态:一句提示词或一份媒体输入、一档分辨率,以及最长 30 秒的时长。各字段会在官方接口正式开放时最终确定。

    打开
  3. step 03

    上线当天即可投产

    Wan 3.0 正式发布时,模型 id、参数与每秒费率会在本页最终确定,Playground 同步开放。按预览形态搭好的集成,最多只需做字段级的微调。

    打开

常见问题

关于此模型的常见疑问。

Wan 3.0 是阿里的新一代视频生成模型(通义万相 3.0)。它于 2026 年 8 月 6 日开启公测,据公布可从文字、图片、音频、视频和文档出发,单次生成最长 30 秒的视频,并对角色、道具、声音、空间关系与风格提供细粒度参考控制。

start building

准备好上线了吗?

在 Playground 中试用,或直接获取 API Key 立即接入。