推荐Lovart 中文版 - 一站式 AI 设计平台推荐一人企业Vibe Coding社区!热门AI设计工具新品免费AI编程工具 Trae - 智能编码助手Seedance2.5已上线新用户注册即领免费算力
UIED.CN今天偷学哪一招,朋友

阿里把 AI 视频一口气拉到30秒:Wan3.0最多能吃5段视频参考,连网页都能直接喂

AI 视频以前最让人抓狂的问题之一就是:

image.png

太短。

5 秒。

10 秒。

一个复杂镜头刚起势:

没了。

想做一条完整广告或者有叙事的视频,只能:

生成;

剪辑;

续写;

再生成;

最后自己一点点拼起来。

阿里云最新展示的:

Wan3.0

这次直接把单次原生生成时长拉到了:

最长30秒。

而且不只是:

“把10秒硬拉长到30秒”。

它同时把:

参考图;

参考视频;

音频;

文档;

网页;

台词;

BGM;

音效

全部装进了同一套模型里。

AI 视频开始真正往:

生产级创作工具

靠了。




一、单次直接生成最长30秒

Wan3.0 当前支持单次生成:

2~30秒。

输出帧率:

30fps。

分辨率覆盖:

480P

720P

1080P。

还支持:

16:9;

4:3;

1:1;

3:4;

9:16;

以及自适应画幅。

所以一套模型就可以同时覆盖:

横版宣传片;

竖版短视频;

社交媒体内容;

电商广告;

影视分镜。

如果不想自己决定长度,还可以直接开启:

Smart Duration。

让模型根据 Prompt 和输入素材自动判断:

这条视频到底应该生成几秒。




二、30秒最大的意义其实是:故事终于能展开了

以前 5~10 秒视频通常只能完成:

一个动作。

比如:

人物走过来。

产品转一圈。

镜头推近。

但到了30秒,

已经足够形成:

开场;

发展;

高潮;

收尾。

阿里官方展示的案例里,一段 30 秒视频可以连续完成:

云层穿越;

角色登场;

音乐演奏;

舞蹈;

宴会收尾。

也就是说:

一个 Prompt 就能控制完整的30秒叙事节奏。

而且既可以:

多镜头组织,

也可以做:

复杂连续运镜和长镜头。

这对广告、短片和预告片的意义比单纯“多20秒”大得多。




三、最多可以直接丢5段视频给它参考

我觉得 Wan3.0 这一代真正实用的能力其实是:

Omni Reference。

参考模式下最多可以输入:

10张参考图片

5段参考视频

5段参考音频。

其中:

5 段参考视频总时长不超过:

15秒。

以前做参考生视频:

一般就是扔一张角色图。

现在可以直接把:

角色动作;

镜头运动;

人物外观;

场景;

声音;

产品

拆成不同素材交给模型。

例如你可以说:

人物参考图1,服装使用图片2,动作参考视频1,运镜参考视频2,声音参考音频1。

模型再统一理解这些素材:

重新组合成一条新视频。

这个玩法已经越来越接近:

导演给制作团队下指令。




四、参考视频甚至可以一起参考声音

Wan3.0 的参考视频不仅能参考:

动作;

角色;

镜头。

如果输入的视频本身带有声音:

模型还可以继续利用其中的:

Voice。

例如给一段演员参考视频。

再让他出现在完全不同的:

场景;

服装;

镜头

里。

同时尽量保持:

人物身份;

声音;

动作逻辑。

相比过去需要:

视频模型生成画面;

语音模型生成声音;

口型模型重新对齐,

现在越来越多环节开始被:

一个模型直接吃掉。




五、Wan3.0已经是原生“有声视频模型”

这次还有一个特别重要的变化:

默认生成的是:

有声视频。

模型可以原生生成:

人物对白;

环境音;

BGM;

动作音效。

而且这些声音和:

画面;

角色;

动作;

镜头节奏

一起生成。

比如一个人关门。

不是先生成视频,

然后再从素材库里:

贴一个“砰”。

而是模型根据整个场景同步理解:

什么时候出现声音;

声音来自哪里;

大小应该如何变化。

AI 视频继续从:

Video Generation

往:

Audio-Visual Generation

走。




六、连PDF、PPT、Excel和网页都能直接拿来做视频

这块我觉得特别适合企业场景。

Wan3.0 不只支持:

文字;

图片;

视频;

音频。

现在还可以直接输入:

DOC / DOCX

XLS / XLSX

PPT / PPTX

PDF

TXT

Markdown

等文件。

甚至可以直接提供:

公开网页链接。

例如:

把一份产品 PPT 扔进去。

然后说:

根据这份资料制作一条20秒新品发布视频,重点突出三个核心卖点。

模型可以先理解:

文档内容;

产品信息;

视觉素材

再继续生成视频。

这其实把以前:

读资料
↓
整理卖点
↓
写脚本
↓
写视频Prompt
↓
生成视频

开始压成:

一次任务。




七、一套模型把文生、图生、参考生全部合并了

Wan3.0 这次还有一个很明显的产品思路:

All-in-One。

以前生成不同类型视频:

可能要切:

文生视频模型;

图生视频模型;

首尾帧模型;

参考生视频模型;

视频编辑模型。

Wan3.0 现在用:

wan3.0-video

一个模型就统一覆盖:

文生视频;

首帧图生视频;

首尾帧视频;

参考生视频;

视频编辑;

视频延长。

开发者不用根据任务类型:

来回切 Model ID。

这对真正做:

AI视频产品;

自动化内容平台;

企业工作流

会方便很多。




八、首尾帧也保留了,镜头控制更直接

如果需要更加明确地控制:

视频从哪里开始;

最终停在哪里,

仍然可以提供:

First Frame

以及:

Last Frame。

例如:

第一帧:

一辆汽车停在城市街道。

最后一帧:

汽车出现在雪山公路。

再让模型自己补:

中间的运动、场景变化和镜头过渡。

对:

广告;

转场;

剧情;

视觉特效

这种需要精确落点的任务很实用。




九、现在已经正式开放API,不需要再申请

Wan3.0 Video API 已经在:

阿里云百炼

正式开放。

开发者不需要额外申请模型权限。

可以直接调用:

wan3.0-video

如果更加看重速度:

还可以选择:

wan3.0-video-prime

Prime 属于优速推理版本。

能力基本保持一致,

但生成速度更快,

对应调用价格也更高。

API 目前采用:

异步任务模式。

创建视频任务以后:

再轮询获取生成结果。

比较适合:

批量视频;

广告平台;

AI创作工具;

自动化生产流水线。




十、价格目前也是按秒算

Wan3.0 标准版在国内百炼的原价为:

480P:0.3元 / 秒

720P:0.6元 / 秒

1080P:1.2元 / 秒。

目前标准版正在进行:

限时7折。

活动持续到:

2026年9月24日 00:00。

所以对于开发者来说:

生成多长,

基本就直接对应多少成本。

相比以前很多:

积分;

Credits;

固定次数

的计费方式,

这种按秒计费反而比较容易:

提前算账。

最终价格以百炼控制台实时显示为准。




十一、真正适合的已经不只是“玩AI视频”

30秒 + 多视频参考以后,应用场景明显开始变化。

例如广告制作:

产品图
+
品牌视频
+
模特参考
+
配音参考
+
品牌PPT
↓
Wan3.0
↓
30秒完整广告

影视制作可以用:

演员参考;

服装参考;

动作视频;

场景图;

导演 Prompt

直接生成预演镜头。

电商也可以:

一套商品素材,

批量生产不同:

人物;

场景;

语言;

画幅

的营销视频。

对文旅来说:

甚至可以直接把:

景区官网;

介绍资料;

图片素材

作为输入。

然后生成一条完整宣传片。

这里真正变化的是:

视频模型开始能够理解“项目资料”,而不只是Prompt。




十二、AI视频正在从“抽卡”进入“导演模式”

以前生视频有一种很强的:

抽卡感。

一句 Prompt 扔进去。

结果到底长什么样:

模型说了算。

现在参考素材越来越丰富以后,

工作方式逐渐变成:

这个人
+
这个产品
+
这个动作
+
这个声音
+
这个场景
+
这样的镜头
+
这个故事
↓
生成

也就是说:

随机性依然存在。

但创作者可以给的约束越来越多。

这才是:

AI视频真正进入生产流程

需要的东西。




结语

Wan3.0 这次真正值得记住的,不只是:

最长30秒。

而是一整套能力已经开始往生产级视频靠:

单次原生最长30秒。

30fps。

最高1080P。

最多:

10张参考图片。

5段参考视频。

5段参考音频。

还支持:

PDF;

PPT;

Word;

Excel;

Markdown;

公开网页。

并且原生生成:

对白 + BGM + 音效。

现在甚至文生、图生、首尾帧、参考生、编辑和延长:

一个模型全部接住。

以前做 AI 视频:

你需要努力把脑子里的画面:

写成一句 Prompt。

现在开始变成:

把整个创作项目直接交给模型。

人物是谁。

产品长什么样。

动作参考哪个视频。

声音怎么说。

品牌资料在哪里。

模型全部一起理解。

所以 Wan3.0 真正跨过去的可能不只是:

10秒 → 30秒。

而是:

“生成一段视频” → “按导演意图完成一段作品”。

AI 视频这块,越来越像真正的生产工具了。




相关链接

Wan3.0 阿里云体验入口

https://click.alibabacloud.com/m/20000002017/

Qwen Cloud

https://click.qwencloud.com/m/20000002025/

Wan3.0 官方模型发布页

https://bailian.console.aliyun.com/model-releases/wan3.0-video

Wan3.0 使用指南

https://help.aliyun.com/zh/model-studio/wan3-video-generation-guide

Wan3.0 API 文档

https://help.aliyun.com/zh/model-studio/wan3-video-generation-api-reference

Wan3.0 模型信息与价格

https://help.aliyun.com/zh/model-studio/wan3-0-video

阿里云百炼

https://bailian.console.aliyun.com/







标签

评论 0

最新评论

登录后发布评论并参与互动。

暂无评论,欢迎抢沙发。

推荐阅读

查看更多