
摘要
- 阿里巴巴的视频生成模型系列Wan通过官方账号宣布,Wan3.0已开启公开测试版。
- 该版本以原生生成30秒长视频和"真实级"渲染为核心特点。
- 其推出的Omni-Reference功能将参考输入从文本、图像、语音、视频扩展至文档、电子表格、幻灯片和网页。
阿里巴巴Wan推出3.0公开测试版
阿里巴巴的视频生成模型系列Wan公开了下一版本Wan3.0的公开测试版。根据官方账号发布的帖子,该版本以"Simple Input. Smart Creation."的口号推出,并随即开放为普通用户可直接使用的测试阶段。该帖子发布于2026年8月6日(UTC)。
原生30秒生成与渲染质量
在公开的特性列表中,第一项是原生生成30秒长的视频。这被表述为一次性生成30秒内容,而非拼接多个片段,但具体实现方式以及分辨率、帧率等规格并未在此次公告中提及。第二项"Reality-Grade Rendering"被用来指代接近真实实拍的渲染质量,但支持这一说法的基准数据或对比对象并未公开。
Omni-Reference:参考输入的扩展
最引人注目的是Omni-Reference功能。据介绍,该功能在原有的文本、图像、语音、视频参考基础上,还可接受文档、电子表格、幻灯片乃至网页作为参考输入。这似乎意味着可以将表格数据、演示文稿或网页文档直接作为视频制作的依据资料,不过由于原帖内容中途被截断,无法确认所列输入类型是否仅限于此。
| 项目 | Wan3.0发布内容 |
|---|---|
| 发布形式 | 公开测试版 |
| 视频长度 | 原生30秒 |
| 渲染 | Reality-Grade Rendering |
| 参考输入 | 文本、图像、语音、视频、文档、电子表格、幻灯片、网页 |
| 已公开的数值指标 | 无 |
尚未确认的部分
此次发布未提及模型权重是否公开、支持语言、使用渠道、商业使用条件等内容。无论Wan系列过去采用何种部署方式,目前的资料中并无证据表明这些方式会原样适用于Wan3.0。由于信息仅基于单一帖子,待技术报告或官方文档发布后,具体规格仍有进一步明确的空间。
有关视频生成模型的竞争格局及近期发布的多模态模型动态,可在metallab.ai的视频生成领域相关报道中继续了解。
观察要点
视频生成领域的竞争重心正在向长度、真实性和可控性转移。Wan3.0所提出的三项特点分别对应这三个方向。特别是接受文档和电子表格作为参考的结构,可以被视为针对广告、报告、教育内容等原始素材已存在的制作流程所做的设计。不过,实际质量和生成稳定性仍需等待测试版用户的成果积累后才能作出判断。





评论