
이미지: X — 모델·오픈소스
摘要
- 阿里巴巴视频生成模型系列Wan通过官方账号宣布,Wan3.0已开放公开测试版。
- 该版本将30秒长视频的原生生成和"真实级渲染"作为核心特点。
- 主打Omni-Reference功能,将参考输入从文本、图像、语音、视频扩展至文档、表格、幻灯片和网页。
- 모델명
- Wan3.0
- 공개 상태
- 퍼블릭 베타(Public Beta)
- 발표 주체
- Wan 공식 계정(@Alibaba_Wan)
- 발표 시점
- 2026년 8월 6일(UTC)
- 영상 길이
- 네이티브 30초 영상 생성
- 렌더링
- Reality-Grade Rendering으로 표기
- 참조 입력
- 텍스트·이미지·음성·영상 + 문서·스프레드시트·슬라이드·웹페이지
- 슬로건
- "Simple Input. Smart Creation." (Wan 공식 계정)
阿里巴巴Wan,3.0公开测试版发布
阿里巴巴视频生成模型系列Wan公开了其下一代版本Wan3.0的公开测试版。根据官方账号发布的内容,这一版本以"Simple Input. Smart Creation."为口号推出,并立即开放为普通用户可访问的测试阶段。该帖子发布于2026年8月6日(UTC)。

30秒原生生成与渲染质量
发布的特点列表第一项是30秒长视频的原生生成。这被表述为一次性生成30秒内容,而非拼接多个片段,但此次发布内容未包含具体实现方式或分辨率、帧率等规格。第二项"Reality-Grade Rendering"用来指代接近实拍效果的渲染质量,但未公开支撑这一说法的基准测试数据或对比对象。
Omni-Reference:参考输入的扩展
最引人注目的一项是Omni-Reference。据介绍,除了现有的文本、图像、语音、视频参考外,该功能还能接受文档、表格、幻灯片和网页作为参考输入。这似乎意味着可以将表格数据、演示文稿或网页文档直接作为视频制作的参考素材,但由于原帖内容在中途被截断,无法确认所列输入类型是否就此为止。
| 项目 | Wan3.0发布内容 |
|---|---|
| 发布形式 | 公开测试版 |
| 视频长度 | 原生30秒 |
| 渲染 | Reality-Grade Rendering |
| 参考输入 | 文本、图像、语音、视频、文档、表格、幻灯片、网页 |
| 公开的数据指标 | 无 |
尚未确认的部分
此次发布未提及模型权重是否公开、支持语言、使用渠道、商用条件等信息。无论Wan系列过去采取何种发布方式,目前的资料中并没有证据表明这些方式会原样适用于Wan3.0。由于信息来源仅为单条帖子,具体规格可能要等技术报告或官方文档发布后才会明确。
视频生成模型的竞争格局及近期公布的多模态模型动态,可在metallab.ai视频生成领域相关报道中继续了解。
关注要点
视频生成竞争的重心正转向长度、真实性和可控性。Wan3.0提出的三大特点分别对应这三个方向。尤其是接受文档和表格作为参考的结构,可以视为针对广告、报告、教育内容等已有原始素材的制作流程所做的设计。不过,实际质量和生成稳定性仍需等测试用户的成果积累后才能判断。


