
요약
- 알리바바의 영상 생성 모델 계열 Wan이 Wan3.0을 퍼블릭 베타로 공개했다고 공식 계정을 통해 밝혔다.
- 30초 길이 영상의 네이티브 생성과 '리얼리티 그레이드' 렌더링을 핵심 특징으로 제시했다.
- 참조 입력을 텍스트·이미지·음성·영상에서 문서, 스프레드시트, 슬라이드, 웹페이지까지 확장한 Omni-Reference를 내세웠다.
- 모델명
- Wan3.0
- 공개 상태
- 퍼블릭 베타(Public Beta)
- 발표 주체
- Wan 공식 계정(@Alibaba_Wan)
- 발표 시점
- 2026년 8월 6일(UTC)
- 영상 길이
- 네이티브 30초 영상 생성
- 렌더링
- Reality-Grade Rendering으로 표기
- 참조 입력
- 텍스트·이미지·음성·영상 + 문서·스프레드시트·슬라이드·웹페이지
- 슬로건
- "Simple Input. Smart Creation." (Wan 공식 계정)
알리바바 Wan, 3.0을 퍼블릭 베타로
알리바바의 영상 생성 모델 계열 Wan이 차기 버전 Wan3.0을 퍼블릭 베타로 공개했다. 공식 계정 게시물에 따르면 이번 버전은 "Simple Input. Smart Creation."이라는 문구와 함께 소개됐고, 곧바로 일반 사용자가 접근할 수 있는 베타 단계로 열렸다. 게시물은 2026년 8월 6일(UTC)에 올라왔다.
30초 네이티브 생성과 렌더링 품질
공개된 특징 목록의 첫 항목은 30초 길이 영상의 네이티브 생성이다. 여러 클립을 이어 붙이는 방식이 아니라 한 번에 30초를 생성한다는 의미로 제시됐으나, 세부 구현 방식이나 해상도·프레임레이트 같은 사양은 이번 발표문에 포함되지 않았다. 두 번째 항목인 'Reality-Grade Rendering'은 실사에 가까운 렌더링 품질을 가리키는 표현으로 쓰였으며, 이를 뒷받침하는 벤치마크 수치나 비교 대상은 공개되지 않았다.
Omni-Reference: 참조 입력의 확장
가장 눈에 띄는 항목은 Omni-Reference다. 기존의 텍스트·이미지·음성·영상 참조를 넘어 문서, 스프레드시트, 슬라이드, 웹페이지까지 참조 입력으로 받아들인다고 설명했다. 표 데이터나 프레젠테이션, 웹 문서를 그대로 영상 제작의 근거 자료로 넣는 방향으로 읽히지만, 원문 게시물이 중간에서 잘려 있어 나열된 입력 유형이 여기서 끝나는지는 확인되지 않았다.
| 항목 | Wan3.0 발표 내용 |
|---|---|
| 공개 형태 | 퍼블릭 베타 |
| 영상 길이 | 네이티브 30초 |
| 렌더링 | Reality-Grade Rendering |
| 참조 입력 | 텍스트, 이미지, 음성, 영상, 문서, 스프레드시트, 슬라이드, 웹페이지 |
| 공개된 수치 지표 | 없음 |
확인되지 않은 부분
이번 발표에는 모델 가중치 공개 여부, 지원 언어, 이용 채널, 상용 이용 조건 등에 대한 언급이 없었다. Wan 계열이 과거 어떤 배포 방식을 택했든, Wan3.0에 그대로 적용된다고 볼 근거는 현재 자료에 담기지 않았다. 단일 게시물 기반 정보인 만큼 기술 리포트나 공식 문서가 나온 뒤 사양이 구체화될 여지가 있다.
영상 생성 모델 경쟁 구도와 최근 공개된 멀티모달 모델들의 흐름은 metallab.ai의 영상 생성 분야 기사에서 이어서 확인할 수 있다.
관전 포인트
영상 생성 경쟁의 축은 길이, 사실성, 그리고 제어 가능성으로 옮겨가고 있다. Wan3.0이 내세운 세 가지 항목은 이 세 축에 각각 대응한다. 특히 문서와 스프레드시트를 참조로 받는 구조는 광고·리포트·교육 콘텐츠처럼 원 자료가 이미 존재하는 제작 워크플로를 겨냥한 설계로 볼 수 있다. 다만 실제 품질과 생성 안정성은 베타 사용자들의 결과물이 쌓인 뒤에야 판단할 수 있다.





댓글