生成式视频
Generative Video
仅凭文字或照片等输入,让计算机从零生成会动的视频画面的技术。
简单来说
生成式视频是一种让计算机在不用摄像机拍摄的情况下,自行创造出全新动态画面的技术。只要用一句话描述场景,或者给它一张照片,它就能从零开始画出与内容相符的动态画面。
可以比作请画家帮你画一幅画:画家会凭想象画出一幅新画。不同的是,这里生成的不是一张静止的画,而是随时间推移、连成一体的多个画面,组合成一段视频。人物的表情、镜头移动的方向,乃至背景中的光线,都是每一刻重新计算生成的。
早期常常出现尴尬的问题,比如场景一换,人物的脸或穿着就会稍微变样。但最近这种一致性问题已经大大减少,把多个场景拼接成短片的案例也越来越多。
在报道中是这样出现的
文章中会这样使用:「一两年前,生成式视频还常常因为每个镜头里人物的脸、服装、空间都在晃动而让人难以专心欣赏作品」。如今这种一致性问题已经在很大程度上得到解决,关注点也从技术完成度转向了剪辑和叙事构成。
亲手试一试
试着在视频生成工具里输入这样一句话:「夕阳下老人走在海边的背影,镜头缓缓向后拉远」。比较一句话能生成多具体的画面和运动,就能直观理解这个概念。
