METAL LAB

ElevenLabs为ElevenCreative接入Seedance 2.5,支持一镜到底30秒视频

最多参考50张图像保持角色与产品一致,一次生成30秒,配音也能在ElevenCreative内一并完成

이미지: ElevenLabs (YouTube) 영상 갈무리 · METAL LAB 편집

摘要

  • ElevenLabs宣布在自家创作工具ElevenCreative中接入了字节跳动Seed团队的视频生成模型Seedance 2.5
  • ElevenLabs介绍称,用户可以在同一界面内完成配音、对口型、音乐和音效的衔接制作
30 second videos with Seedance 2.5

ElevenLabs宣布,已将字节跳动Seed(ByteDance Seed)团队开发的视频生成模型Seedance 2.5接入自家的视频与图像制作工具ElevenCreative。在发布于YouTube的介绍视频中,ElevenLabs说明称,这款模型最多可一次接收50张参考图像,全程保持角色、产品和光线信息的一致性,无需分镜或拼接,单次生成即可完成30秒的完整视频。

散乱的点群代表50张参考图像,汇聚成一个圆,也就是一段没有剪辑痕迹、一气呵成的30秒视频。视频之上再叠加以同心圆表示的配音、对口型、音乐和音效层。散乱的点群代表50张参考图像,汇聚成一个圆,也就是一段没有剪辑痕迹、一气呵成的30秒视频。视频之上再叠加以同心圆表示的配音、对口型、音乐和音效层。

ElevenLabs 官方网站

这番说明其实是直指现有AI视频生成方式的痛点。以往制作长版AI视频,常见做法是把多段短片拼接在一起,但这个过程中每次切换镜头,人物面部都可能出现细微变化,产品形状也容易悄悄走样。ElevenLabs在视频里也提到,"模型会忘记自己原本在做什么"——这正是把多段短生成拼接在一起时,前后语境断裂的现象。Seedance 2.5的思路是事先把角色、产品、场景、光线作为参考素材提供给模型,再用一段提示词描述整个场景,从而在单次生成过程中保持一致性。

Seedance是TikTok母公司字节跳动旗下AI研究团队ByteDance Seed打造的一系列视频生成模型,ElevenLabs则是将该模型引入自家工具使用的一方。同一时期,HiggsfieldKrea等其他视频制作工具也相继展示了将Seedance 2.5与运镜路径、3D场景控制结合使用的案例。相比之下,ElevenLabs这次的发布把音频后期处理也整合进了同一个界面,思路略有不同。

据介绍,在ElevenCreative中生成视频后,可以立即添加配音、对口型、背景音乐和音效。这意味着用户不必在视频生成和音频后期处理之间来回切换、使用多个不同工具。不过实际画质表现,以及模型对参考素材的还原精度等具体性能细节,仅凭这次介绍视频还无法确认。

评论