
图片:Higgsfield(视频截图)
摘要
- Higgsfield于10月5日发布AI动画系列角色一致性指南,建议先确定参考图像,并在每次生成中重复使用。
- Soul ID用20多张照片学习一个角色,Cinema Studio 4.0以每段最长30秒、最多50个参考生成镜头。
- Blendl表示,用这种方法他在大约4小时内完成了一集1分20秒的作品。
Higgsfield于10月5日在博客上发布了一份制作指南,旨在解决用AI制作动画系列时角色和画风在不同场景间漂移的问题。核心建议是在生成视频之前先确定角色、画风、场景和道具的参考图像,并在每次生成中重新调用这些参考。公司表示,如果跳过这一准备,系列越长,出现视觉漂移的可能性就越大。同一天发布的创作者访谈则展示了一位动画师出身的创作者如何用这些原则每一两天推出一集系列作品。
漂移的原因在于每个镜头都是单独生成的。据Higgsfield介绍,如果不把同一身份和参考传递下去,模型每次对角色描述的理解都会略有不同,这些细小差异会在整个系列中累积。指南把问题分为五类:角色的脸或比例在各集之间变化,画风滑向普通的默认风格,服装或道具无故改变,同一地点在不同集中看起来不一致,以及调色和光线在镜头间变化。
解决办法围绕四个工具展开。Higgsfield在一个工作空间中整合了35个以上的模型和工具,其中Soul ID负责固定角色,用20多张参考照片在几分钟内完成训练。公司自研的图像模型Soul 2.0可生成最高2K的图像,提供20多个预设,用Moodboard锁定画风,用Soul HEX锁定配色。Popcorn把剧本或场景列表变成逐镜头分镜,自动模式可把一个提示扩展为最多8帧。实际镜头由Cinema Studio 4.0生成,每段最长30秒,每次生成最多可用50个参考。
Cinema Studio 4.0中的类型、镜头、焦段、节奏、情绪轮、配色和年代都是可直接设置的参数。指南建议明确设定这些参数,而不是交给提示文字,从而在各镜头间重复使用同样的摄影选择,而不是每次重新描述。画风也是如此。公司解释说,每次都重新写一遍画风描述,就等于寄希望于模型两次理解得一模一样。

工作流程分为六步。用Soul ID锁定角色身份,在Soul 2.0中确定画风,并用同一画风生成场景、物件和服装。用Popcorn规划哪些场景和道具出现在哪里,再用Cinema Studio 4.0生成镜头。每一集新内容都要与最初的参考图像对比,而不是只和上一集比较,因为设计在一集之内保持稳定,也可能从第一季到第三季悄悄走样。一旦出现漂移,先用编辑工具修正,再考虑重新生成整个镜头。
修正工具有两个。Genjutsu的Object Swap可在保留镜头运动、动作和构图的同时替换角色、服装或场景,Motion Transfer则保留原有动作和节奏,用不同的角色或场景重建画面。Seedance 2.5 Edit负责现有片段中的局部修改,可以用提示描述,也可以用Draw to Edit直接圈出要改的区域。Seedance 2.5支持最长30秒的片段和最多50个多模态参考。指南强调,重新生成一张静态参考图的成本远低于在成片中发现错位后再修正。
METAL查看的指南附带视频是一段13秒的无声动画。戴红色毛线帽、穿宽大蓝色运动夹克和红白运动鞋的同一角色出现在网球场的多个镜头中,从隔着铁丝网的远景、过肩镜头、脚部特写到正面全身,脸和服装始终一致。橙色球场地面、铁丝网和树木背景在各镜头中也保持同样的画风。
Hugo Blendl的案例展示了这些原则在实际中的运用。这位来自墨西哥城的2D动画师曾担任《瑞克和莫蒂》第5季和第6季的动画监督,如今独自制作喜剧系列《Zero to Hero》。据Higgsfield的访谈,他为每个主要角色用白色背景的设计稿创建一个Element,在每次生成中都加以标注,默认使用四分之三侧视图。由于附上完整的转面图容易让角色在画面中被复制成两个,他只在角色转身、跳跃或打斗的镜头中使用转面图。他不单独生成背景,而是把角色和非常具体的场景描述放在同一个请求中,并把反复出现的场景保存下来重复使用。
Blendl用Seedance 2.5以720p、每段30秒的片段生成剧集。最近一集包括剧本、服装重新设计和一个新反派,用了大约4小时完成1分20秒的成片。在电视行业,一名动画师每天产出的成片为3到5秒。他说:"即使要指挥AI来做动画,你仍然需要懂动画和摄影。如果不能把想法转化为精确的语言,也就是景别、镜头运动、表演和节奏,结果就不会好看。"他还把自己的方式描述为"用工具接手一件我已经做腻了、但我知道怎么做的工作"。由于每次生成都单独处理音频,配音目前还无法延续,他计划逐步引入真人配音演员。
METAL此前曾报道Higgsfield发布的短篇动画制作花絮视频。那次关注的是一部作品的完成过程,而这份指南把焦点转向如何在多集之间延续同样的面孔和同样的世界。这表明AI视频工具的竞争正在从单个镜头的画质转向系列作品的连续性。
结论在于顺序。先做参考图,再锁定参数,并与最初的参考对照,这些习惯把生成模型的即兴性变成了制作流程的纪律。只要工具还不能替创作者记住一切,系列的一致性最终取决于创作者积累的参考库有多厚。





评论