每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

Synthesia一次性发布7项7月新功能 强化角色扮演与配音

从带实时指导的角色扮演到支持130种语言的对口型配音,Synthesia整理了7月一整月的更新内容

이미지: METAL LAB 생성

摘要

  • Synthesia通过一段YouTube汇总视频公布了2026年7月推出的7项新功能
  • 新功能包括带实时指导的角色扮演会话、支持130种语言的对口型配音2.0、品牌定制头像等
  • 无需提示词即可生成B-roll素材的AI视频预设及动态图形编辑功能也一并加入
공개 영상
유튜브 "What's New in Synthesia? (July in 60 Seconds)" (2026-08-17 게시)
대상 기간
2026년 7월 신테시아 신기능 7종
롤플레이 세션
실시간 코칭·피드백이 붙은 대화 연습 기능
더빙 2.0
130개 언어 지원, 원어 화자 입 모양에 맞춘 립싱크
커스터마이즈 아바타
유니폼·색상 등 브랜드 아이덴티티 반영 가능
AI 비디오 프리셋
프롬프트 없이 몇 초 안에 B롤 영상 생성

对话练习加入了实时指导

如果即将面对一场棘手的客户会议或面试,现在可以在Synthesia内创建对话对象进行练习了。Synthesia上月推出的"角色扮演会话"功能,让用户设定任意对话场景进行练习,AI会实时给出指导和反馈。根据Synthesia公开的汇总视频,这项功能被排在7月新发布列表的首位。

Synthesia是一家用AI生成"真人对镜头讲话"式视频的公司。公司2017年创立于伦敦,专注于制作企业培训视频、公司内部通知等无需摄像机、麦克风和摄制团队即可完成的"讲话人"视频。虽然常被拿来与Sora、Veo等通用视频生成模型相提并论,但两者制作的内容对象并不相同。其头像也并非凭空想象绘制的面孔,而是实际拍摄演员、征得同意后使用。

7月一整月的7项更新

视频按时间顺序梳理了7月一个月内推出的功能,整理成表格如下:

功能核心内容
角色扮演会话带实时指导与反馈的对话练习
配音2.0支持130种语言,对口型贴合原语言说话人的口型
定制头像反映制服、颜色等品牌形象
语音变体整体音色更加自然
动态图形在项目内直接修改文字、标题、数据,内置翻译功能
自动翻译自动为动态图形元素应用翻译
AI视频预设无需提示词,数秒内生成完整度较高的B-roll素材

据介绍,配音2.0将支持语言数量扩大至130种,并对对口型效果进行了改进,使其更贴合原语言说话人的口型。定制头像功能则让企业可以将自身的制服、颜色、标志等品牌元素原样呈现在头像上。AI视频预设的介绍是:无需苦思该使用怎样的提示词,只需选择预先设置好的风格即可生成B-roll素材。

如何使用

从视频中可以确认的入口是Synthesia平台内的项目页面。具体菜单步骤未公开,但根据各功能的性质,可以按如下流程操作:

  1. 打开Synthesia项目,选择新的视频类型。如果目的是对话练习则选择角色扮演会话,如果需要多语言版本则选择配音2.0。
  2. 在角色扮演会话中设定要练习的对话场景,AI会扮演对方角色进行对话,并实时弹出指导文字。
  3. 将制作完成的视频转入配音2.0,可从130种语言中选择所需语言,生成贴合原语言说话人口型的对口型配音版本。
  4. 如需品牌视频,可在定制头像菜单中调整制服、颜色等,制作出相应头像使用。
  5. 当B-roll素材不足时,可在AI视频预设中选择预先设置好的风格,数秒内生成用于插入的视频。

首要适用对象是制作企业培训视频或公司内部通知视频的团队。例如在制作新员工入职培训视频时,可以用角色扮演会话练习应对棘手客户的情形,同时用配音2.0一并生成供海外分公司使用的多语言版本。如果是营销团队,则可以用定制头像制作身穿公司制服的引导员视频,再用AI视频预设填充背景B-roll,以提升完成度。

编辑观察

此次更新组合中值得注意的一点是,Synthesia正悄然从"制作头像视频的公司"扩展为"训练对话的公司"。角色扮演会话并非单纯播放视频,而是能实时给出指导反馈的双向功能。此前Synthesia的头像一直停留在按固定台词讲话的单向视频层面,而这次的新功能则向头像能对用户反应做出响应的方向迈进了一步。在企业培训市场,角色扮演长期以来一直是真人讲师或演员的工作,如今这一位置可能被AI头像取代,这是一个值得关注的信号。

在实际业务中使用这类头像平台时,结论往往大同小异:虽然不必再单独配备摄像机、配音员和翻译团队,但成果的"自然度"仍然需要人工再次审核。即便配音2.0在130种语言上都实现了对口型匹配,在实际企业培训场景中,往往仍需要人工再检查一遍是否存在文化上的违和表达或语调差异。此次更新在语言数量和对口型精度上的提升是明显的进步,但并不意味着可以直接实现完全自动化。

对国内企业而言,比较合理的做法是先将Synthesia这类头像平台用于内部培训或入职视频。而对于品牌广告、对外宣传这类对细微语感要求较高的视频,仍应以"需要更多人工介入"为前提来接触。像角色扮演会话这类对话型功能,比较适合先在新员工接待培训、销售话术练习等需要反复训练的领域进行试用。

在接下来的几周内,不仅是Synthesia,HeyGen、Hedra等竞争对手的头像平台很可能也会跟进推出类似的实时对话和多语言配音功能。头像视频市场的下一个竞争重点,正在从"多接近真人实拍"转向"对话有多自然"。