数字分身是创捷云 AI 创作中心里的视频内容生产功能。它通过真人形象克隆、声音克隆和人像资产管理,把「真人出镜拍摄」这件事转成可批量复制的流程:你录制一次形象与音色素材,之后输入文案,就能持续生成由你的数字形象出镜的口播短视频。也可以不依赖真人素材,直接搭建虚拟 IP 形象用于内容生产。
能解决什么问题
- 不想反复出镜拍摄,但需要稳定更新口播视频。
- 拍摄成本高、周期长,一条视频要占用半天甚至更久。
- 同一个形象要覆盖多个账号、多个平台,真人分身乏术。
- 需要统一、可识别的品牌 IP 形象,但缺乏出镜人选。
- 已有真人素材,希望沉淀为可复用的资产,而不是拍完就闲置。
怎么用
准备素材:按界面提示录制或上传用于克隆的真人视频与音频。形象克隆对光线、姿态、口型清晰度有要求,声音克隆对录音环境安静度有要求,具体标准以页面提示为准。
创建形象:进入数字分身模块,选择真人形象克隆,提交素材后等待系统处理,生成属于你的数字人形象。
创建声音:选择声音克隆,提交音频素材,生成对应音色。若暂不做声音克隆,也可使用系统提供的音色。
管理资产:在「人像资产管理」中查看、命名、归类已生成的形象与音色,便于后续调用和区分。
生成视频:新建口播视频任务,选择形象与音色,输入或粘贴口播文案,按实际界面提示设置画面比例、背景等选项后提交生成。
批量生产:替换文案即可复用同一形象与音色,批量产出多条视频,用于不同选题或不同账号。
虚拟 IP 形象:如不使用真人素材,可在形象创建环节选择虚拟 IP 方向,搭建非真人的品牌形象用于内容生产。
关键参数说明
- 形象来源:真人克隆形象 / 虚拟 IP 形象,决定出镜主体的形态。
- 音色:克隆音色或系统音色,决定视频的配音。
- 口播文案:视频要说的话,是批量生产时主要替换的内容。
- 画面比例:适配不同发布平台的画幅,按实际界面提供的选项选择。
- 背景:视频的画面背景,可按界面提供的选项设置。
- 素材要求:形象与声音克隆对素材的时长、清晰度、环境有对应要求,页面会给出具体提示,按提示准备即可。
注意事项
- 克隆真人形象与声音前,必须获得该自然人本人的明确授权,不得未经许可克隆他人形象或音色。
- 素材质量直接决定克隆效果,录制时保持光线充足、面部清晰、环境安静,避免遮挡与杂音。
- 形象与声音克隆的处理需要一定时间,提交后请等待处理完成再用于生成视频。
- 生成的视频用于商业传播时,需遵守发布平台的 AI 内容标识等相关规定。
- 人像资产建议及时命名归类,避免形象和音色增多后难以区分。
常见问题
问:不做真人克隆,能直接用数字分身吗? 可以。除了真人形象克隆,也能搭建虚拟 IP 形象,配合系统音色完成口播视频生产,适合不想真人出镜的场景。
问:同一套形象和音色能生成多条视频吗? 可以。形象与音色属于可复用资产,批量生产时只需替换口播文案,即可持续产出不同内容的视频。
问:克隆出来的效果不理想怎么办? 多数情况与素材质量有关。可重新录制更清晰、光线更好、环境更安静的素材后再次提交克隆。具体素材标准以页面提示为准。