先别急着操作,关键在于选对克隆模式。
进入营销内容创作平台后,在首页「立即克隆」按钮旁边会并列显示两种模式:【精品克隆】和【极速克隆】。不要凭感觉选择,直接根据使用场景判断:
如果你需要制作总裁出镜讲解产品、知识类IP长期口播的视频,必须选择【精品克隆】——它能精准1:1还原你的真实口型,但要求你张嘴录制至少4分钟的视频;
如果只是用于店铺日常自动直播、带货短视频轮播,选择【极速克隆】更高效——30分钟即可生成模型,但口型由AI自动匹配,不需要强制张嘴,反而要求全程闭口录制。
⚠️注意:如果闭口录制却选择了精品克隆,或者张嘴录制却选了极速克隆,训练必然失败,平台不会给出任何提示,只会卡在“处理中”状态不动。
上传视频前的硬性准备
无论选择哪种模式,都必须提前按照规范拍摄好视频,否则上传后系统会拒绝或导致训练失真:
使用手机或单反相机拍摄,分辨率不低于1080p,帧率固定为30fps;
模特穿着纯色上衣(避免细条纹、亮片、反光材质),背景使用纯绿幕(不是浅绿、不是灰绿,而是RGB值为0,180,0的标准绿色);
【精品克隆】必须张嘴说话,内容不限,但需要持续发音至少4分钟,语速均匀,不要突然停顿;
【极速克隆】必须全程闭嘴,保持自然微笑或中性表情,头部轻微转动并配合抬手示意即可,时长达到2分钟即可;
收音使用领夹麦克风,贴在衣领第二颗纽扣位置,录音电平峰值控制在-6dB以内——底噪过大会导致声音克隆失败,且无法重新尝试。
上传与设置关键三步
第一步:点击「立即克隆」→选择克隆类型→拖入已拍摄好的视频文件;
第二步:为你的数字分身命名(例如“张总知识播报”),勾选相关协议,点击「下一步」;
第三步:抠图方式选择「自动抠图」——【仅当背景是标准绿幕时才可选此项】,实物背景或白墙选择自动抠图会把人像边缘吃掉,后续无法修复;
声音设置选择「使用视频原声」——如果你录制的是干净语音,并且希望克隆自己的声音,就选这个;如果原视频有环境噪音,或者你打算后期更换音色,直接选择「智能匹配音色」,不消耗额外权益。
提交后盯住两个节点
点击「开始克隆」后,页面会跳转至「我的人像」,这里只需关注两项:
状态栏显示「训练中(预计剩余XX分钟)」——精品克隆大约需要4小时,极速克隆大约需要30分钟;
进度条下方出现「素材质检通过」字样才算真正进入训练,如果一直卡在「质检中」,说明视频不符合绿幕、发音、时长等任一硬性指标;
训练完成时,状态变为「就绪」,右侧会出现「预览」按钮,点击后可以看到数字人原地站立、眨眼、轻微点头——这表示基础模型已生效,可以直接用于直播或视频生成。
