先说一个核心判断:使用百度一镜数字人实现从半身像到全身像的构图转换,这件事并非靠后期裁剪或简单缩放就能完成。数字分身的训练高度依赖原始视频素材,训练结果几乎等于1:1复刻——拍摄时是什么构图,最终生成的数字人就固定成什么样子。因此,在拍摄阶段就必须按照目标构图来执行,这一环节没有回旋余地。

具体来说,如果希望通过后期调整或AI自动拉远镜头来切换半身与全身画面,基本行不通。必须采用绿幕双轨拍摄,或单次多构图拍摄,并确保光源、背景、服装完全一致。上传时还需关闭自动裁剪功能,手动勾选“保留完整肢体结构识别”,同时设置好9:16或16:9的画面比例。
拍摄前明确构图需求
动手之前,打开「人像拍摄指导」文档,重点阅读“数字分身拍摄须知”部分。这一步的关键在于明确拍摄目标——是用于短视频口播,还是直播场景。如果后续需要频繁切换半身和全身镜头,最好提前规划好几套拍摄方案,不要指望AI能自动帮你拉远镜头。
一个简单的判断方法:对照使用场景反推拍摄方式。知识类口播通常采用半身构图,突出面部表情和手势动作;电商带货直播则常需要全身展示服装或肢体动作。如果是后者,直接按全身像标准来拍摄,不要想着先拍半身再“转”全身,那基本是白费力气。
实拍阶段执行全身像构图
方法一:绿幕实景双轨拍摄
① 搭建绿幕环境时,注意人物头顶距离顶部留白至少30厘米,脚底距离底部留白不少于40厘米,确保全身轮廓完整,不出现切脚情况。
② 摄像机位置必须固定,最好使用三脚架加水平仪校准,避免俯仰角度导致腿部变形——这一点很容易被忽略,但直接影响最终效果。
③ 拍摄时,模特双脚自然分开与肩同宽,双手放松垂落或做基础手势。先保持3秒静止,然后开始说话,全程避免剧烈位移。这一步直接影响后续数字人的站立稳定性,如果画面抖动或频繁走动,全身姿态合成很容易失真。
方法二:单次拍摄多构图版本
在同一场拍摄中,分别录制三段独立视频:半身(腰部以上)、三分身(大腿中部以上)、全身(含脚)。每段视频开头统一做3秒闭嘴静止,结尾也保持3秒自然闭嘴。注意,三段视频必须使用同一光源、同一背景、同一服装,否则训练时会出现光影断裂或衣着错位,导致画面效果大打折扣。
上传与训练环节关键操作
进入百度一镜控制台,找到「应用管理」,选择对应的数字人项目,点击「形象克隆」。上传已经拍摄好的全身像视频文件——MP4格式,分辨率不低于1080p,时长不少于60秒。
上传完成后,在「训练参数」中关闭「自动裁剪」选项,手动设置画面比例为9:16(竖屏)或16:9(横屏),然后勾选「保留完整肢体结构识别」。这个选项默认是关闭的,如果不勾选,系统会按半身逻辑截取上半身区域进行建模,结果将无法满足全身需求。
提交训练任务后,等待大约2到4小时生成结果。期间不要中断,也别修改参数,耐心等待即可。
