如果你想用可灵AI制作多图参考的产品展示视频,操作前提是使用电脑版 v3.0.2 以上客户端,选择“视频1.3”模型,上传2–4张同一商品不同视角的1024×1024 JPG/PNG图片,并输入带有明确动作描述的提示词。整个视频生成过程通常在4秒内完成,生成后务必手动校验关键中间帧,避免出现产品变形或穿模现象。
确认环境与入口
先打开电脑版可灵AI客户端,查看左下角版本号——【低于v3.0.2将无法进入多图参考界面】。如果你当前使用的是网页端或手机 App,请立即退出,并重新安装官方桌面客户端。
进入后点击左侧导航栏【视频生成】→顶部选项卡切换到【图生视频】→再点击【多图参考】。进入该模式后,系统会自动锁定“视频1.3”模型,用户无法手动切换。
准备产品参考图组
方法一:正面+侧面+细节特写(最稳定、最推荐)
建议拍摄三张图片:一张完整正视图(白底或纯色背景)、一张45°侧视图(用于体现厚度和整体轮廓)、一张关键区域特写(例如 LOGO 位置、接口、材质纹理等)。所有图片都必须来自同一产品,保持相同打光环境,并避免反光、遮挡等干扰。
方法二:动态视角组(适合做旋转展示视频)
可使用三脚架固定手机,将产品放在转盘上,每旋转30°拍摄一张,共拍4张(0°、30°、60°、90°),随后统一裁切为1024×1024。拍摄时要特别注意避免阴影过长或镜头畸变——【畸变图会导致生成视频中产品边缘扭曲】。
上传数量最低为两张,最高为四张;如果超出数量上限,系统会默认静默截断,仅保留前四张图片参与生成。
填写动作提示词
第一步,先在提示词输入框中明确写出动作指令。例如:“金属保温杯缓慢顺时针旋转360度,杯盖弹开15毫米,底部LED灯随旋转节奏明暗闪烁”。
第二步,尽量删除所有模糊表达。比如“慢慢转”可以改为“匀速旋转,每秒转15度”,“亮一下”可以改成“LED灯以0.8秒周期明暗交替”。
第三步,检查每个动词是否与对应部位准确匹配。例如“旋转”对应“杯身”,“弹开”对应“杯盖”,“闪烁”对应“LED灯”。如果缺少动作主体或具体部位,AI 往往会自行补全细节,最终导致生成结果偏离预期。
提示词总长度不能超过60字。超过的部分会被系统自动截断,而且不会给出额外提示。
提交生成与校验
点击【生成】按钮后,界面会先显示“正在构建三维先验”,大约2秒后进入渲染倒计时。默认输出参数为4秒、1080p、16:9,当前不支持手动调整画面比例或帧率。
视频生成完成后,建议立即拖动时间轴逐帧检查第12帧、第24帧、第36帧——重点观察产品接缝处是否出现撕裂,LOGO 是否被拉伸,以及旋转轴心是否发生偏移。如果发现穿模或明显形变,不要直接重复生成,应先返回检查图片组的角度一致性和拍摄质量。
