要实现首尾帧生成视频,您需要调用腾讯混元Vidu的SubmitViduImageToVideoTask接口——请注意,该接口仅限ap-beijing地域可用。请准备两张格式、分辨率、构图一致的PNG或JPG图像,按顺序提供URL,设置MotionSpeed参数在0.8到1.5之间,Duration固定为3秒,然后通过DescribeViduTaskResult接口查询结果,即可获得一个24小时有效的VideoUrl视频链接。

简单来说,首尾帧生成视频是指输入两张关键帧——起始帧和结束帧,让AI自动补全中间过渡动作,最终输出一段连贯的视频。这一功能需要通过混元生视频的图生视频接口并配合特定参数来调用,而非直接使用通用的文生视频或单图生视频功能。
准备首尾帧图像
图像准备是第一步,也是关键环节。两张图片都必须为PNG或JPG格式,分辨率最好统一为1024×576或1280×720,长宽比需保持一致——如果比例不同,系统会强制裁剪,可能导致主体被截断。此外,首帧和尾帧中同一主体(例如人物、物体)的位置、朝向、大小应尽量接近,否则AI难以建立合理的运动轨迹,容易出现肢体错位或形变撕裂。还要注意,避免使用包含文字、水印或复杂背景的图片——这些元素会被AI误判为运动目标,导致画面抖动或异常偏移。
登录API Explorer调试环境
接下来,登录腾讯云API Explorer(vclm产品),使用已实名认证的腾讯云账号登录。在左侧服务列表中搜索“Vidu”,找到【SubmitViduImageToVideoTask】接口并点击进入调试页面。【必须选择地域为ap-beijing】,该接口当前仅在北京地域开放首尾帧模式,其他地域调用会返回ParameterError错误,且不提示具体原因。
配置首尾帧参数
在请求参数区域展开“Input”对象,点击“Edit as JSON”切换为JSON编辑模式。将原始默认JSON中的ImageUrls数组替换为以下结构:
{"ImageUrls": ["https://example.com/start.png", "https://example.com/end.png"], "Type": "image_to_video", "MotionSpeed": 1.0, "Duration": 3}
其中ImageUrls必须严格按顺序填入首帧URL、尾帧URL;【顺序颠倒会导致动作反向播放,且后期无法通过反转修复】。MotionSpeed取值范围0.5~2.0,默认1.0;低于0.8容易产生卡顿感,高于1.5可能丢失细节连贯性;Duration固定为3秒,目前不支持自定义时长。
发起调用并获取任务ID
点击【发送请求】按钮,等待响应返回包含TaskId字段的JSON结果。复制返回的TaskId值,进入【DescribeViduTaskResult】接口页面,粘贴TaskId,点击发送,刷新查看Status字段是否变为SUCCESS。当Status为SUCCESS时,Response中Output.VideoUrl即为生成视频的直链,有效期24小时,请及时下载保存。
