核心问题
豆包AI在缺乏明确指令时,不会自动生成镜头编号、景别、角度、运镜等分镜要素。例如,直接要求“写一个短视频脚本”,输出结果通常只有台词和简单动作提示,无法直接用于实际拍摄。
解决方案
明确要求分镜结构
在提问时,应首先明确分镜结构。例如输入“请按以下格式生成分镜脚本:【镜头编号】【画面描述】【台词】【音效/背景音乐】”,豆包将严格遵循该框架输出。如果遗漏“镜头编号”,系统可能直接描述画面而跳过编号,给后期剪辑带来不便。
明确描述景别和运镜方式。例如使用“特写→缓慢推近→拍锅气升腾瞬间”,而不是简单写“拍锅”。豆包无法自动判断“拍锅”是全景还是俯拍,也不会主动补充运镜逻辑。
用影视术语约束AI输出
方法一:嵌入专业词库限定输出范围。在需求中插入括号说明,例如“所有画面描述必须包含【景别】(近景/特写/中景/全景)、【角度】(俯拍/仰拍/平视)、【运镜】(推/拉/摇/固定)三项,缺一不可”。豆包会逐条校验,并自动补全缺失项。
方法二:提供范例强制对齐格式。先给出一段标准分镜样例:“01|特写|平视|固定|筷子夹起拉面,汤汁滴落|‘筋道!’|(音效:面条弹牙声)”,然后要求“请按此格式生成5个分镜”。样例中【特写|平视|固定】三要素缺一不可,否则豆包会沿用模糊表达。
注意事项
- 删除形容词堆砌句式。避免使用形容词堆砌的句式。例如,不要写“唯美梦幻的夕阳下缓缓走过”,豆包会将“唯美梦幻”视为无效修饰而丢弃,最终输出只剩“夕阳下走过”。应使用名词+动词+技术参数组合,如“全景|低角度|慢速跟拍|人物从画面右下角走入”。
- 禁用开放式指令。禁止使用开放式指令。例如“自由发挥画面感”“让镜头有电影感”等表述会让豆包退回通用话术,输出“镜头缓缓推进”等缺乏实质信息的描述。应改为“镜头从桌面酱料瓶后方45度角升起,露出主厨侧脸”,这样豆包才会按空间坐标生成。
- 避免混用多任务指令。不要在同一句中加入“既要突出产品卖点,又要体现品牌调性,还要有分镜”。豆包会优先处理最后出现的需求,导致“分镜”被弱化。建议拆分成两轮:第一轮专门提问分镜结构,第二轮再加入品牌元素。
当前进展
截至目前,豆包AI官方尚未对此问题发布公开回应或更新说明。用户需要自行调整提示词策略,才能获得可执行的分镜脚本。
