先拆解口播脚本,明确分段边界
打开度加AI网页或App,进入「AI口播」模块,把完整口播文案粘贴进去,然后点击「智能分段」按钮。系统会自动按语义停顿(句号、问号、感叹号)和口语呼吸点切分。这一步不能跳过,否则后续每段生成节奏错位,合并后嘴型对不上、语气断层。
人工检查分段结果:重点看“但是”“其实”“接下来”这类转折词是否被单独切开——【如果转折词被切到上一段末尾,下一段开头只剩半句话,合并后会显得突兀生硬】,手动拖动分隔线,确保每段都是完整语义单元。
逐段生成AI口播音频
方法一:网页端批量生成
在分段列表里,勾选全部段落,点击「批量生成音频」,选择统一音色(如“知性女声-03”)和语速(建议1.0倍速),等待全部完成。注意:不同段落若选不同音色,合并后听感像多人对话,破坏口播一致性。
方法二:App端单段精控
逐个点击段落右侧的「生成」图标,生成后立即试听。发现某段“嗯”“啊”等填充词过多,就点「重录」并勾选「减少口语冗余」。导出时统一命名为“P1_口播”“P2_口播”……避免文件名混乱导致后期错序。
用剪映专业版合并多段AI音频
第一步:新建项目,导入所有已命名的AI音频文件,按P1、P2、P3顺序拖入音频轨道。
第二步:选中P2音频片段,右键,选择「音频分离」,删掉分离出的空白视频轨,只留纯音频。
第三步:把P2音频左边缘拖至P1结尾处,放大时间轴到帧级别——听P1末尾与P2开头是否有0.1秒以上的静音间隙。有则用裁剪工具切掉P2开头0.05秒;无则微调P2起始位置,让两段人声气流自然衔接。
第四步:全选所有音频片段,右键,选择「音频对齐」,再选「按波形峰值对齐」——系统自动修正因生成延迟导致的毫秒级偏移。
第五步:导出前务必开启「智能降噪」和「响度标准化」,否则各段音量忽大忽小,听众要反复调音量键。
