很多老师吐槽,用度加AI数字人做课程视频,脚本写得像论文,最后口型对不上,学生听着直犯困。我讲过不少知识类课程,经验是:问题真不在工具本身,而在于脚本没按数字人的“生理节奏”来设计。课程内容,必须让AI数字人“讲得像老师”,而不是“念得像录音机”。这背后,需要把知识拆解成可驱动口型、可嵌入气口、可匹配字幕跳动的教学单元。

先搭骨架:知识口播脚本的四段式结构
别写“大家好,今天我们讲XXX”了。度加AI数字人对开场白特别敏感,冗长的问候会拉平语调曲线,导致口型僵硬。直接来个问题锚点:开头3秒,必须抛出一个具体困惑或反常识结论。比如讲“牛顿第一定律”,别写“同学们好,今天我们学习力学基础”,改成“你推一辆静止的自行车,它动了;你松手,它却慢慢停下——这恰恰证明牛顿第一定律是错的?”
后续严格按四段推进:
- 痛点场景(15秒内还原真实卡点)
- 原理切片(单句讲清1个核心概念,禁用复合句)
- 案例具象(用“你正在做的某件事”代替“小明”)
- 行动钩子(明确告诉观众“现在立刻做哪一步”)
注意,每段结尾留0.8秒空白。这是度加自动插入眨眼和微表情的关键缓冲区,别省。
再填血肉:让文字能被AI“读懂”并驱动口型
度加不识别标点节奏,它只认换行和括号标注。所以,把脚本里所有逗号、句号删掉,改用换行来分隔语义单元。举个例子:
原来写的是“这个公式有三个变量(a、b、c),其中a代表初始速度,b是加速度,c是时间”,改成:
这个公式有三个变量
(a代表初始速度)
(b是加速度)
(c是时间)
括号内的内容,会被度加识别为强调短语,自动加重对应音节、同步唇形张合幅度。没有括号的纯文本行,AI默认用平直语调处理,很容易变成念稿感。还有一个关键细节:括号必须是英文半角,中文括号会触发解析错误。
最后调音:用“气口标记”控制AI呼吸节奏
方法一:在需要停顿处插入【喘】。比如“为什么电流会发热【喘】因为电子在导体里撞来撞去【喘】每次碰撞都把动能变成热能”。度加遇到【喘】会自动插入0.6秒自然停顿,并同步数字人喉结微动和眨眼动作,能有效避免机械感。
方法二:用【重读】包裹关键词。例如“真正的【重读】安全距离不是车速×2,而是车速×【重读】3.5”。这比加粗或变色更有效——度加会据此调整音高、延长发音时长,并联动口型开合角度。
【重要前提】所有【喘】【重读】标记必须紧贴文字后,中间不能有空格,否则标记失效。
导入度加前的终极检查
第一步:复制脚本全文,粘贴到记事本,全选,字体设为等宽字体(如Consolas),查看是否每行字符数≤42。超过的话,AI会自动折行,导致字幕错位、口型错帧。
第二步:用Ctrl+F搜索“的”“了”“呢”“啊”等语气词,删掉70%以上。这些词在真人讲课中靠气息带过,但AI会逐字生成口型,堆砌后会造成嘴部高频抖动,观感极差。
第三步:把脚本最后一行改成“(下节课我们拆解实操步骤)”。度加会将这行识别为结束信号,自动添加微笑+微微点头收尾动作,比手动截断自然得多。
