游乐游手机版
首页/AI热点日报/热点详情

通义听悟生成Excel公式的完整步骤与处理办法

类型:热点整理2026-07-20
针对通义听悟导出的语音转文字文本,可利用Excel公式提取时间戳与发言者,按换行拆分段落,清理口语词和括号注释,实现结构化整理,大幅提升效率。

最近在协助团队整理会议记录时,发现许多同事使用通义听悟导出语音转文字文本后,面对混合的时间戳、发言者姓名及杂乱对话内容,往往只能手动逐行拆分,既耗时又容易出错。实际上,只要掌握几个关键的Excel公式组合,就能将导出内容一键整理为结构化的表格,大幅节省重复劳动。

将通义听悟导出的语音转文字内容整理成Excel表格,核心在于根据原始文本的特征编写针对性公式。下面就从最基础的时间戳与发言者提取开始,逐步拆解整个流程。

提取时间戳与发言者姓名

通义听悟导出的文本常见格式为“[00:01:23] 张三:今天讨论预算分配……”这样的组合,需要从中分离出时间、人名和发言内容三部分。

假设原始文本位于A2单元格,那么B2用来提取“]”之后的内容:=TRIM(MID(SUBSTITUTE(A2,"]",REPT(" ",100)),2,100))。该公式的原理是将“]”替换成100个空格,然后从第二个字符开始截取,再用TRIM去掉多余空格,从而得到“]”后面的全部文本。

C2提取发言者姓名:=IFERROR(LEFT(B2,FIND(":",B2)-1),"")。注意此处使用的是中文冒号“:”。如果某行没有冒号(例如只有纯时间戳或纯文字),公式会返回空值而不会报错,可放心使用。

D2提取时间戳(从开头到“]”):=SUBSTITUTE(LEFT(A2,FIND("]",A2)),"[","")。这一步必须确保A2单元格确实包含“[”和“]”这对方括号,否则FIND函数会报错。因此,原始文本必须包含标准方括号时间标记,这是整个流程的前提条件。

按段落拆分发言内容

通义听悟导出的纯文本经常将多轮对话挤在同一个单元格里,需要按换行符切分。但Excel公式无法直接处理换行符CHAR(10),需要先将其替换成其他分隔符。

方法一:预处理+FILTERXML(仅限Windows版Excel 2019+或Microsoft 365)。
具体操作:选中数据列,按Ctrl+H打开查找替换,查找内容输入Ctrl+J(即插入换行符),替换为“|”。然后使用公式:=FILTERXML(""&SUBSTITUTE(A2,"|","")&"","//s["&ROW(A1)&"]"),向下拖拽即可逐行提取每一段对话。

方法二:TEXTSPLIT函数(Microsoft 365用户专属)。
直接在B2输入:=TEXTSPLIT(A2,CHAR(10))。此操作非常简单,但必须确认你的Excel版本支持TEXTSPLIT函数,旧版会显示#NAME?错误,白费功夫。

清洗并标准化发言内容

语音识别结果中常常夹杂着“嗯”“啊”“呃”这类口语词,以及“……”“(笑声)”“(电话铃声)”等冗余内容,需要批量清理。

第一步:去除首尾空格与不可见字符。
E2输入:=TRIM(CLEAN(B2))。CLEAN函数可以移除文本中的不可打印字符,TRIM去掉多余空格,两招并用,数据就干净多了。

第二步:替换常见口语填充词。
F2输入:=SUBSTITUTE(SUBSTITUTE(SUBSTITUTE(E2,"嗯",""),"啊",""),"呃","")。如需清理更多词,继续嵌套SUBSTITUTE即可,注意括号不要漏掉。

第三步:删除括号及其中内容(如“(掌声)”“(电话铃声)”)。
G2输入:=LET(txt,E2,trimmed,REDUCE(txt,SEQUENCE(LEN(txt)),LAMBDA(a,i,IF(ISERROR(FIND("(",a)),a,SUBSTITUTE(a,MID(a,FIND("(",a),FIND(")",a&")")-FIND("(",a)+1),"")))),TRIM(trimmed))。该公式嵌套较深,复制时务必核对左右括号数量,少一个会导致整列报错,得不偿失。

来源:https://www.php.cn/faq/2850848.html?uid=1431639

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。