想象一下,你面前摆着几十页的行业报告,或者十几份合同需要快速过一遍,只想抓出里面所有的公司名、金额、日期和人名。手动翻找?那效率实在太低了,而且很容易漏掉关键信息。豆包专业版可以帮你几秒钟就把这些实体信息全抽出来,直接导成CSV表格,拿来就能用。

确认办公任务模式已启用并完成本地授权
先把豆包App打开,点右下角的「我」,进入「设置」,找到「办公任务模式」,确保开关是开启的。如果显示「未授权」,点进去,把「访问本地文件」和「控制桌面应用」这两项权限都授予。Windows系统会弹窗,点「是」就行;macOS用户则需要去「系统设置→隐私与安全性→完全磁盘访问」里,手动勾选豆包。
这一步不搞定,后续所有上传操作都只能识别文件名,文件内容根本读不到。授权完成后,重启豆包App,回到主界面,底部导航栏应该会出现一个「办公」专属入口图标。
上传文档后用字段指令精准提取
切换到「办公」模式,界面中央会有一个虚线框,提示你「拖入文档开始处理」。把本地的Word、PDF或TXT文件直接拖进去,松手后豆包就会开始解析,大约10秒内生成摘要,并显示「已加载文档结构」的状态条。
接着,在输入框里输入明确的字段指令,比如:请提取甲方全称、乙方全称、签约日期、付款方式、违约责任五项内容,每项单独一行,无则写“未明确”。点击「生成摘要」,系统就会输出结构化的字段列表,不包含任何解释性文字。整个过程很直接,把文件拖进去就行。
纯文本前加关键词锚定提取
除了上传文件,还有一个更灵活的方法:把待处理的文本复制成纯文本,粘贴到豆包输入框里。在文本最前方,键入你关注的关键词,比如:甲方、乙方、金额、截止日、违约金、管辖法院、签署地。换行后粘贴原文,末尾追加指令:严格围绕上述七个关键词提取对应内容,逐项列出,不解释、不补充、不推断。发送后,模型就会完全围绕这些关键词来切片信息,缺失的部分会标注为「未提及」。这招对合同段落、邮件正文这类非结构化文本特别管用,模型不会擅自脑补。
如果原文里掺杂了大量干扰信息,比如会议纪要里夹杂着闲聊,可以在指令开头加一句:忽略所有口语化表达、感叹词和括号内的备注,只提取具有法律效力或财务约束力的实体。
批量处理多个文件并汇总导出
当你有多个文件需要处理时,比如一堆发片,可以用批量功能。先把所有目标文件都拖入工作区,确保文件名有规律可循,比如invoice_20260601.pdf、invoice_20260602.pdf。然后输入指令:把工作区里所有以“invoice_”开头的PDF文件,每份都提取发片号码、开票日期、总金额,汇总成一个Excel表格,保存为“6月发片汇总.xlsx”。接下来,豆包会自动遍历、解析、去重、合并,生成一个可下载的.xlsx文件。整个过程你不需要打开任何一个PDF,也不用复制粘贴。
有一点需要额外提醒:如果某份PDF是扫描件,豆包会自动调用OCR识别文字后再提取实体,但清晰度低于300dpi的图片可能会出现漏字的情况。所以,优先使用原生电子版,效果会更好。
