确认文档可被正确识别
在处理任何文档之前,务必先确认文档类型,否则后续所有操作都将失效。
文档类型判断
- PDF文件:打开PDF文件,按Ctrl+A尝试全选文字。如果文字能够高亮选中,说明是文字型PDF,可直接解析;如果光标划过只框出图片轮廓,说明是扫描型PDF,必须先进行OCR预处理。
- Word文件:必须使用.docx格式且未加密。旧版.doc或带密码保护的文件上传后会静默失败,无错误提示。
文件大小与页数限制
- 单文件大小:不能超过100MB。
- PDF页数:建议控制在100页以内。超限会导致章节锚点偏移、表格识别断裂。
小提示:扫描型PDF如果跳过OCR直接操作,AI会报出“无法读取内容”错误,务必先完成OCR处理。
上传文档并触发结构化分析
完成文档确认后,通过以下三种方式之一上传并触发结构化分析。
方法一:桌面端快捷路径
- 启动纳米AI桌面版。
- 点击左侧【知识库】。
- 点击“+添加内容”。
- 拖入PDF文件。
- 等待右下角出现“已解析”绿标。
- 点击右侧“分析”图标。
方法二:对话框内直传直问
- 在【大模型】对话页,点击输入框上方【上传文件】图标。
- 选择PDF文件。
- 上传完成后,立即输入指令:“总结这份报告的三个核心结论、五项待办事项,并标出原文页码。”不要等界面提示“上传成功”再输指令,AI已实时建模,延迟输入会导致重解析。
方法三:网页端精准调用
- 确保浏览器已打开目标PDF(如本地file://路径或云盘在线预览页)。
- 点击工具栏【网页对话】。
- AI自动加载当前页面文本块。
- 输入指令:“提取文中所有带‘应’‘须’‘不得’字样的强制性条款,并归类为合规/执行/监督三类。”
分层提炼与结果导出
上传成功后,系统会自动进行结构化解析,并生成结果。
第一步:等待结构化解析完成
- 文字型PDF:通常需要30秒至2分钟,系统自动生成“核心思想”“章节摘要”“关键概念图谱”“金句摘录”四个模块化卡片。
- 扫描型PDF:需额外等待1~3分钟的OCR处理时间。
第二步:导出Markdown文件
- 点击任一模块右上角“导出为Markdown”按钮。
- 保存至本地或同步至知识库。
- 导出的Markdown文件会保留标题层级、列表缩进与表格结构,适配Notion、Obsidian等笔记工具。
第三步:验证关键信息溯源
- 检查输出中每条结论是否标注原文位置,例如“数据安全责任归属见P17第4.2条”。
- 如果没有标注页码,说明解析未穿透到语义层,需重新上传或切换OCR模式。
常见问题:如何处理扫描型PDF以确保解析成功?
答案:必须先使用OCR工具(如ABBYY FineReader、Adobe Acrobat的OCR功能)将扫描件转换为可搜索的文字型PDF,再上传至纳米AI。如果直接上传,系统会提示“无法读取内容”。
