别指望一次性把整份50页的技术白皮书或8万字的行业尽调报告扔给Kimi,它就能自动给你抽取出所有关键条款。实际上,得学会分段提问,让Kimi精准定位每一块信息单元。具体做法分三步:先按书签拆分子文件并逐个上传,指令提取带“应”字的强制性条款;手动分段时加前缀标记防止逻辑断裂;再用问答模式直接提问,定向抽取准确率会高得多。
面对一份50页的技术白皮书,或者一份8万字的行业尽调报告,通读一遍实在太耗时,还容易遗漏关键条款。因此,必须通过分段提问,让Kimi精准定位每一块信息单元。
按自然章节切分并绑定指令锚点
第一步:用Adobe Acrobat打开PDF,点击“组织页面”,选择“拆分文档”,勾选“基于书签拆分”,导出为多个带标题命名的子文件(比如“3.2 数据安全要求.pdf”)。
第二步:逐个上传子文件,每次只传一个。上传完成后,在输入框中直接输入指令:“请提取本节中所有带‘应’字的强制性条款,按原文顺序编号输出,不加解释。”
第三步:收到响应后,立即检查是否包含页码标注(如“P23第4条”)。如果没有页码,说明Kimi没有启用文档原生解析模式,需要重新上传,并等待右上角出现“已启用文档理解模式”提示后再提问。这一步一定要留意,否则后续提取结果可能不准。
手动分段+前缀标记法
方法一:用记事本打开导出的纯文本,每1200字符左右插入一条分隔线“———【段落X结束】———”,然后在每段开头加一个结构化前缀,例如【P17-2|承接上文“加密算法选型”结论】。
方法二:把含表格的段落单独处理,先手动转述成文字:“表4显示:AES-256加密延迟均值为1.2ms,SM4为0.9ms,RSA-2048为8.7ms”,再提交该描述句,并加上指令“对比三类算法性能指标,指出延迟最低与最高者”。
【不加前缀标记的段落,Kimi会默认重载上下文,导致前后逻辑断裂】 这一点必须牢记,否则分段处理反而会乱套。
用文档问答模式实现定向抽取
上传完整PDF后,不要走摘要路径,直接开启问答模式。输入问题:“这份合同第5.3条约定的验收标准具体包括哪三项指标?”然后追加一句:“请只返回原文中间出现的三个短语,用顿号分隔,不加引号、不加序号。”
这一步操作很简单,直接把问题复制粘贴进去就行。Kimi会在全文中锚定位置并精准截取,比泛泛而问“总结验收条款”准确率高6倍以上。
