如果你希望 MiniMax Agent 在工作流中引用真实文档内容,而不是基于模型自行生成答案,首先必须完成知识库接入。通常可按以下流程操作:第一步,整理 PDF、Excel 等格式的原始资料,并先对扫描件完成 OCR 文字识别;第二步,在网页端上传文件并完成解析;第三步,在 Bot 工作流中配置知识库检索节点,正确连接输入与输出关系;第四步,通过调试测试返回结果是否能够准确匹配原文。

想让 MiniMax Agent 在回答问题时自动调用并引用你自己的 PDF、Excel、Word 或内部知识文档,而不是仅依赖大模型记忆“自由发挥”,就必须先把知识库接入工作流。这一步如果没有完成,Agent 即使能力再强,也无法真正调用企业内部资料,只会基于通用知识“凭空生成”,难以输出可信的真实数据。
第一步:准备知识源文件
先将需要提供给 Agent 检索的原始资料统一整理到同一个目录中。当前常见支持格式包括 PDF、DOCX、XLSX、TXT、MD,不支持压缩包,也不支持无法识别文字的扫描图片版 PDF。若文件中包含扫描文字,请务必先使用 OCR 工具转换为可检索文本,否则后续知识库切片与索引会失败,最终导致整个知识库无法正常检索。
文件命名建议采用“中文+下划线”的方式,例如“2026_财务报销制度_v3.docx”,尽量避免空格、特殊符号或过于随意的命名。系统虽然对文件名长度没有明确硬性限制,但如果名称过长(超过 64 个字符),在部分页面中可能出现显示截断,不利于后续管理和定位。
第二步:上传并解析知识库
登录 MiniMax Agent 网页端(https://agent.minimaxi.com),进入左侧菜单【知识库】→点击【新建知识库】→填写知识库名称(例如“HR政策库”)→点击【上传文件】→从本地目录中批量拖拽已准备好的文档进行上传。
上传完成后,系统会自动开始解析文件:例如 PDF 会提取正文与表格结构,Word 文档会尽量保留标题层级,Excel 会识别 Sheet 与字段名称。在解析状态条显示“处理中”时,请不要关闭页面,也不要刷新浏览器——【一旦中断,可能导致该文件解析失败且无法直接重试,只能删除后重新上传】。
全部文件解析完成后(通常为每 MB 约 1–3 分钟),状态会变为“就绪”,页面右侧还会显示成功解析的文件数量与总文本量(单位:token)。如果某个文件显示“解析失败”,可将鼠标悬停查看具体原因,常见问题包括 PDF 被加密、XLSX 文件损坏,或原始文档结构异常。
第三步:配置工作流中的知识库节点
进入【Bot管理】→选择目标 Bot→点击【工作流】标签页→在画布空白区域双击,或从左侧节点栏中拖入【知识库检索】节点。
点击该节点后,在右侧配置面板中下拉选择刚刚创建好的知识库名称;建议将“最大返回片段数”设置为 3–5 条(返回过多会干扰 LLM 理解重点,返回过少则可能遗漏关键信息);同时勾选“启用语义匹配”(通常默认开启,若关闭则会退化为传统关键词检索)。
随后,将用户输入消息连接到该节点的“query”输入口;再把该节点输出的“retrieved_content”内容,连接到后续 LLM 节点的“context”字段——【连接顺序不能出错:必须先做知识库检索,再把检索结果传给 LLM,否则大模型仍然只能自行猜测答案】。
第四步:验证知识库是否生效
保存工作流后,点击右上角【调试】按钮,输入一个能够明确指向知识库内容的问题,例如:“差旅住宿标准最高是多少?”或“试用期解除合同需要提前几天通知?”这类问题更适合测试知识库检索是否真正生效。
随后观察调试面板左侧的“执行路径”,确认【知识库检索】节点已经被触发,并且返回了非空的 content;在右侧输出结果中,理想状态下应能看到来自你上传文件的具体制度条款、原文描述或数据内容,而不是空泛、模板化的通用回答。
如果返回结果为空,或者内容明显偏题,建议优先检查知识库是否处于“启用”状态(顶部开关应为蓝色),同时确认提问表述中是否包含原文里的核心关键词。需要注意的是,知识库检索并不是完全依赖模糊联想,而是基于语义向量匹配进行召回,因此问题中最好保留一定的关键词锚点,才能提升 MiniMax Agent 知识库问答的准确率与命中率。
