先看怎么选
先按精确词、同义问法与组合条件准备样本,再比较全文、向量和混合检索。索引方式决定可用选项;Rerank 是后续排序步骤,配置与成本需要单独核对,不能把功能名称当成效果保证。
先区分索引与检索 索引回答资料怎样被组织,检索回答收到问题时走哪条查找路径。Dify 的高质量索引使用嵌入模型,提供向量、全文和混合检索;经济索引则使用关键词相关的倒排检索。名字中的“高质量”是产品模式名称,并不能替代对具体知识库的效果评估。 根据问法准备对照 对于型号、错误码等精确字符串,先检查全文检索能否保留这些词的区分度;对于同一意思的不同表达,观察向量检索是否返回相关内容。混合检索把两条路径结合,再进行排序。编辑建议是为每类问法保留若干经过核对的样本,分别观察有没有命中以及前几项是否相关。 用三种问法识别真正的差别 准备一份自拟设备资料,分别描述 X-120 与 X-120S 的耗材规格,并包含“待机后无法唤醒”的排查说明。测试“X-120S 用什么耗材”时,型号末尾的 S 不能被忽略;测试“睡眠后叫不醒”时,观察能否匹配到“无法唤醒”;测试“X-120S 的售后联系人”时,资料没有联系人就不应因型号相同而拿无关片段凑答案。 先在同一知识库、同一组问题下保留向量和全文检索结果,再试混合路径。对每次结果记录文件与分段身份、前几名的位置、是否包含答案,不只抄一个分数。某个设置修好了口语问法却混淆型号,应按实际问题比例判断取舍,而不是挑一条最好看的结果宣布提升。 Rerank 只能调整已经进入候选集的内容。正确型号的分段从未被召回时,先查索引、过滤或前置检索;它已经在候选中却排得很后,才更适合考察重排序。这能避免把每次漏检都归因于“缺少更强的 Rerank”。 权重与 Rerank 不要混为一谈 官方资料中,混合检索可以配置语义与关键词权重,也可以启用 Rerank 模型。选择外部 Rerank 前,需要在模型供应商中完成对应配置,并确认服务的计费和能力。本篇没有为任何比例或模型给出通用推荐,因为答案取决于文档与问题分布。 对于多模态知识库还需多查一步。文档要求嵌入模型与 Rerank 的多模态能力相适配,否则图片可能在重排序及结果中被排除。若文字命中正常但图片消失,应检查这一层,而不是只反复修改查询文本。 先确认设置在哪一阶段生效 所核对文档注明:向量与全文模式中的 TopK、Score 设置在 Rerank 阶段生效,需要启用 Rerank;混合模式的权重设置与 Rerank 路径则都提供相关选项,经济索引只提供 TopK。先核对所用版本与当前路径,再观察实际返回数量。不要把其他模式中的参数经验直接套过来,也不应凭分数大小跨模型比较优劣。 索引切换需要预先安排 文档说明经济索引可升级为高质量,而以高质量建立的知识库不能再切回经济。正式迁移前,可在单独试验库中用相同资料完成对照,记录索引时间、外部模型调用和检索结果。这样选定后仍能说明为什么改变,而不只是因为某个模式名字更吸引人。 验收看三种结果 把未召回正确资料、正确资料排序靠后以及资料充分但回答错误分别标记。前两类再调整检索与排序,最后一类应继续检查生成。保留原问题和返回片段,避免把回答措辞变化误当成召回改善。
放在一起,看清差异
| 项目 | 本文用途 | 验收重点 |
|---|---|---|
| Dify | 向量、全文与混合候选 | 召回遗漏、排序靠后或生成错误 |
本篇涉及的工具1

Dify
配置知识库检索路径与重排序
- 适合场景
- 已有 Dify 知识库,准备调整召回与重排序策略的维护人员。
- 需要留意
- 参数生效阶段、索引转换与多模态兼容性需核对。
我们如何筛选
根据文末官方资料核对功能与接口语义,围绕本文问题整理操作路径和验收建议。文中的测试样例属于编辑建议,没有安装实测或性能排名。
参考来源与更新
补充型号、口语与无答案问法的对照,以及候选召回和重排序的不同职责与参数生效阶段。
发布于 2026-09-12 · 更新于 2026-09-13


