Appearance
6.3 检索阶段的筛选与路由
这一节开始从“理解问题”继续往前走,进入真正的检索前决策层:
- 这次检索要不要先过滤
- 该走文档级还是 chunk 级
- 这个问题该去哪一路索引里查
很多系统到这一步还会犯一个常见错误:
- 不管什么问题,都丢给同一套检索策略
这种做法在小系统里有时能勉强运行,但在真实业务里很容易出现:
- 不该进来的候选进来了
- 该先缩边界的问题没有先缩
- 该走 FAQ 的问题被送去文档检索
- 该走 chunk 的问题却按整篇文档处理
所以这一节真正想讲清楚的是:
- 检索之前,系统其实还要做一次“筛选和分流”
学这一节时,最值得先建立的判断
- metadata filter 不是展示层功能,而是检索阶段的重要边界控制
- 文档级检索和 chunk 级检索解决的不是同一类问题
- Router Retrieval 的价值,不是更复杂,而是让不同问题走对路径
- 很多检索不稳,不是召回器太弱,而是问题本来就走错了检索策略
这一节会回答什么问题
读完这一节后,你最好能更稳地判断:
- 什么过滤条件应该在检索前就收紧
- 哪类问题更适合先找整篇文档,哪类问题更适合直接找 chunk
- 什么时候该引入路由检索,而不是继续让所有问题走同一路径