Appearance
7.1 为什么召回到了内容,模型还是答不好
这一节要先拆开看一个非常常见的误解:
- 检索结果里明明已经有答案相关内容,为什么模型最后还是答不好
很多人做到这里时,会自然觉得:
- 既然都召回到了,后面生成应该就不难了
但真实系统里,“召回到了”和“最后答好”之间其实还隔着很多层:
- 候选是不是排在前面
- 候选之间有没有重复和冲突
- 模型最后拿到的是不是最关键那几条
- 上下文是不是被噪声挤占了
这一节真正想帮你建立的是一个更稳的判断:
- 召回只是把候选带进来
- 但候选怎么排、怎么选、怎么送给模型,同样决定最终质量
学这一节时,最值得先建立的判断
- “能找到”不等于“会被优先看到”
- “候选里有答案”不等于“模型最后能稳定用对答案”
- 召回阶段和排序阶段解决的是两类不同问题
- 很多看起来像生成问题的现象,其实根因在结果排序和精选上
这一节会回答什么问题
读完这一节后,你最好能更稳地判断:
- 问题是出在召回不到,还是召回到了但排错了
- 为什么候选集质量和候选顺序会直接影响最终回答
- 为什么后面必须引入 rerank、结果精选和上下文组织