Skip to content

7.1 为什么召回到了内容,模型还是答不好 ​

这一节要先拆开看一个非常常见的误解:

  • 检索结果里明明已经有答案相关内容,为什么模型最后还是答不好

很多人做到这里时,会自然觉得:

  • 既然都召回到了,后面生成应该就不难了

但真实系统里,“召回到了”和“最后答好”之间其实还隔着很多层:

  • 候选是不是排在前面
  • 候选之间有没有重复和冲突
  • 模型最后拿到的是不是最关键那几条
  • 上下文是不是被噪声挤占了

这一节真正想帮你建立的是一个更稳的判断:

  • 召回只是把候选带进来
  • 但候选怎么排、怎么选、怎么送给模型,同样决定最终质量

学这一节时,最值得先建立的判断 ​

  • “能找到”不等于“会被优先看到”
  • “候选里有答案”不等于“模型最后能稳定用对答案”
  • 召回阶段和排序阶段解决的是两类不同问题
  • 很多看起来像生成问题的现象,其实根因在结果排序和精选上

这一节会回答什么问题 ​

读完这一节后,你最好能更稳地判断:

  • 问题是出在召回不到,还是召回到了但排错了
  • 为什么候选集质量和候选顺序会直接影响最终回答
  • 为什么后面必须引入 rerank、结果精选和上下文组织