Appearance
8.5 生成阶段常见错误
先给结论:RAG 系统就算把材料检索到了、上下文也送进去了,生成阶段仍然可能出错。很多看起来像“模型没答好”的问题,实际是生成阶段在证据理解、答案组织和忠实表达上出了偏差。
这一步最容易让人误判的地方在于:
- 候选是对的
- 上下文也在
- 但答案还是不对
这时如果只看检索链路,很容易觉得“问题已经解决了”;但真正更准确的判断通常是:
- 检索只是把证据送到模型面前
- 生成阶段还要决定模型怎样理解、选择、组织和表达这些证据
而这些动作里,每一步都可能出错。
学这一节时,最值得先建立的判断
- RAG 并不会自动保证答案忠实于材料,生成阶段仍然会出现偏读、误读和过度补全
- “有材料”不等于“会围绕材料回答当前问题”
- “引用了来源”不等于“答案真的被这些来源支持”
- 生成错误往往和检索、上下文构造纠缠在一起,但不能因此忽略生成层本身的责任
这一节会回答什么问题
读完这一节后,你最好能更稳地判断:
- 当前问题更像是检索没找对,还是生成没用对
- 一个回答“看起来像有依据”,和它“真的忠实于依据”之间的差别
- 为什么 RAG 最难处理的错误,往往不是完全没答,而是“半对半错”