Appearance
8.4.3 什么时候应该要求模型引用来源?
先给结论:当任务需要可追溯性、可审查性或高风险事实约束时,就应该要求模型引用来源。反过来,如果任务更偏自然交流、轻量辅导或内部低风险总结,引用可以弱化,但不代表证据边界就不重要。
很多人会把“是否引用来源”理解成纯展示问题,好像只是:
- 要不要把链接放出来
其实不是。对 RAG 来说,是否要求引用,直接反映的是系统在回答时更强调什么:
- 更强调自然流畅 还是
- 更强调证据可回查
一、哪些场景更应该强制引用
1. 高风险事实问答
比如:
- 医疗
- 金融
- 法律
- 企业制度
- 合规规则
这类场景里,用户不仅关心答案是什么,还关心:
- 这句话依据哪条材料
所以来源引用往往不是加分项,而是基本要求。
2. 文档口径经常变化的系统
如果知识内容变化频繁,比如:
- 产品规则更新
- 版本策略变更
- 内部流程经常调整
那么引用来源可以显著降低一个风险:
- 模型答得像对,但用户无法判断它依据的是哪个版本
3. 需要人工复核的系统
如果回答后面还要进入:
- 人工审核
- 工单处理
- 客服升级
- 专家复核
那来源引用会极大提升系统可用性,因为它把“回看证据”的成本降下来了。
二、哪些场景可以弱化引用
不是所有场景都必须把来源显式展示给用户。
例如:
- 低风险知识辅导
- 入门解释
- 内部学习型问答
- 更强调阅读流畅度的总结任务
这类任务里,如果每段都带来源,回答体验可能反而变重。
但这里的“弱化引用”不等于:
- 不关心来源
更合理的做法通常是:
- 对外展示可以不强制逐句带来源
- 但系统内部仍然保留证据映射能力
三、引用要求会怎样影响回答风格
一旦你要求模型引用来源,它的回答风格通常也会跟着变化:
- 更克制
- 更偏证据型表达
- 更少自由发挥
- 更容易围绕材料而不是围绕语言流畅度展开
这通常是好事,但也意味着:
- 回答可能不如纯自然对话那样轻盈
所以是否强制引用,往往也是在做取舍:
- 流畅度 vs
- 可追溯性
四、怎样要求引用会更稳
如果你决定要求来源,最好把规则写清楚,而不是只写一句:
- 请附上来源
更稳的要求通常包括:
- 引用哪些类型的来源
- 是段末引用、列表引用,还是按编号引用
- 如果多个结论来自不同材料,是否要分开标注
- 没有足够证据时,不要为了凑引用而硬贴来源
例如:
text
回答中涉及明确事实结论时,请在对应结论后标注来源编号。
如果材料不足以支持结论,不要编造来源。这种要求会比模糊的“请给出处”更可执行。
一个常见误区
很多人会觉得:
- 只要系统是 RAG,就必须默认所有回答都带来源
这不一定对。是否引用,最终还是取决于:
- 用户需不需要查证
- 业务能不能接受无引用回答
- 回答的风险等级有多高
更稳的原则通常不是“永远引用”或“永远不引用”,而是:
- 按任务风险和审查需求决定引用强度
一句话总结
当任务需要可追溯性、可审查性或高风险事实约束时,就应该要求模型引用来源;当任务更偏低风险交流或总结时,可以弱化展示层引用,但仍然应该保留证据边界。是否要求引用,本质上是在选择系统更偏流畅度还是更偏可回查性。