Skip to content

8.4.3 什么时候应该要求模型引用来源? ​

先给结论:当任务需要可追溯性、可审查性或高风险事实约束时,就应该要求模型引用来源。反过来,如果任务更偏自然交流、轻量辅导或内部低风险总结,引用可以弱化,但不代表证据边界就不重要。

很多人会把“是否引用来源”理解成纯展示问题,好像只是:

  • 要不要把链接放出来

其实不是。对 RAG 来说,是否要求引用,直接反映的是系统在回答时更强调什么:

  • 更强调自然流畅 还是
  • 更强调证据可回查

一、哪些场景更应该强制引用 ​

1. 高风险事实问答 ​

比如:

  • 医疗
  • 金融
  • 法律
  • 企业制度
  • 合规规则

这类场景里,用户不仅关心答案是什么,还关心:

  • 这句话依据哪条材料

所以来源引用往往不是加分项,而是基本要求。

2. 文档口径经常变化的系统 ​

如果知识内容变化频繁,比如:

  • 产品规则更新
  • 版本策略变更
  • 内部流程经常调整

那么引用来源可以显著降低一个风险:

  • 模型答得像对,但用户无法判断它依据的是哪个版本

3. 需要人工复核的系统 ​

如果回答后面还要进入:

  • 人工审核
  • 工单处理
  • 客服升级
  • 专家复核

那来源引用会极大提升系统可用性,因为它把“回看证据”的成本降下来了。

二、哪些场景可以弱化引用 ​

不是所有场景都必须把来源显式展示给用户。

例如:

  • 低风险知识辅导
  • 入门解释
  • 内部学习型问答
  • 更强调阅读流畅度的总结任务

这类任务里,如果每段都带来源,回答体验可能反而变重。

但这里的“弱化引用”不等于:

  • 不关心来源

更合理的做法通常是:

  • 对外展示可以不强制逐句带来源
  • 但系统内部仍然保留证据映射能力

三、引用要求会怎样影响回答风格 ​

一旦你要求模型引用来源,它的回答风格通常也会跟着变化:

  • 更克制
  • 更偏证据型表达
  • 更少自由发挥
  • 更容易围绕材料而不是围绕语言流畅度展开

这通常是好事,但也意味着:

  • 回答可能不如纯自然对话那样轻盈

所以是否强制引用,往往也是在做取舍:

  • 流畅度 vs
  • 可追溯性

四、怎样要求引用会更稳 ​

如果你决定要求来源,最好把规则写清楚,而不是只写一句:

  • 请附上来源

更稳的要求通常包括:

  • 引用哪些类型的来源
  • 是段末引用、列表引用,还是按编号引用
  • 如果多个结论来自不同材料,是否要分开标注
  • 没有足够证据时,不要为了凑引用而硬贴来源

例如:

text
回答中涉及明确事实结论时,请在对应结论后标注来源编号。
如果材料不足以支持结论,不要编造来源。

这种要求会比模糊的“请给出处”更可执行。

一个常见误区 ​

很多人会觉得:

  • 只要系统是 RAG,就必须默认所有回答都带来源

这不一定对。是否引用,最终还是取决于:

  • 用户需不需要查证
  • 业务能不能接受无引用回答
  • 回答的风险等级有多高

更稳的原则通常不是“永远引用”或“永远不引用”,而是:

  • 按任务风险和审查需求决定引用强度

一句话总结 ​

当任务需要可追溯性、可审查性或高风险事实约束时,就应该要求模型引用来源;当任务更偏低风险交流或总结时,可以弱化展示层引用,但仍然应该保留证据边界。是否要求引用,本质上是在选择系统更偏流畅度还是更偏可回查性。