Appearance
8.2 不同任务的上下文组织方式
先给结论:上下文构造不能脱离任务类型单独讨论。不同任务要解决的问题不同,模型需要的证据组织方式也不同。检索式问答更强调直接命中,总结式问答更强调覆盖完整,对比式问答更强调结构对齐。
很多系统一开始会默认:
- 先检索
- 再拿前几条结果
- 按固定模板拼进 Prompt
这套方式能处理一部分简单问答,但一旦任务变复杂,就会迅速暴露问题。因为:
- 问“某个配置项默认值是多少”和“帮我总结这个方案的核心变化”,需要的上下文并不一样
- 问“文档 A 和文档 B 有什么不同”和“根据文档回答一个具体事实”,需要的证据排列也不一样
所以这一节要建立的核心判断是:
- 上下文构造不是只有一种默认拼法,而是要随任务目标变化
学这一节时,最值得先建立的判断
- 检索式问答更强调直接证据优先,不适合塞太多背景
- 总结式问答更强调覆盖和结构完整,不适合只截最前面的几条块
- 对比式问答更强调来源分组和字段对齐,不适合把不同来源材料混成一堆
- 同样一批候选,用不同组织方式喂给模型,最终回答质量可能差很多
这一节会回答什么问题
读完这一节后,你最好能更稳地判断:
- 当前问题更像事实问答、总结任务,还是对比任务
- 面对长文档和多文档问题时,应该优先保局部精确,还是保结构覆盖
- 为什么有些系统“检索其实没问题”,但只是上下文组织方式不适合任务