RAG 上下文增强 6 大利器:从语义分块到文档增强全解析
·
上下文增强(Context Enrichment)在 RAG 中的核心作用
在 RAG(检索增强生成)架构中,上下文增强是连接「文档检索」和「大模型生成」的核心环节,它通过对检索到的原始文档进行优化处理,直接决定了输入给大模型的上下文质量;
1、语义分块 (Semantic Chunking)

2、Relevant Segment Extraction(相关片段提取)
3、上下文压缩 (Context Compression)
4、上下文块标题 (Chunk Title)
5、上下文窗口增强 (Context Window Augmentation)
6、文档增强 (Document Augmentation)
最常用方法选择技巧:
(1)基础必用(3 个):语义分块(把属于同一语义的模块放在一起,通过相邻句子的相似度高低判断是否为同一语义)、相关片段提取(与问题相似即相关,通过文本块与用户查询的相似度阈值 /top-k 判定,实现 “只取和问题有关的块”)、上下文压缩(RAG 流程的基础,无此三者则上下文增强失去意义);
(2)高频辅助(2 个):上下文块标题(提升检索效率)、上下文窗口增强(兜底窗口适配);
(3)进阶核心(1 个):文档增强(专业场景必用,提升回答质量上限)。
| 核心业务场景 | 场景特征 | 语义分块(Semantic Chunking) | 相关片段提取(Relevant Segment Extraction) | 上下文压缩(Contextual Compression) | 上下文块标题(Contextual Chunk Headers) | 上下文窗口增强(Context Window Enhancement) | 文档增强(Document Augmentation) |
|---|---|---|---|---|---|---|---|
| 通用轻量问答(科普/日常资讯/短问题解答) | 短文本(<500字)、价值密度低、查询为基础需求(是什么/有哪些) | ❌排除(文本过短,无需拆分) | ❌排除(无无关内容,无需筛选) | ⭐推荐-轻量(删除口语化/修饰词,精简表述) | ✅可选-简易(标注文本核心主题,方便快速识别) | ❌排除(Token未超限,无窗口适配需求) | ⭐推荐-基础(补充基础元数据,如来源/发布时间) |
| 技术文档查询(开发手册/AI教程/技术白皮书) | 常规/超长文本、价值密度高、查询为精准需求(步骤/参数/原理) | ✅必用(按技术逻辑切分,保证语义完整) | ✅必用(筛选与问题相关的技术模块) | ⭐推荐-轻量(保留参数/步骤,仅删冗余举例) | ✅必用(为技术模块加标题,提升检索效率) | ⭐推荐-核心置顶(技术核心内容置顶,优先读取) | ✅必用-结构化(补版本/依赖/适用场景+逻辑重构) |
| 金融/法律合同查询(借款/买卖/劳务合同/法规条款) | 常规/超长文本、价值密度极高、查询为精准需求(条款/金额/责任) | ✅必用(按合同条款/章节切分,避免条款割裂) | ✅必用(筛选与问题相关的条款模块) | ✅必用-高精度(仅删格式套话,保留所有数字/比例) | ✅必用(为条款加标题,如「还款义务」「违约责任」) | ⭐推荐-冗余截断(剔除无价值通用条款,控制Token) | ✅必用-专业版(元数据+结构化拆分+关键信息标注) |
| 医疗场景分析(病历/诊疗指南/药品说明) | 常规/超长文本、专业性强、查询为专业需求(诊断/用药/诊疗方案) | ✅必用(按诊疗环节切分,如检查→诊断→医嘱) | ✅必用(筛选与患者/问题相关的诊疗信息) | ⭐推荐-轻量(保留检查结果/医嘱,仅删冗余描述) | ✅可选-专业(为诊疗环节加专业标题) | ⭐推荐-核心置顶(诊断/医嘱等核心信息置顶) | ✅必用-领域版(元数据+领域知识补全+诊疗逻辑关联) |
| 多轮对话交互(智能客服/AI助手/连续问答) | 历史对话+新问题、上下文易膨胀、新问题依赖历史信息 | ❌排除(无长文本,无需分块) | ✅必用(筛选与新问题相关的历史对话) | ✅必用-轻量(删除口语化冗余,如「谢谢」「麻烦了」) | ❌排除(无分块,无需加标题) | ✅必用-历史浓缩(浓缩历史上下文,避免窗口超限) | ⭐推荐-简易(轻量结构化,区分历史/当前问题) |
| 超长篇文档分析(万字报告/整本书/行业白皮书) | 超长篇文本(>10万字)、Token远超模型窗口、查询为核心结论/整体逻辑 | ✅必用-细粒度(按语义细切分,适配窗口) | ✅必用-逐块筛选(逐块筛选相关内容) | ✅必用-中度(逐块精简,保留核心观点) | ✅必用(为每个细块加标题,提升检索效率) | ✅必用-分块循环(循环推理突破窗口限制,整合结果) | ⭐推荐-逐块增强(逐块增强后整合,保证信息完整) |
| 多文档联合查询(多份合同/技术文档/病历联合解答) | 多文档、内容分散、易冗余/冲突、查询为整合信息需求 | ✅必用-统一标准(按同一规则分块所有文档) | ✅必用-跨文档筛选(跨文档提取相关片段) | ✅必用-合并压缩(合并后去重,精简冗余信息) | ✅必用-统一命名(按统一规则为分块加标题) | ✅必用-核心整合(整合多文档核心信息,避免冲突) | ✅必用-关联版(元数据+结构化+跨文档信息关联) |
| 高精度专业咨询(法律合规/医疗诊疗/金融研报分析) | 专业文档、对准确性/全面性要求极高、查询为深度专业需求(为什么/依据是什么) | ✅必用(按专业逻辑精准分块) | ✅必用-高相似度(高阈值筛选,保证信息相关性) | ⭐推荐-极轻量(仅删无价值内容,最大化保留细节) | ✅必用-专业命名(按专业领域规则加标题) | ⭐推荐-兜底适配(仅在Token超限时使用,最小化处理) | ✅必用-全维度(元数据+结构化+领域知识+关键标注+关联) |
| 短文本精准查询(单条法规/短句技术参数/合同单条款) | 超短文本(<200字)、核心为单一关键信息、查询为精准提取(数值/比例/条款) | ❌排除 | ❌排除 | ❌排除(无冗余内容,避免精简丢失关键信息) | ✅可选-核心标注(标注关键信息类型,如「违约金比例」) | ❌排除 | ⭐推荐-关键标注(仅对核心数字/术语做加粗标注) |
更多推荐

所有评论(0)