🧭 向量空间中的语义距离
🔴 红点 = 用户 Query 🟢 绿点 = 命中的文档 🔵 蓝点 = 未命中
🎯 面试速答:一句话讲清 RAG
Q:RAG 的完整流程是什么?
离线阶段把文档分块、向量化、存入向量库;在线阶段把用户提问向量化,在向量库中检索 Top-K
相似文档,可选重排,把检索结果拼进 Prompt 交给大模型生成答案。
Q:RAG 相比微调有什么优势?
知识更新快(改文档即可,无需重训)、成本低、可溯源(能给出引用来源)、减少幻觉。适合知识频繁变化的场景;微调适合改变模型风格和能力。
Q:如何提升 RAG 检索准确率?
① 分块策略优化(语义分块、重叠窗口);② 混合检索(向量 + BM25 关键词);③ 重排模型(Cross-Encoder
精排);④ Query 改写/扩展;⑤ 元数据过滤。
Q:RAG 常见问题有哪些?
检索不到相关内容、检索到无关内容、上下文超长被截断、多跳推理失败、答案与检索内容矛盾。对应方案:Query
改写、重排、上下文压缩、多轮检索、引用约束。