RAG 架构全景:从检索增强生成到 Agentic RAG 的生产实践
RAG(检索增强生成)已成为大语言模型接入私有知识库的主流范式,但朴素 RAG 在召回率、相关性排序与评估层面存在系统性短板。本文系统讲解 RAG 架构全景:文档切分与索引策略、查询路由与改写、混合检索(稀疏+密集+BM25)、Cross-Encoder Reranker 重排序、生成阶段上下文组装,以及基于 RAGAS 的评估体系与 Agentic RAG 的生产调优。
tag
RAG(检索增强生成)已成为大语言模型接入私有知识库的主流范式,但朴素 RAG 在召回率、相关性排序与评估层面存在系统性短板。本文系统讲解 RAG 架构全景:文档切分与索引策略、查询路由与改写、混合检索(稀疏+密集+BM25)、Cross-Encoder Reranker 重排序、生成阶段上下文组装,以及基于 RAGAS 的评估体系与 Agentic RAG 的生产调优。
LLM 应用上线后的最大风险不是"跑不起来",而是"悄悄变差"——模型升级、Prompt 改动、知识库更新都可能引入质量回归,而概率性输出让这种退化难以用传统测试发现。LLMOps 的核心是建立评估(Evaluation)与监控(Monitoring)的闭环: …
传统的测试方法论建立在确定性之上:同样的输入必然得到同样的输出,断言 assert x == y 是质量的黄金标准。但以 LLM 为代表的生成式 AI 模型打破了这一前提——同样的 prompt 每次调用可能返回不同的、且没有唯一正确答案的文本。assert response == …