今天细致聊聊RAG(检索增强生成):RAG是目前的大模型(LLM)领域里一门常用的技术.可以用来缓解大模型的幻觉问题(大模型的训练的知识都有一个截至日期,超过这个日期的事就不知道了),更多常见的应用是用来部署在企业内部,来解决企业里面一些私有知识的问答.替代Iora微调带来的高成本风险,转而是一种快捷的,便利的,低成本的,安全的方案.RAG技术主要分为两个阶段:离线阶段:这个阶段也是数据的准备阶段.大致过程就是:先是获取各种文档,例如:PDF,HTML等完成加载,然后是将这些文档按照一点过的规则进行切块处理,然后是向量化:使用嵌入(向量)模型将文本转换为高维向量..最后是将文本块及其相应的向量存入专门的向量库.例如Milvus,FAISS等.在线阶段.这里主要是完成文本的检索阶段.大致过程是:先是获取用户的提问,,进行切块处理,然后用相同的嵌入(向量)模型对切块部分进行向量化.最后是去向量库中通过相似度(不同的向量库,用到的是不同的相似度.例如Milvus用到的是余弦相似度,Chroma用到的是欧式距离)找出最关的TOP-K个文本片段.如果配合大模型的话.最后生成的TOP-K个片段连同用户提示词一起投给大模型,大模型基于这个增强版的提示词(这个提示词的部分就是文档里面的专业知识的解析,是大模型没有学到的私有知识或者是一些时效性更强的一些知识,是在大模型训练阶段完成之后的知识.)完成问题的输出部分.另外:在高级 RAG 架构中,还会加入"重排序(Rerank)"机制,对初步检索的结果进行二次打分和过滤,以确保喂给大模型的上下文质量最高.
相关推荐
zandy10111 分钟前
AI办公工具选哪个?千问办公、百度搭子、WorkBuddy三款高阶智能体深度拆解mengpp_1234562 分钟前
AIoT平台 vs 普通IoT平台 核心区别canonical_entropy8 分钟前
可逆不是逆向运行:DeepSeek Harness 架构的数学本质别动我齐刘海44 分钟前
机器人运动控制学习2——基础进阶冬奇Lab1 小时前
Code Agent 解剖(05):模型怎么知道有哪些工具可以用?Function Calling 如何实现?ZGIAI1 小时前
ZGI Workflow:让知识检索进入业务流程ZGIAI1 小时前
ZGI 模型网关:统一接入与路由大模型冬奇Lab1 小时前
开源项目第193期:Semantica — 开源版 Palantir for AI Agent,知识图谱 + 确定性推理 + W3C 溯源,让 AI 决策可追溯、可审计、可合规雷帝木木2 小时前
数据湖与数据仓库:从理论到实践小小测试开发2 小时前
AI Agent 评测确定性:snapshot → fork → act → assert → diff 的状态孪生测试世界