-
RAG 是什么:检索增强生成,给大模型「开卷考试」,让它的回答基于真实文档
-
工作流程:分索引阶段(离线建库)和查询阶段(在线检索+生成)
-
微调 vs RAG:微调是「内化知识」,RAG 是「外挂参考书」,两者互补
-
文档切割:从固定大小到语义切割,推荐先用递归字符切割起步
-
Re-rank:用 Cross-Encoder 对检索结果做精排,准确率提升 30-50%
-
Embedding:从 Word2Vec 到 BERT 再到 BGE-M3,技术不断演进
-
向量数据库:Milvus、Pinecone、Weaviate 等各有侧重,按需选型
-
多路召回:向量检索 + BM25 混合检索,效果比单路好 10-30%
-
效果量化:用 RAGAS 等框架评估 Faithfulness、Relevance 等核心指标
-
大模型幻觉:RAG 是降低幻觉的核心手段,但不能完全消除,需要组合策略
关于 RAG 的十个核心问题
天地沧海2026-04-15 15:38
相关推荐
蜡台7 分钟前
大模型算力下放客户端:浏览器/本地设备全落地方案解析冬奇Lab16 分钟前
开源项目第191期:gstack — YC CEO Garry Tan 开源的 AI 虚拟工程团队,23 个专家角色 slash command,从产品构思到上线发布的完整研发流程冬奇Lab34 分钟前
企业知识库系列(03):图增强 RAG 实测——GraphRAG vs HippoRAGMomentYY37 分钟前
RAG 索引维护:文档改了,知识库要不要重建?土星云SaturnCloud37 分钟前
产线SOP动作级AI监管方案:土星云SE110S-WC8赋能合规识别、预警与效率分析乐之者v2 小时前
AI人工智能--DeepSeek Harness的安装ai产品老杨2 小时前
边缘计算盒子部署常见问题和排查清单问天_观心2 小时前
零基础在windows环境下的WSL使用llamafactory(二)牛企老板俱乐部2 小时前
广东机器人结构验证手板产业格局:深圳珠海东莞三城分析