RAG工作流程的执行时机

RAG工作流程的执行时机如下:

  1. 文档加载和向量存储(前两步):

    • 这部分是在项目启动时或首次创建VectorStoreService实例时处理的
    • VectorStoreService类的load_document方法会:
      • 从数据文件夹读取文档
      • 分割成小块
      • 使用嵌入模型将文本转换为向量
      • 存储到向量数据库中
      • 计算文件MD5值进行去重,避免重复加载
  2. 用户查询处理(后四步):

    • 这部分是在用户发送请求时处理的
    • 当用户提问时,系统会:
      • 将问题转换为向量
      • 在向量空间中检索最相似的文档片段
      • 将检索到的文档作为上下文传递给大语言模型
      • 模型基于上下文生成准确的回答

执行流程

  1. 项目启动时,VectorStoreService会加载数据文件夹中的文档并处理为向量
  2. 用户发送查询时,RagSummarizeService会调用检索器获取相关文档
  3. 将检索到的文档与用户查询一起传递给模型
  4. 模型生成基于上下文的回答

这种设计使得系统在启动时完成了耗时的文档处理工作,而在用户查询时能够快速响应,提高了系统的性能和用户体验。

相关推荐
Easy_API6 分钟前
从“有多少卡“到“卖多少 Token“:算力的标尺正在换
大数据·人工智能·深度学习
零依赖极客15 分钟前
Day 6·1 ARMv8.2 dotprod——vdotq_s32 一条指令做 4 个点积
c语言·开发语言·人工智能·矩阵·arm·vllm
xsd2024111833 分钟前
Seedance 2导演Skill开源:让AI Agent变身视频创意总监
人工智能
冬奇Lab1 小时前
DeepSeek Harness 系列(05):Session 与记忆——对话历史是怎么活下来的
人工智能
DogDaoDao1 小时前
SimToolReal 解读:用“物体中心“视角重新定义灵巧工具操作
人工智能·机器人·github·关键点·人形机器人·gpt-4o·simtoolreal
冬奇Lab1 小时前
一天一个开源项目(第216篇):OpenViking - 给 AI Agent 装上可自进化的上下文数据库
人工智能·开源·资讯
一切皆是因缘际会1 小时前
从存量释放
人工智能
Xuantong_901 小时前
从 0 到 1 搭建本地 AI 工作环境:我的完整方案与经验总结
人工智能
晓窗科技1 小时前
口碑好的AI基座服务商
大数据·人工智能·python
一航jason1 小时前
Android平台推理框架及试用场景模型对比
android·人工智能·ai·架构·ai编程·llama