大模型学习·第44天:Chroma向量数据库与RAG链式组装

一、Chroma 向量数据库

InMemoryVectorStore 存在内存中,重启程序就没了。Chroma 是轻量级外部向量数据库,数据持久化到磁盘,重启后依然可用。

bash 复制代码
pip install langchain-chroma chromadb
python 复制代码
from langchain_chroma import Chroma

vector_store = Chroma(
    collection_name="text",              # 类似数据库表名
    embedding_function=DashScopeEmbeddings(),
    persist_directory="./chroma_db"      # 数据持久化到本地文件夹
)

# 增删检索,和 InMemoryVectorStore 完全一样
vector_store.add_documents(documents=docs, ids=["id1", "id2"])
vector_store.delete(["id1", "id2"])
result = vector_store.similarity_search("查询", k=3, filter={"source": "黑马程序员"})

对比InMemoryVectorStore 适合学习和临时测试,Chroma 适合需要持久化的项目。两者接口完全一致,切换只需改创建代码。filter 参数支持按 metadata 字段过滤。

二、RAG 完整流程:检索 + 构建提示词 + 生成

python 复制代码
# 1. 准备向量库数据
vector_store.add_texts(["减肥就是要少吃多练", "控制卡路里摄入并运动起来", "跑步是很好的运动"])

# 2. 用户提问 → 检索相关文档
result = vector_store.similarity_search("怎么减肥?", k=2)

# 3. 拼接参考资料
reference_text = "[" + "".join([doc.page_content for doc in result]) + "]"

# 4. 构建提示词模板
prompt = ChatPromptTemplate.from_messages([
    ("system", "以参考资料为主,简洁专业回答。参考资料:{context}"),
    ("user", "用户提问:{input}")
])

# 5. 链式调用
chain = prompt | model | StrOutputParser()
res = chain.invoke({"input": input_text, "context": reference_text})

RAG 本质:用户提问 → 向量检索匹配资料 → 资料 + 问题一同填入提示词 → 模型基于资料生成答案。整个流程的核心就是在向模型提问之前,先检索知识库确保信息精准。

三、RunnablePassthrough:自动传递数据

RunnablePassthrough 在链中起到"透传"作用------接收什么就原样传下去,主要用于在链式调用中传递用户原始输入,同时并行调用检索器获取上下文。

python 复制代码
from langchain_core.runnables import RunnablePassthrough

retriever = vector_store.as_retriever(search_kwargs={"k": 2})

chain = (
    {"input": RunnablePassthrough(), "context": retriever | format_func}
    | prompt | model | StrOutputParser()
)

res = chain.invoke("怎么减肥?")

数据流详解

  • RunnablePassthrough() 把用户提问原样传入 {"input": ..., "context": ...}
  • retriever 输入是用户提问(字符串),输出是 list[Document]
  • format_funclist[Document] 转成拼接好的字符串
  • prompt 接收 {"input": str, "context": str},输出完整提示词

核心优势 :不需要手动调用 invoke 传参,链会自动把数据流转到正确的位置。

四、as_retriever 方法

vector_store.as_retriever() 把向量存储转成检索器(Runnable接口子类),可以直接加入链。参数 search_kwargs={"k": 2} 指定检索返回前2个最相似文档。

今日核心总结

  1. Chroma :轻量级持久化向量数据库,与 InMemoryVectorStore 接口一致,切换只需改创建代码
  2. RAG 流程:用户提问 → 向量检索 → 拼接参考资料 → 填入提示词 → 模型生成答案
  3. as_retriever:把向量存储转为检索器对象,可直接加入 Chain
  4. RunnablePassthrough:透传用户输入,配合检索器并行获取上下文
  5. 数据流 :retriever 输入 str 输出 list[Document] → format_func 转为 str → prompt 接收 dict → 模型生成
相关推荐
考虑考虑12 小时前
数据库中的EXISTS
运维·数据库·后端
Wang's Blog12 小时前
Java框架快速入门: Spring Security+OAuth2之数据库和实体类的RBAC改造
java·数据库·spring
M78佐菲13 小时前
51单片机学习笔记:ds18b20要点整理
linux·笔记·嵌入式硬件·学习·51单片机
高亦真13 小时前
今天是学习嵌入式的第37天
linux·学习·算法
梦想平凡13 小时前
百游棋牌源代码开发搭建教程(十):隔离部署、备份恢复与双端验收
java·前端·javascript·数据库·源代码管理
xcLeigh14 小时前
让大模型长出手脚,自己写SQL查数据库(Function Calling初探)
数据库·人工智能·sql·时序数据库·timechoai
yume_sibai15 小时前
06-Rust Web 开发实战(Axum 框架 + 数据库 + JWT 认证 + 中间件 + 部署)
前端·数据库·rust
AugustRed16 小时前
Neo4j 图数据库原理 + 应用场景简单介绍
数据库·neo4j
Gl�ria16 小时前
Redis 高可用架构对比
数据库·redis
泡泡鱼(敲代码中)16 小时前
Python 字符串 str 完整学习笔记
python·学习