大模型学习·第44天:Chroma向量数据库与RAG链式组装

一、Chroma 向量数据库

InMemoryVectorStore 存在内存中,重启程序就没了。Chroma 是轻量级外部向量数据库,数据持久化到磁盘,重启后依然可用。

bash 复制代码
pip install langchain-chroma chromadb
python 复制代码
from langchain_chroma import Chroma

vector_store = Chroma(
    collection_name="text",              # 类似数据库表名
    embedding_function=DashScopeEmbeddings(),
    persist_directory="./chroma_db"      # 数据持久化到本地文件夹
)

# 增删检索,和 InMemoryVectorStore 完全一样
vector_store.add_documents(documents=docs, ids=["id1", "id2"])
vector_store.delete(["id1", "id2"])
result = vector_store.similarity_search("查询", k=3, filter={"source": "黑马程序员"})

对比InMemoryVectorStore 适合学习和临时测试,Chroma 适合需要持久化的项目。两者接口完全一致,切换只需改创建代码。filter 参数支持按 metadata 字段过滤。

二、RAG 完整流程:检索 + 构建提示词 + 生成

python 复制代码
# 1. 准备向量库数据
vector_store.add_texts(["减肥就是要少吃多练", "控制卡路里摄入并运动起来", "跑步是很好的运动"])

# 2. 用户提问 → 检索相关文档
result = vector_store.similarity_search("怎么减肥?", k=2)

# 3. 拼接参考资料
reference_text = "[" + "".join([doc.page_content for doc in result]) + "]"

# 4. 构建提示词模板
prompt = ChatPromptTemplate.from_messages([
    ("system", "以参考资料为主,简洁专业回答。参考资料:{context}"),
    ("user", "用户提问:{input}")
])

# 5. 链式调用
chain = prompt | model | StrOutputParser()
res = chain.invoke({"input": input_text, "context": reference_text})

RAG 本质:用户提问 → 向量检索匹配资料 → 资料 + 问题一同填入提示词 → 模型基于资料生成答案。整个流程的核心就是在向模型提问之前,先检索知识库确保信息精准。

三、RunnablePassthrough:自动传递数据

RunnablePassthrough 在链中起到"透传"作用------接收什么就原样传下去,主要用于在链式调用中传递用户原始输入,同时并行调用检索器获取上下文。

python 复制代码
from langchain_core.runnables import RunnablePassthrough

retriever = vector_store.as_retriever(search_kwargs={"k": 2})

chain = (
    {"input": RunnablePassthrough(), "context": retriever | format_func}
    | prompt | model | StrOutputParser()
)

res = chain.invoke("怎么减肥?")

数据流详解

  • RunnablePassthrough() 把用户提问原样传入 {"input": ..., "context": ...}
  • retriever 输入是用户提问(字符串),输出是 list[Document]
  • format_funclist[Document] 转成拼接好的字符串
  • prompt 接收 {"input": str, "context": str},输出完整提示词

核心优势 :不需要手动调用 invoke 传参,链会自动把数据流转到正确的位置。

四、as_retriever 方法

vector_store.as_retriever() 把向量存储转成检索器(Runnable接口子类),可以直接加入链。参数 search_kwargs={"k": 2} 指定检索返回前2个最相似文档。

今日核心总结

  1. Chroma :轻量级持久化向量数据库,与 InMemoryVectorStore 接口一致,切换只需改创建代码
  2. RAG 流程:用户提问 → 向量检索 → 拼接参考资料 → 填入提示词 → 模型生成答案
  3. as_retriever:把向量存储转为检索器对象,可直接加入 Chain
  4. RunnablePassthrough:透传用户输入,配合检索器并行获取上下文
  5. 数据流 :retriever 输入 str 输出 list[Document] → format_func 转为 str → prompt 接收 dict → 模型生成
相关推荐
毛驴赶鹿8 小时前
【金仓数据库征文】KES V9性能调优实战记录:从慢SQL排查到全链路优化
数据库·sql
码农阿豪8 小时前
【金仓数据库征文】Mac开发环境|SpringBoot3 + MyBatisPlus对接KES V9 Docker实战全指南
数据库·macos·docker
杨云龙UP9 小时前
MySQL 数据库常用备份工具对比:mysqldump、mydumper 与 XtraBackup
linux·运维·服务器·数据库·mysql·dba·备份恢复
ZENERGY-众壹9 小时前
500个工商业电站压垮数据库?海量光伏时序数据存储的架构取舍
数据库·架构·influxdb·光伏·光伏运维
mubei-12310 小时前
SpringDAO的用法
java·开发语言·数据库
星蓝_starblue12 小时前
零服务器、零数据库!开源growth-board,利用GitHub自动管理刷题/学习/求职全流程
服务器·数据库·程序人生·系统架构·node.js·github·改行学it
咸鱼翻身小阿橙14 小时前
现在这个四通道出现的问题
学习
三84414 小时前
sqli-labs1-10通关笔记
数据库
云贝教育-郑老师15 小时前
OceanBase 是如何搞定海量数据分片(Sharding)的?
学习·oceanbase·dba