milvus

简介

区别mysql,前者使用标量数据做索引,milvus使用向量作为索引。其他都和mysql差不多

支持单机部署和集群部署

生产环境一般集群部署

关键概念

互联网上80%往上都是非结构化

补充:实体对应mysql中的行

名称对比

索引

MySQL的索引存磁盘,milvus为了加速查询,索引放内存,所以有了一些省内存的索引方式

mysql可以选择进行是否使用索引,milvus不使用索引工作不了

FLAT就是遍历,精度高,内存消耗大

IVF_FLAT(生产级):

就是先kmeans聚类,指定相似度的最高的n个簇,只查这几个簇里的内容

IVF_SQ8 : 在IVF_FLAT基础上把向量转标量,节省内存,降低精度

**IVF_PQ : **更加省内存,基本不用

**HNSW:**也是生产级的索引方式,基于图的方式,效率很高,原理复杂,本质是拿内存换时间

相似度度量

第一个注重数值,多用于人脸识别

第三个注重方向,多用于情感分类

第二个综合,什么都干

CRUD

不同于mysql可以用sql语句操作,milvus全得靠代码手搓

增删改不必说,和mysql差不多

简单查询本质上只做3件事:

  1. 算距离 向量相似度计算,由索引加速(ANNs算法);
  2. 划范围 通过 limitradiuspartition 缩小搜索圈;
  3. **加条件 ** 通过 filteroutput_fields 做数据过滤与提取。

复杂查询----使用混合索引

在实际业务中,一条数据可能包含多个向量字段 (例如:一个商品既有"图片向量",又有"文字描述向量")。当你搜索时,可能希望同时考虑这两个维度的相似性,而不是只看其中一个。

混合检索的流程是:

  1. 分别执行多次 ANN 搜索:对每个向量字段进行一次独立的 Top-K 搜索(例如图片向量搜出 100 个结果,文字向量也搜出 100 个)。
  2. 重排序(Merge & Rerank):将这两组结果合并,使用一种策略重新打分,最终返回你最想要的 Top-N 个结果。

这种合并过程的关键在于"如何给每个结果综合评分"。Milvus 提供了两种内置策略:

你最想要的 Top-N 个结果。

这种合并过程的关键在于"如何给每个结果综合评分"。Milvus 提供了两种内置策略:

外链图片转存中...(img-GfXmtfMy-1784797868676)

相关推荐
circuitsosk4 天前
向量数据库选型与性能压测:Milvus、Pinecone、Chroma在真实业务下的对比
数据库·python·pinecone·milvus·向量数据库·chroma
码云骑士5 天前
97-Milvus从零到生产-Standalone-vs-Cluster-索引选择-分片监控扩容
python·milvus
初圣魔门首席弟子6 天前
Milvus 向量数据库:AI 时代的“记忆引擎”与新手实战指南
数据库·人工智能·milvus
人工智能培训8 天前
向量数据库 Milvus 使用方法:从理论到实战
milvus
今天AI了吗9 天前
【AI智能体】Hermes Agent 从部署到项目实战操作详解
java·人工智能·python·milvus
IT小盘11 天前
08-向量数据库选型-Chroma-FAISS-Milvus-pgvector
数据库·人工智能·milvus·faiss
安_11 天前
如何为 RAG 项目选择向量数据库?Milvus、Pinecone、Chroma 怎么选?
数据库·milvus
知行合一。。。12 天前
LangChain--11--Milvus
langchain·milvus
二进制_博客12 天前
Milvus-lite的使用
milvus
tqs_1234513 天前
Agent智能体+Skill插件引擎+Milvus混合检索 技术沉淀
java·python·milvus