大模型开发实践-milvus向量数据库搭建

Milvus 是一款开源的高性能向量数据库,专门为海量向量数据的存储、检索和分析而设计,是人工智能(AI)和大语言模型(LLM)应用的核心基础设施。简单来说,它解决的是 "如何快速从亿级数据中找到最相似的内容" 这个问题。

一、核心概念:什么是向量?

在 AI 时代,图片、文本、语音等非结构化数据,都会被AI 模型(如 Embedding 模型)

转换成一串数字,这串数字就叫向量 (Vector)。

例如:一张猫的图片 → 模型提取特征 → 生成一个几百维的数组 0.12, 0.88, ...

向量数据库就是用来存放这些数组的 "仓库"。

二、Milvus 解决了什么痛点?

    1. 传统数据库(MySQL、PostgreSQL)擅长处理结构化数据(表格),但做相似度搜索(找最像的)极慢。
      传统方式:全表扫描比对,100 万条数据可能要几分钟。
    1. Milvus 方式:使用近似最近邻(ANN)算法,毫秒级返回结果,支持亿级甚至万亿级数据量

三、windows docker运行Milvus

1.打开powershell 创建目录并进入

复制代码
mkdir D:\milvus
cd D:\milvus 

2.下载 Milvus 单机版 Compose 文件(最新稳定版 v2.6.11)

复制代码
# 下载 Milvus 单机版 Compose 文件(最新稳定版 v2.6.11)
Invoke-WebRequest https://github.com/milvus-io/milvus/releases/download/v2.6.11/milvus-standalone-docker-compose.yml -OutFile docker-compose.yml

3.加入docker镜像源

复制代码
         "https://docker.registry.cyou",
        "https://docker-cf.registry.cyou",
        "https://dockercf.jsdelivr.fyi",
        "https://docker.jsdelivr.fyi",
        "https://dockertest.jsdelivr.fyi",
        "https://mirror.aliyuncs.com",
        "https://dockerproxy.com",
        "https://mirror.baidubce.com",
        "https://docker.m.daocloud.io",
        "https://docker.nju.edu.cn",
        "https://docker.mirrors.sjtug.sjtu.edu.cn",
        "https://docker.mirrors.ustc.edu.cn",
        "https://mirror.iscas.ac.cn",
        "https://docker.rainbond.cc"

4.下载 Milvus 单机版 Compose 文件(最新稳定版 v2.6.11)

复制代码
# 后台启动所有容器(etcd + MinIO + Milvus)
docker compose up -d

等待镜像拉取并启动,成功后会显示:

复制代码
Creating milvus-etcd   ... done
Creating milvus-minio  ... done
Creating milvus-standalone ... done

5.验证服务状态

复制代码
# 查看容器状态(需显示 healthy/Up)
docker compose ps
# 检查端口监听
docker port milvus-standalone 19530

输出 0.0.0.0:19530 表示服务正常。

相关推荐
程序员老猫4 小时前
当 AI 能写 80% 的代码时,后端工程师的核心价值还剩什么?
人工智能
想会飞的蒲公英4 小时前
计算机怎样读取中文文本:编码、清洗与标准化
人工智能·python·自然语言处理
CIO_Alliance4 小时前
AI+iPaaS解决方案深度整合:让跨系统业务流程自动化一步到位
人工智能·ipaas·系统集成·ai+ipaas·企业cio联盟·企业级ai化转型
苏州IT威翰德4 小时前
算力资产“续命”专家:苏州威翰德科技赋能NVIDIA高端AI芯片芯片级维修
大数据·人工智能
天上路人4 小时前
A59P双波束语音模块:神经网络降噪在远场拾音中的工程实现分析
人工智能·深度学习·神经网络·ai降噪·ai语音·麦克风·回音消除
冬奇Lab4 小时前
AI 评测系列(03):LLM-as-Judge——让 LLM 评价 LLM 的正确姿势
人工智能·llm
Miao121315 小时前
某海外住宿平台如何在大规模场景下实现指标一致性:Minerva 指标平台实践
大数据·数据库·人工智能
冬奇Lab5 小时前
每日一个开源项目(第164篇):毕昇(BISHENG)- 面向企业的开源 LLM DevOps 平台
人工智能·开源·agent
声讯电子5 小时前
录音笔AI降噪方案:从录得到到听得清的听觉革命
人工智能·语音识别
小小测试开发5 小时前
Playwright vs Selenium vs Cypress:从浏览器协议到 API 设计的全面对比与实测
人工智能·selenium·测试工具