技术栈
向量数据库
做个文艺程序员
21 小时前
minio
·
向量数据库
·
ai大模型
·
rag
·
springai
·
pgvector
MinIO第07篇:基于MinIO + Spring AI + pgvector构建RAG知识库(Java全栈实战)
系列导读:前六篇我们完成了从架构认知、Spring Boot集成、大文件分片上传、多租户隔离、事件驱动架构到分布式部署的完整链路。这一篇是系列的收官之作,我们将把MinIO从“文件存储工具”升级为“AI数据底座”——用Spring Boot 3 + Spring AI + MinIO + PostgreSQL/pgvector构建一个完整的RAG(检索增强生成)知识库系统。
光依旧
7 天前
docker
·
langchain
·
大模型
·
向量数据库
·
pdf解析
·
rag
·
pageindex
PageIndex没翻车,翻车的是我的解析器
测试日期:2026-10-02 测试环境:Docker+PageIndex Cloud SDK+FAISS+PyMuPDF+硅基流动API 测试文档:腾讯控股2024年度年报(274页,繁体PDF)
森山冶仁
7 天前
数据治理
·
向量数据库
·
数据质量
·
元数据
·
rag
向量索引也要治理:RAG 系统里“原始数据已作废、向量仍可检索”怎么解
RAG 上线后最典型的失效不是模型答错,而是检索层悄悄失效:原文改了向量没改,原文删了向量还在,索引漂移无人发现。本文把向量索引当作一类受管数据资产,拆出索引生命周期、向量权限合规、检索质量闭环三大工作项,给出六张可直接套用的清单与巡检表。
Alice-YUE
8 天前
数据库
·
milvus
·
向量数据库
·
chroma
·
rag
·
qdrant
向量数据库选型实战:Chroma/Qdrant/Milvus/PgVector 怎么选
**一句话讲清楚:**RAG、Agent记忆、推荐系统背后都靠向量数据库做语义检索。但Chroma、Qdrant、Milvus、Redis Vector、PgVector到底怎么选?这篇从原理到选型逻辑一次讲透。
自传.
8 天前
软考高级
·
向量数据库
·
六边形架构
·
软考系统架构师
·
系统架构师论文
·
2026真题
·
论文实战
软考系统架构师|论文篇 3+4|2026 两道真题实战|向量数据库 & 六边形架构
软考高级系统架构师论文,最大的备考秘诀不是背多篇完整范文,而是掌握一稿多套。 同一份项目底稿,大部分内容直接默写,考场上只需要替换少量主题段落,就能适配不同考题。本次一次性更新论文篇 3、4 两集,拆解 2026 上半年两道真题,完整演示这套考场实战方法。
智码看视界
9 天前
flink
·
向量数据库
·
rag
·
全栈开发
·
edgeai
·
iot诊断
Edge AI 全栈实战 ④:向量数据库 + RAG 让 IoT 诊断拥有“记忆“
① 篇:ESP32 → MQTT → 云端(能通) ② 篇:ESP32 → MQTT → Flink → 实时管道 + 异常检测(生产级) ③ 篇:② + 异常时调 LLM 生成诊断(会思考) ④ 篇:③ + 向量库存历史诊断,检索增强(有记忆) ← 本篇
温暖小土
9 天前
centos
·
ai编程
·
milvus
·
向量数据库
CentOS 部署 Milvus 向量数据库完整指南
在开始安装 Milvus 之前,请确认你的 CentOS 系统满足以下最低要求:提示: Milvus Standalone 模式适合开发、测试及中小规模生产环境。如果数据量超过 1000 万向量,建议使用 Cluster 集群模式部署。
深海鱼肝油ya
19 天前
人工智能
·
elasticsearch
·
向量数据库
·
es搜索文档
·
只能体
·
非结构化数据库
向量数据库Elasticsearch(四)搜索文档——各种方式
目录一.创建索引&添加数据二.搜索方式1.match_all2.match3.range4.match_phrase
深海鱼肝油ya
21 天前
人工智能
·
elasticsearch
·
kibana
·
向量数据库
·
文档操作
·
索引操作
·
域的属性
向量数据库Elasticsearch(二)介绍&安装&常用操作
目录一.Elasticsearch介绍_全文检索二.Elasticsearch介绍_正排索引&倒排索引
hey you~
24 天前
向量数据库
·
openapi
·
接口开发
·
幂等设计
·
云客服机器人
·
知识库批量导入
·
批量导入api
云客服机器人知识库批量导入,接口开发实操方案
云客服机器人知识库批量导入的接口开发,核心是设计一套支持批量提交、分片上传、异步处理、状态查询、失败重试、幂等校验和向量化索引更新的 API 体系。常见方案采用 RESTful API + 消息队列 + 异步 Worker 架构,客户端将知识条目按批次或分片提交,服务端校验后写入任务表,由 Worker 完成解析、切分、向量化和向量数据库写入,最后通过回调或轮询返回导入结果。本文给出 OpenAPI 规范、数据格式、数据库设计、异步任务、幂等与重试、向量化流程、多语言 SDK 示例、压测数据、成本模型和故
java_logo
25 天前
数据库
·
docker
·
私有化部署
·
milvus
·
向量数据库
·
rag
·
轩辕镜像
Docker 部署 Milvus:轻松搭建高性能向量数据库平台
本文基于 openeuler/milvus:2.6.0-oe2403sp2,跟做标签 2.6.0-oe2403sp2(Milvus 2.6.0 / openEuler 24.03-LTS-SP2),客户端实测 pymilvus 3.0.1,测试平台 Ubuntu 24.04 Linux。
虎虎(_ _)。゜zzZ
1 个月前
数据库
·
人工智能
·
大模型
·
向量数据库
·
rag
·
qdrant
Qdrant向量数据库工程实战
做 RAG 检索增强生成,向量库是绕不开的一环。市面上选择不少——Chroma 轻量但扛不住并发,Milvus 功能全但部署重,pgvector 复用 PostgreSQL 但检索性能有天花板。
深海鱼肝油ya
1 个月前
人工智能
·
elasticsearch
·
向量数据库
·
es数据库增加索引
·
es数据库相似度查询
·
knn查询
向量数据库Elasticsearch(一)
目录一.什么是向量数据库二.Elasticsearch数据库初识三.Elasticsearch数据库安装
Rolei_zl
1 个月前
aigc
·
向量数据库
AIGC(生成式AI)试用 57 -- 向量数据库
不追其理,不求甚解,应用为主,但求应用于实际。遗留问题:文本切分的原则是什么?什么是有效招回?如何有效切分长文本存入向量数据库?
circuitsosk
1 个月前
数据库
·
python
·
oracle
·
向量数据库
·
rag
·
多模检索
从零搭建行业知识平台:向量库+图数据库+传统关系库的多模检索统一层设计
我在为一家大型制造企业搭建知识平台时,被业务方提了一个"简单"的需求:“把我们几十年的设备维修知识做成一个系统,工程师问什么,它就能答什么。”
数据库小学妹
1 个月前
人工智能
·
架构
·
向量数据库
·
ai数据库
·
数据库趋势
·
ai agent记忆
AI Agent记忆怎么存?Redis+向量库三层记忆架构实战
大家好,我是数据库小学妹👋 我踩过的坑,你别再踩。上个月帮一个客服产品团队调Agent,碰到一个挺典型的例子。用户头天晚上留过一句话:"我是会员,短信通知关了,只留邮件。"结果第二天Agent一上来,张口就问:"请问需要短信通知吗?"用户当场就炸了,工单里骂了整整五分钟。
viskaz
1 个月前
近邻算法
·
向量数据库
2-向量数据库:主流近似最近邻算法(ANN)原理
在向量数据库中,如果要遍历整个数据库进行精确对比(KNN,K-Nearest Neighbors),计算量太大且在海量数据下极度耗时。因此,向量数据库通常采用近似最近邻算法(ANN, Approximate Nearest Neighbor),通过牺牲微小的精确度前提,跨越式提升查询速度并降低内存开销。
ryan_996
1 个月前
数据库
·
elasticsearch
·
milvus
·
向量数据库
·
chroma
·
qdrant
生产环境向量检索数据库选型:Elasticsearch、Qdrant、Milvus 与 Chroma
这篇笔记抛开具体 RAG 框架,回答以下问题:本文主要讨论自建或托管形态下的检索引擎选择,不把某个产品的官方规模区间、单次 Benchmark 或默认参数当成普遍结论。
孙启超
2 个月前
人工智能
·
缓存
·
llm
·
向量数据库
·
bm25
·
向量化
·
ai应用开发
【AI应用开发】什么是混合检索(Hybrid Search)?向量检索 + BM25 关键词检索,适用场景与 RRF 融合原理
混合检索(Hybrid Search)= 向量检索(语义匹配)+ BM25 关键词检索(精确匹配),通过 RRF 等融合算法合并两路结果,取两者之长补各自之短。