rag

甜辣uu5 小时前
人工智能·性能优化·大模型·llm·agent·rag·智能体
智能体Agent性能优化从原理到实战文章定位:CSDN爆款技术博文,面向大模型应用开发者、算法工程师、Agent落地从业者;覆盖RAG优化、提示词工程、工具调用、记忆机制、多智能体协作、成本延迟优化、评测体系七大维度,附完整可运行代码与踩坑总结。复制全部内容保存为.md直接粘贴CSDN编辑器即可发布,图片位置标记【图X:xxx】,用Mermaid或AI绘图生成对应图插入即可。
云烟成雨TD8 小时前
ai·agent·rag·llamaindex
LlamaIndex 系列【21】语义检索(Semantic Search)BM25、TF‑IDF 都属于关键词检索(词法检索),只做字面词汇匹配:关键词检索只在乎单词是否出现过,并不读懂文字背后真正的语义。想要解决这个短板,就要依靠语义检索。
云烟成雨TD9 小时前
ai·agent·rag·llamaindex
LlamaIndex 系列【20】关键词检索(Keyword Search):BM 25 算法BM25 是生产环境标准关键词检索算法,ElasticSearch 默认的关键字检索算法是就是 ‌BM25‌(Best Matching 25),从 5.x 版本开始取代了早期的 TF-IDF,成为默认的相关性评分算法。‌‌
ShallWeL12 小时前
人工智能·agent·知识库·工作流·rag
RAG 向量索引重建与回归摘要:《RAG 关键词检索与向量检索的切换边界》给出了切换建议,《RAG 文档更新后的全链路闸门验收》把五段闸门串成发布流水线。真正启用向量检索后,文档与扩展表一变,旧索引包仍在线上服务,变体问法会悄悄退步。本文说明如何把向量索引做成可版本化的索引包:写入文档指纹与扩展表指纹、检测漂移、重建后做原话层与变体层回归,并用闸门输出 VECTOR_INDEX_ALLOWED 或 VECTOR_INDEX_BLOCKED;标准库即可跑通。
虎虎(_ _)。゜zzZ1 天前
数据库·人工智能·大模型·向量数据库·rag·qdrant
Qdrant向量数据库工程实战做 RAG 检索增强生成,向量库是绕不开的一环。市面上选择不少——Chroma 轻量但扛不住并发,Milvus 功能全但部署重,pgvector 复用 PostgreSQL 但检索性能有天花板。
森山冶仁1 天前
人工智能·智能问答·rag·企业知识库·大模型落地·ai治理
治理知识库构建:用 RAG 把制度、文档、经验变成 AI 能力绝大多数企业的治理能力,都死在「文档堆积、经验流失、制度没人看、规范没人懂」。企业沉淀了海量制度文件、治理规范、数据标准、操作手册、复盘经验,但全部躺在网盘、Wiki、共享文件夹里,无法检索、无法落地、无法赋能业务。
云烟成雨TD2 天前
ai·agent·rag·llamaindex
LlamaIndex 系列【14】数据接入流水线(IngestionPipeline)数据接入流水线(IngestionPipeline)是指 LlamaIndex 中专门用来把原始文档变成可检索 Node 的一站式处理链路。
武哥聊编程3 天前
springboot·rag·pgvector·langchain4j
【AI实战项目】基于LangChain4j+Springboot+Vue+RAG+PGVector的AI智能客服与工单处理系统该项目资料获取请点击上方⬆️卡片,然后进入【AI实战库】板块即可搜索到。B站演示视频 https://www.bilibili.com/video/BV1pEhV64ERV
circuitsosk3 天前
python·知识库问答·rag·面试项目·ai工程化·混合检索
企业知识库 RAG 从 62% 到 91%:分块策略、混合检索与重排序的调优全记录之前面试时我发现一个尴尬的事实:会调 ChatGPT API 的人太多了,但能把自己做过的项目讲出"实验—对比—结论"的人很少。面试官最爱问的一句话是:“你这个准确率是怎么来的?提升是靠感觉还是靠实验?”
寻道码路3 天前
大模型·agent·rag·json schema·ai工程化·llmops`
大模型工程化实战(七):JSON Schema 强约束——模型吐的 json 不合规?schema 校验不通过,重试、兜底、降级一条龙客服 AI 念身份证的事过去一周,脱敏闸挂上了,泄露是不泄露了。可上线第四周,数据组来拍桌子:模型把“金额”吐成字符串 “¥1,234”(schema 要的是 number),“是否退款”整个字段丢了,还自作主张加了个 schema 里根本没有的“运费”。下游 json.loads 直接崩,pandas 读出来一片 NaN。
weixin_440213294 天前
agent·pdf解析·rag·检索增强生成
Agent‑RAG 处理复杂 PDF:从 Demo 走向生产级摘要:在 RAG 项目开发中,直接把 PDF 转纯文本再切片,是 Demo 级别的简单做法。面对真实业务 PDF:多栏排版、表格、扫描件、图表、合同层级页眉页脚,简单文本切片会带来上下文断裂、表格信息损坏、无法溯源等一系列问题。本文梳理工业界 Agent+RAG 处理 PDF 的四层架构,讲清楚生产环境 PDF RAG 完整落地思路,同时说明如何规避大模型幻觉问题。
beyond谚语4 天前
langchain·rag·ollama
六、LangChain——StrOutputParser和JsonOutputParser以第一次模型的输出结果,拿去第二次询问模型现在需要:chain = prompt | model | model,参与链的构建的组件完全符合要求,但运行会报错 ValueError: Invalid input type <class 'langchain_core.messages.ai.AIMessageChunk'>. Must be a PromptValue, str, or list of BaseMessages.
像风一样自由20205 天前
人工智能·postgresql·大模型·milvus·rag·智能体
17.Milvus如何完成一次向量相似度检索码海寻道 · 大模型、智能体与 RAG 工程组件系列第 17 篇在 RAG 项目里,“向量检索”经常被一句 search() 代码带过。但要真正排查召回为空、结果不准和延迟升高,必须理解一次检索内部发生了什么。
YoanAILab5 天前
语言模型·transformer·embedding·token·rag
大语言模型基础:Token、Embedding、Transformer、KV Cache 与 RAG理解大语言模型,可以先记住两条主线:大语言模型并不是直接以“汉字”或者“英文单词”为单位处理文本,而是先通过 Tokenizer(分词器) 将文本切分成一个个 Token。
像风一样自由20205 天前
postgresql·大模型·milvus·rag·智能体
19.Milvus数据分片扩展与高并发设计码海寻道 · 大模型、智能体与 RAG 工程组件系列第 19 篇当 Milvus 从单机开发环境进入生产环境,问题会从“能不能检索”变成“高峰期能不能稳定检索”。这时需要理解三个概念:数据如何分布、组件如何扩展、查询资源如何隔离。
Feynman’s boom6 天前
python·pdf解析·rag
PDF解析文字提取后RAG仍然检索不准刚开始做企业法律 RAG 时,我对 PDF 解析的要求并不高。只要 PyMuPDF 能正常打开文件,get_text() 能把正文抽出来,我就觉得最难的一步已经过去了。真正开始检查合同、法条和工程类法律文件以后,我才发现这个判断完全错了:PDF 最麻烦的地方从来不是“有没有文字”,而是“这些文字原来属于什么结构”。
ShallWeL6 天前
agent·知识库·rag·智能体
RAG 命中后的引用格式与拒答规则摘要:本地知识库把检索 hit@3 做上去之后,下一层翻车常出现在对外回复:模型说得很顺,却说不出依据哪份文档;或者证据不够,仍然硬答。本文给出可执行的回答信封:命中时强制带 doc_id、chunk_id 与原文片段;未命中或分数过低时输出 REFUSE 并写明原因。沿用支付回调、登录接口、Orin 发布三份示例文档,本机用标准库脚本即可跑通。
软件聚导航7 天前
前端·数据库·mysql·微信小程序·小程序·ai编程·rag
「聚小软 AI 助手」技术升级:从数据库检索到 RAG 知识库问答前言各位小伙伴大家好,「软件聚导航 AI 助手」今天完成了一次重要升级--接入 RAG(检索增强生成),让它开始真正认识「软件聚导航」本身。
玉&心7 天前
ai·springboot·graalvm·rag
GraalVM 21 Native Image 编译踩坑全记录:从 class 初始化冲突到成功构建Spring Boot 3.x 智能客服项目,集成了 Nacos(配置中心/服务注册)、Milvus(向量数据库)、Logback(日志)、MyBatis-Plus、Elasticsearch、Redis 等组件。配置了 Maven 双 Profile(JVM / Native)支持 GraalVM AOT 编译。
水管在开花.7 天前
人工智能·agent·rag
Agent范式与LangGraph④-零基础保姆级教程现在图把它抬升了一层:updates 流"步骤"、messages 流"字"——真实产品往往两者组合(前端上方滚动"正在查询天气…"的步骤条,下方打字机输出正文)。FastAPI 会把这两路流转成 SSE 推给浏览器。