在ubuntu22.04上部署RagFlow一个深度文档理解的开源 RAG

RAGFlow 是一个基于深度文档理解的开源 RAG(Retrieval-Augmented Generation)引擎。它为任何规模的企业提供简化的 RAG 工作流程,结合 LLM(大型语言模型)以提供真实的问答功能,并由来自各种复杂格式数据的有根据的引用提供支持。

主要特点

1、"品质进,品质出"

基于深度文档理解,从具有复杂格式的非结构化数据中提取知识。

找到"数据大海捞针",字面上是无限的令牌。

2、 基于模板的分块

智能且可解释。

大量模板选项可供选择。

3、 接地引文,减少幻觉

文本分块的可视化,允许人为干预。

快速查看关键参考文献和可追溯的引文,以支持有根据的答案。

4、 与异构数据源的兼容性

支持 Word、幻灯片、excel、txt、图像、扫描副本、结构化数据、网页等。

5、 自动化且轻松的 RAG 工作流程

简化的 RAG 编排可满足个人和大型企业的需求。

可配置的 LLM 以及嵌入模型。

多次召回与融合重新排名配对。

直观的 API,可与业务无缝集成。

下面我们就开始介绍部署

一、软件硬件要求

CPU >= 4 核

RAM >= 16 GB

磁盘 >= 50 GB

Docker >= 24.0.0 和 Docker Compose >= v2.26.1

Docker安装

复制代码
sudo apt-get install docker.io

docker-compose的安装

复制代码
curl -L "https://github.com/docker/compose/releases/download/v2.29.1/docker-compose-$(uname -s)-$(uname -m)" -o /usr/local/bin/docker-compose

设置系统参数

复制代码
systemctl enable docker
systemctl start docker

二、以docker方式安装RagFlow

1、系统参数设置

复制代码
# In this case, we set it to 262144:
$ sudo sysctl -w vm.max_map_count=262144

2、克隆代码

复制代码
$ git clone https://github.com/infiniflow/ragflow.git

3、构建预构建的 Docker 镜像并启动服务器:

复制代码
$ cd ragflow/docker
$ chmod +x ./entrypoint.sh
$ docker compose up -d

如果你非常幸运,但么执行完上面就安装完了,但因为众所周知的不知道什么原因,如果无法下载docker镜像文件,小伙伴可以从我们百度网盘下载:

链接:https://pan.baidu.com/s/1afq0C2fTyoctU2df2Uhs8g?pwd=jw5f

提取码:jw5f

下载后,执行下面的导入镜像文件

复制代码
#下载五个docker文件,并安装
docker load -i [文件名]

然后再执行:

复制代码
$ cd ragflow/docker
$ chmod +x ./entrypoint.sh
$ docker compose up -d

三:运行及设置

运行直接打开浏览器,输入IP地下即可。

http://ip:80

首次登录,需要注册一个帐号。

四:设置LLM

这里就具体说了,我是选了本地的ollama,

使用本地ollama,这里的API-Key可以不填。

五:结束语

我们先后介绍了FastGPT、Flowise和今天我们介绍的RagFlow。大家可以对比测试一下,看看哪个功能更多,更好用。

相关推荐
paopao_wu3 小时前
腾讯HunyuanOCR开源端到端OCR-1B:本地部署与测试
ai·开源·ocr·hunyuan
通义灵码4 小时前
Qoder 全形态产品家族正式发布,并开源 Agentic Coding 产品耐用度评测集
人工智能·开源·ai编程
济南壹软网络科技有限公司5 小时前
架构深潜:通霸IM——私有化部署、全链路开源的高可用企业级即时通讯技术基座
java·架构·开源·即时通讯源码·即时通讯im
OpenCSG5 小时前
智源Emu3.5发布:34B参数的世界模型基座,以“下一状态预测”重塑多模态Scaling范式
人工智能·开源
OpenCSG6 小时前
悟界Emu3.5发布:世界模型诞生,多模态进入“下一状态预测”新纪元
人工智能·开源
IvorySQL7 小时前
活动预告|IvorySQL 与您相约 COSCon‘25
数据库·postgresql·开源
面包会有的,牛奶也会有的。7 小时前
开源项目:自动化测试平台-TestRunner-接口测试平台
开源
DisonTangor8 小时前
Step-Audio-R1 首个成功实现测试时计算扩展的音频语言模型
人工智能·语言模型·开源·aigc·音视频
SongYuLong的博客10 小时前
开源 C 标准库(C Library)
c语言·开发语言·开源
OpenCSG10 小时前
无需人类干预,300 轮自主思考!Kimi K2 Thinking 模型发布,多项基准达 SOTA
人工智能·开源·kimi·csghub