LLM之RAG实战(四十四)| rag-chatbot:支持Huggingface和Ollama任意模型的多PDF本地RAG方案

特点:

  • 支持本地运行和Kaggle (new)运行
  • 支持HuggingfaceOllama 的任意模型
  • Process multiple PDF inputs.
  • Chat with multiples languages (Coming soon).
  • Simple UI with Gradio.

一、安装使用

1.1 Kaggle(推荐)

Step1:把https://github.com/datvodinh/rag-chatbot/blob/main/notebooks/kaggle.ipynb脚本导入到Kaggle。

Step2:把<YOUR_NGROK_TOKEN>替换为自己的token。

1.2 本地安装

a)克隆项目

复制代码
git clone https://github.com/datvodinh/rag-chatbot.gitcd rag-chatbot

b)安装

Docker方式

复制代码
docker compose up --build

脚本方式(Ollama, Ngrok, python package)

复制代码
source ./scripts/install_extra.sh

手动安装

Step1:Ollama
Step2:Ngrok

Step3:安装rag_chatbot包

复制代码
source ./scripts/install.sh

c)启动

复制代码
source ./scripts/run.sh

或者

复制代码
python -m rag_chatbot --host localhost

使用Ngrok

复制代码
source ./scripts/run.sh --ngrok

此时,会下载大模型

大模型的配置文件:https://github.com/datvodinh/rag-chatbot/blob/main/rag_chatbot/setting/setting.py

LLM默认是:llama3:8b-instruct-q8_0

Embedding模型默认是:BAAI/bge-large-en-v1.5

此时,登录http://0.0.0.0:7860即可访问:

参考文献:

1 https://github.com/datvodinh/rag-chatbot

相关推荐
牛肉胡辣汤12 小时前
手握实战经验,分享AI工程落地的踩坑与收获
人工智能
2601_9632827712 小时前
山地复杂环境对讲机通信失效实战排查与组网优化方案
人工智能·语音识别
两万五千个小时12 小时前
DeepSeek Harness 从 0 开始:15 schedule 域(定时任务)
人工智能·程序员·架构
IT智慧客073112 小时前
2026年3月前端面试:20个高频考点全解析
人工智能
火山引擎开发者社区12 小时前
Agent Plan × DeepSeek Harness 实践指南
人工智能
桃西西呀12 小时前
DeepSeek Harness vs Codex CLI vs Claude Code,谁该用什么
人工智能
火山引擎开发者社区12 小时前
用 AgentKit,5 分钟搭建云端安全隔离的 DeepSeek Harness
人工智能
Ai-_Man12 小时前
怎么手动备份豆包智能体的聊天数据?
人工智能·ai·小程序
淼澄研学13 小时前
宇树H1机器人控制原理与Python SDK实操接入指南
人工智能
帅哥的AI自修课13 小时前
弥合RAG语义鸿沟——从知识图谱到跨模态对齐的工程实践
人工智能·知识图谱