利用ollama和open-webui本地部署通义千问Qwen1.5-7B-Chat模型

目录

[1 安装ollama](#1 安装ollama)

[2 安装open-webui](#2 安装open-webui)

[2.1 镜像下载](#2.1 镜像下载)

[3 配置ollama的模型转换工具环境](#3 配置ollama的模型转换工具环境)

[3.1 下载ollama源码](#3.1 下载ollama源码)

[3.2 下载ollama子模块](#3.2 下载ollama子模块)

[3.3 创建ollama虚拟环境](#3.3 创建ollama虚拟环境)

[3.4 安装依赖](#3.4 安装依赖)

[3.5 编译量化工具](#3.5 编译量化工具)

[7 创建ollama模型](#7 创建ollama模型)

[8 运行模型](#8 运行模型)

参考文献:


1 安装ollama

bash 复制代码
curl -fsSL https://ollama.com/install.sh | sh

启动、关闭ollama

systemctl start ollama

systemctl stop ollama

systemctl restart ollama

systemctl status ollama

2 安装open-webui

bash 复制代码
git clone https://github.com/open-webui/open-webui.git
cd open-webui

这里open-webui的源码其实用不到,直接用下面的镜像就行。

2.1 镜像下载

官方没有在 docker hub 上发布镜像,而是发布在 ghcr.io,地址在 https://Github.com/open-webui/open-webui/pkgs/container/open-webui

bash 复制代码
docker pull ghcr.io/open-webui/open-webui:main

如果没有科学上网,很可能会拉不动,可以试试 docker 代理网站:https://dockerproxy.com/,但是会多几个步骤

bash 复制代码
# 如果拉不动的话加个代理
docker pull ghcr.dockerproxy.com/open-webui/open-webui:main

# 重命名镜像(如果是通过代理下载的)
docker tag ghcr.dockerproxy.com/open-webui/open-webui:main ghcr.io/open-webui/open-webui:main

# 删除代理镜像(如果是通过代理下载的)
docker rmi ghcr.dockerproxy.com/open-webui/open-webui:main

然后docker images可以看到镜像

bash 复制代码
docker run -d -p 3006:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui-chw --restart always ghcr.io/open-webui/open-webui:main
2c93ac3c6c911302d4d2926692a7bab64f607317938da71e53ff32798be801da

3 配置ollama的模型转换工具环境

3.1 下载ollama源码

bash 复制代码
git clone https://github.com/ollama/ollama.git
cd ollama

3.2 下载ollama子模块

bash 复制代码
git submodule init
git submodule update llm/llama.cpp

3.3 创建ollama虚拟环境

bash 复制代码
conda create -n ollama_chw python=3.11
conda activate ollama_chw

3.4 安装依赖

bash 复制代码
pip install -r llm/llama.cpp/requirements.txt

3.5 编译量化工具

bash 复制代码
make -C llm/llama.cpp quantize
如果编译llama.cpp的测试工具main,在llama.cpp目录执行make -j,会在当前目录生成main文件。
测试实验./main -m ./model_name

4 5 6 见私人博客

7 创建ollama模型

bash 复制代码
ollama create chw1.5 -f /data/chw/ollama_20240419/qwen1.5-7B/Modelfile

到了这一步之后,其实在open-webui上就可以看到这个模型了

8 运行模型

bash 复制代码
ollama run chw1.5

其实这个ollama run就相当于在命令行运行模型,但是我们这里是用open-webui,所以直接ollama create之后就可以用open-webui。

参考文献:

GitHub - ollama/ollama: Get up and running with Llama 3, Mistral, Gemma, and other large language models.

GitHub - open-webui/open-webui: User-friendly WebUI for LLMs (Formerly Ollama WebUI)

llama.cpp部署通义千问Qwen-14B_通义千问gguf model-CSDN博客

适配Ollama的前端界面Open WebUI | 半码博客
🚀 Getting Started | Open WebUI

相关推荐
CODER03046 天前
ubuntu22.04部署完整deepseek局域网web服务全过程(RTX5090安装黑屏+web端多人并发)
pytorch·webui·ubuntu22.04·ollama·deepseek·rtx5090·自然语言模型
jianpeng的工程笔记6 天前
Qwen-Image-2.1 图像编辑拆解:从透明改字到多图合成
人工智能·qwen·图像生成·comfyui
Zhu7586 天前
docker环境,vLLM 部署 Qwen3.8-27B
docker·qwen·vllm
福大大架构师每日一题6 天前
agno v3.0.10发布:Azure OpenAI Responses、Elasticsearch、MCP 路由与一批关键稳定性修复全解析
ollama
空 白II7 天前
9.20 大语言模型研究简报:Qwen Code v0.24.1从 Coding Agent 走向统一 Agent Runtime
大语言模型·qwen
咬代码的兽9 天前
Qwen3.8-Omni-Flash 发布:1M 上下文 + 原生全模态,四步跑通音视频 API
人工智能·大模型·api·qwen
All for pursuit.9 天前
FastAPI+Ollama 部署本地AI大模型对话助手
python·github·aigc·ollama
程序猿编码10 天前
不用 GPU!RK3588 跑视觉大模型,Qwen3.5-2B VLM 端侧落地
大模型·llm·rk3588·qwen·推理·vlm
赋创小助手10 天前
Qwen3.8-27B 本地推理 Benchmark 解析:llama.cpp、vLLM、SGLang 与长 Context 的性能差异
服务器·人工智能·大模型·qwen·vllm·sglang·context长度
论文复现现场10 天前
Llama/Qwen 70B 部署需要几张 RTX 4090?2卡、4卡、8卡显存、量化与 vLLM 选型
llama·qwen·vllm·大模型推理·大模型部署·rtx4090