千问Qwen7B chat:本地部署及网页端使用

基于前面的安装经验,千问大模型的本地部署并不算难,主要时间用在大模型文件的下载上。同时系统运行对硬件也有较高的要求,本机的硬件配置为N卡3060,显存12G。

  1. 使用conda创建虚拟环境,主要版本如下:

Python 3.9.18

CUDA 12.1

pytorch 2.2.2

  1. 克隆代码到本地

git clone https://github.com/QwenLM/Qwen.git

  1. 进入Qwen目录,执行安装命令

安装依赖

pip install -r requirements.txt

安装 web_demo 依赖

pip install -r requirements_web_demo.txt

  1. 运行命令

python web_demo.py --server-port 8087 --server-name "0.0.0.0"

会下载很多模型文件,需要一点时间。下载完成后启动界面如下

在输入框里输入沟通内容"你是谁"。我们看一下后台输出:

相关推荐
武子康20 分钟前
给 Pi 增加能力时,应该写 Prompt、Skill、Tool 还是 Extension?
人工智能·llm·agent
tachibana234 分钟前
怎么让大模型同时给意图节点打分
大数据·人工智能·ai·大模型·llm·prompt
XLYcmy1 小时前
小红书 算法一面 三
llm·sft·强化学习·多模态·损失函数·visual r1·奖励机制
罗高16 小时前
AI Agent 可观测性完全指南:遥测、追踪、指标与评估
llm·agent
罗高16 小时前
评估 AI Agent 技能:用 Langfuse 让技能质量变得可衡量
llm·agent
罗高16 小时前
评估 AI Agent 技能的框架:如何量化技能对代理性能的真实影响
llm
小林ixn16 小时前
在浏览器里跑 DeepSeek-R1:WebGPU + Transformers.js 实战
react.js·llm·浏览器
XLYcmy16 小时前
小红书 算法一面 二
llm·sft·memory·多模态·位置编码·grpo·视觉数据
CodeBlog-star20 小时前
LLM能力与边界:多模态、幻觉、上下文窗口及开源模型对比
人工智能·python·开源·llm
冬奇Lab20 小时前
Code Agent 解剖(02):agent 是怎么一轮一轮思考和行动的?
人工智能·llm·agent