快速在WIN11中本地部署chatGLM3

具体请看智谱仓库github:GitHub - THUDM/ChatGLM3: ChatGLM3 series: Open Bilingual Chat LLMs | 开源双语对话语言模型

或者Huggingface:https://huggingface.co/THUDM/chatglm3-6b

  1. 利用Anaconda建立一个虚拟环境:

    conda create -n chatglm3 python=3.11 (版本太低安装streamlit会出问题)
    conda activate chatglm3

  2. 安装torch的GPU版:

根据自己本地计算机显卡和系统选择官方上相应的指令:

复制代码
conda install pytorch torchvision torchaudio pytorch-cuda=12.1 -c pytorch -c nvidia

这块安装时间较长,耐心等待,反复尝试,直到安装成功为止。其中,需要测试一下GPU的CUDA功能是否可以正常使用:

复制代码
print(torch.version.cuda)	#查看cuda版本
print(torch.cuda.is_available())  # 查看cuda是否可用
print(torch.cuda.device_count())  # 查看可行的cuda数目

如果以上指令运行没问题,显示True,说明可以GPU可以正常使用。

3.开始安装ChatGLM3,根据以上官网地址的说明进行如下操作:

选择D盘或者其他盘建立一个本地文件,利用管理员权限打开一个cmd窗口运行如下命令:

复制代码
git clone https://github.com/THUDM/ChatGLM3
cd ChatGLM3

然后使用 pip 安装依赖:

复制代码
pip install -r requirements.txt

此外,使用 Code Interpreter 还需要安装 Jupyter 内核:

复制代码
ipython kernel install --name chatglm3-demo --user

然后,进入basic_demo目录下,实现三种新的样例测试

1)案例1------指令窗口

运行如下指令:

复制代码
python cli_demo.py

指令对话窗口案例2:

2) 案例2------Gradio

运行如下命令:

复制代码
python web_demo.py

注意:如果不输出结果,是由于Gradio的版本过高,建议安装pip install gradio==3.40版本。太低会报错,比如3.39版本。

  1. 案例3------streamlit

运行如下命令:

复制代码
streamlit run web_demo2.py

其中,需要修改一下路径,将下载好的模型放到本目录下,将第6行程序改为

复制代码
将MODEL_PATH = os.environ.get('MODEL_PATH', 'THUDM/chatglm3-6b')改为
MODEL_PATH = os.environ.get('MODEL_PATH', '../chatglm3-6b')

这样所有的程序和模型都在一起,方便管理。

程序启动之后,浏览器显示如下:

安装过程中一些注意事项:

  • 遇到"RuntimeError: nvrtc: error: failed to open nvrtc-builtins64_121.dll.
    Make sure that nvrtc-builtins64_121.dll is installed correctly."

需要将虚拟环境下的"nvrtc-builtins64_121.dll"文件拷贝到C:\Windows\System32目录下,即可解决。

相关推荐
子昕3 分钟前
API Key 登录 Codex 也能用插件了,还支持会话删除和导出
ai编程
Agent产品评测局9 分钟前
传统RPAvsAI Agent,制造业生产场景能力对比详解 —— 2026企业级自动化选型全景盘点
运维·人工智能·ai·chatgpt·自动化
野犬寒鸦29 分钟前
Claude Code:终端AI编程助手全指南(附带指令全讲解)
开发语言·后端·面试·ai编程
無名路人32 分钟前
小程序点餐页吸顶滚动
前端·微信小程序·ai编程
DogDaoDao36 分钟前
【GitHub】Ruflo:面向 Claude Code 的企业级多智能体编排平台深度解析
人工智能·深度学习·大模型·github·ai编程·claude·ruflo
盼君1 小时前
用AI编程从零搭建一个响应式数据看板
ai编程·数据可视化
紫小米2 小时前
Agent的范式
prompt·embedding·ai编程
いNeil2 小时前
海外开发者注册验证码解决方案,适配 GPT、Codex 等第三方应用
gpt
数据法师2 小时前
Sora退场,GPT Image 2.0封神!免费不限次还支持中文!
人工智能·gpt·计算机视觉
2601_957780842 小时前
GPT-5.5时代:从“指令集“到“任务契约“的Prompt工程范式迁移
大数据·人工智能·gpt·架构·prompt