ChatGLM3-6B-32K 在linux(Ubuntu) GPU P100(16G)复现记录

ChatGLM3-6B-32K 在linux(Ubuntu) GPU P100(16G)复现记录

时间:2024年6月12日

1.创建Conda环境

bash 复制代码
conda create --name chatglm3 python=3.10
conda activate chatglm3

2.下载chatglm,并安装依赖

如果没有安装git命令,先安装git命令

bash 复制代码
sudo apt-get update
sudo apt-get install git

下载chatglm源代码库

bash 复制代码
git clone https://github.com/THUDM/ChatGLM3
cd ChatGLM3

安装依赖

bash 复制代码
pip install -r requirements.txt

3.下载预训练权重

如果没有安装lfs,先安装lfs

bash 复制代码
sudo apt update
sudo apt install git-lfs
git lfs install

注意这里下载的是6b-32k

bash 复制代码
# 注意这里下载的是6b-32k
git clone https://www.modelscope.cn/ZhipuAI/chatglm3-6b-32k.git

4.运行./basic_demo/cli_demo.py

修改cli_demo.py中路径

bash 复制代码
MODEL_PATH = os.environ.get('MODEL_PATH', 'THUDM/chatglm3-6b')

改为

bash 复制代码
MODEL_PATH = os.environ.get('MODEL_PATH', '../chatglm3-6b-32k/')

运行cli_demo.py

bash 复制代码
python cli_demo.py

程序会在命令行中进行交互式的对话,在命令行中通过 用户: 进行输入指示,直接输入问题回车即可生成回复,输入 clear 可以清空对话历史,输入 stop 终止程序。

显存占用情况:

5.运行composite_demo相关代码

bash 复制代码
cd composite_demo
pip install -r requirements.txt
ipython kernel install --name chatglm3-demo --user

修改client.py里面的路径信息

bash 复制代码
MODEL_PATH = os.environ.get('MODEL_PATH', 'THUDM/chatglm3-6b')

改为

bash 复制代码
MODEL_PATH = os.environ.get('MODEL_PATH', '../chatglm3-6b-32k/')

运行以下命令在本地加载模型并启动 demo

bash 复制代码
streamlit run main.py
相关推荐
分布式存储与RustFS11 分钟前
模型 checkpoint 放对象存储:分片上传、断点续传与残留清理
运维·云原生·开源·对象存储·分布式存储·s3·性能基准
M78佐菲39 分钟前
ARM学习笔记(11)
linux·arm开发·笔记·嵌入式硬件·学习
M78佐菲42 分钟前
ARM学习笔记(10)
linux·arm开发·笔记·嵌入式硬件·学习
半仙白桑1 小时前
内核篇第十五讲:system-V共享内存
linux·共享内存·shmget·shmat·shmdt·shmctl
一条破秋裤1 小时前
Linux 线程创建:pthread_create 与基本回收
java·linux·运维
阿钱真强道2 小时前
15 嵌入式操作系统 | 库的下载、编译、安装与验证(libubox / ubus / uci)
ubuntu·cmake·uci·ubus·libubox
s6516654963 小时前
IDT和GDT是什么
linux
Android系统攻城狮3 小时前
Linux Gstreamer深度解析之gst_audio_decoder_set_estimate_rate调用流程与实战(四十五)
linux·gstreamer音视频·音视频进阶
FED_AF3 小时前
Linux运维“邪修”功法之通配符
linux·运维
箓维3 小时前
线程的概念和理解
linux