CentOS8.5 LLaMA-Factory训练模型

注:VMware16 + CentOS8.5 虚拟机尝试,不能实现GPU直通,训练不能成功。需要单独服务器直接安装linux系统。还要查看自己的显卡是否支持CUDA

CUDA GPU | NVIDIA 开发者

魔搭社区下载模型需要安装:

复制代码
pip install modelscope

使用量化需要安装:

复制代码
pip install bitsandbytes

下载模型

模型库:模型库首页 · 魔搭社区

找到你需要的模型

例如:Llama-3.2-3B-Instruct

使用命令下载:

复制代码
modelscope download --model LLM-Research/Llama-3.2-3B-Instruct

默认下载的模型目录:

用户目录下的.cache/modelscope/hub/models/(cache前的点不要忽略)

LLaMA-Factory放入模型

复制代码
cd ~/LLaMA-Factory/

mkdir models/

cp -r ~/.cache/modelscope/hub/models/ ~/LLaMA-Factory/models/

运行LLaMA-Factory页面

复制代码
conda  activate llamafactory

llamafactory-cli webui

配置页面属性

本地模型需要填写全路径:

/root/LLaMA-Factory/models/models/LLM-Research/Llama-3.2-3B-Instruct

此时就表示,我们的模型可用了。

自定义数据集准备

下载示例数据集

以下是使用示例数据集的步骤,假设您使用的是PAI提供的多轮对话数据集:

复制代码
cd LLaMA-Factory
wget https://atp-modelzoo-sh.oss-cn-shanghai.aliyuncs.com/release/tutorials/llama_factory/data.zip
mv data data.bak
unzip data.zip -d data

查看数据集

设置训练参数

可以打开量化进行加速;

下方数据集是选择出现的,不是自己填进去的,如果不行,就把数据路径搞成全路径。

开始微调

在Web UI中设置好参数后,您可以开始模型微调过程。微调完成后,您可以在界面上观察到训练进度和损失曲线。

启动微调后需要等待大约20分钟,待模型下载完毕后,可在界面观察到训练进度和损失曲线。当显示训练完毕时,代表模型微调成功。

评估模型

未完成,待继续

相关推荐
Lilith的AI学习日记7 分钟前
纳米AI搜索体验:MCP工具的实际应用测试,撰写报告 / 爬虫小红书效果惊艳
人工智能·测试工具·aigc·ai编程
疯狂学习GIS12 分钟前
Python的ArcPy基于Excel表格对大量遥感影像批量重分类
python·arcpy·批处理·遥感数据·遥感影像·重分类·栅格重分类
kkai人工智能12 分钟前
DeepSeek的100个应用场景
人工智能·gpt·学习·chatgpt
葡萄城技术团队13 分钟前
低代码 x AI,解锁数智化应用的创新引擎
人工智能·低代码
半路_出家ren14 分钟前
Python操作MySQL
开发语言·python·计算机网络·mysql·网络安全
IT古董15 分钟前
【漫话机器学习系列】245.权重衰减(Weight Decay)
人工智能·机器学习
琢磨先生David25 分钟前
Java 网络安全新技术:构建面向未来的防御体系
java·开发语言·web安全
J先生x25 分钟前
【IP101】图像分割技术全解析:从传统算法到深度学习的进阶之路
图像处理·人工智能·深度学习·学习·算法·计算机视觉
有人说风轻的像雨30 分钟前
使用 Python 监控系统资源
python
涯边上的蒲公英32 分钟前
挑战用豆包教我学Java01天
java·开发语言·人工智能