大模型微调之LLaMA-Factory实战

目录

  • [1. 环境搭建](#1. 环境搭建)
  • [2. 开始调参](#2. 开始调参)
    • [2.1 模型配置](#2.1 模型配置)
    • [2.2 选择数据集](#2.2 选择数据集)
      • [2.2.1 使用自定义数据集](#2.2.1 使用自定义数据集)
    • [2.3 其他参数](#2.3 其他参数)
  • [3. 开始微调](#3. 开始微调)
  • [4. 模型评测](#4. 模型评测)
  • [5. 模型导出](#5. 模型导出)

1. 环境搭建

环境要求

Python ≥3.9

PyTorch & CUDA

GPU显存>24GB

安装命令

bash 复制代码
git clone https://github.com/hiyouga/LLaMA-Factory.git
cd LLaMA-Factory
pip install -e ".[torch,metrics]"
llamafactory-cli webui

2. 开始调参

浏览器输入http://10.0.0.140:7861/进入调参页

2.1 模型配置

首先要选择要微调的模型,我们这里选择DeepSeek-R1-1.5B-Distill,如果预先没下载好模型,右侧模型下载源选择modelscope

2.2 选择数据集

2.2.1 使用自定义数据集

2.3 其他参数

其他参数根据需要自行调节

3. 开始微调

点击start即开始微调训练,训练完成后,可以在LLaMA-Factory-main/saves/DeepSeek-R1-1.5B-Distill/lora/train_2025-09-10-00-34-43/目录下找到微调后的模型即训练loss曲线图

从loss曲线图可以看出,虽然震荡比较厉害,但是整体趋势是一直在下降的

4. 模型评测

模型训练完成后,可以对模型进行评测

调参页选择Evaluate&Predict,然后点击Start即可。

完成后,会输出如下评测结果

5. 模型导出

在调参页选择Export,然后选在刚微调的模型,并填写导出路径,点击Export即开始导出。

导出完成后,可以在导出目录看到如下:

相关推荐
feasibility.18 小时前
多模态模型Qwen3-VL在Llama-Factory中断LoRA微调训练+测试+导出+部署全流程--以具身智能数据集open-eqa为例
人工智能·python·大模型·nlp·llama·多模态·具身智能
问道飞鱼1 天前
【大模型知识】Chroma + Ollama + Llama 3.1 搭建本地知识库
llama·知识库·chroma·ollama
凉忆-1 天前
llama-factory训练大模型
python·pip·llama
zhangfeng11332 天前
大模型微调时 Firefly(流萤)和 LlamaFactory(LLaMA Factory)这两个工具/框架之间做出合适的选择
人工智能·llama
love530love2 天前
技术复盘:llama-cpp-python CUDA 编译实战 (Windows)
人工智能·windows·python·llama·aitechlab·cpp-python·cuda版本
玄同7652 天前
Llama.cpp 全实战指南:跨平台部署本地大模型的零门槛方案
人工智能·语言模型·自然语言处理·langchain·交互·llama·ollama
zhangfeng11332 天前
大模型微调主要框架 Firefly vs LLaMA Factory 全方位对比表
人工智能·语言模型·开源·llama
zhangfeng11333 天前
LLaMA Factory 完全支自定义词库(包括自定义微调数据集、自定义领域词汇/词表)
人工智能·llama
小毅&Nora3 天前
【人工智能】【大模型】从厨房到实验室:解密LLaMA架构如何重塑大模型世界
人工智能·架构·llama
kimi-2224 天前
LLaMA Factory: 一站式大模型高效微调平台
llama