大模型-微调相关内容

大模型-微调相关内容

1、LoRA微调基本原理

相关概念:

python 复制代码
模型预训练:从头开始训练一个全新的模型(全新的模型是指模型的参数完全随机,不能处理任何的问题)
微调训练(迁移学习):基于之前训练好的模型,来继续学习新的任务。微调的目的往往是让模型具备新的或特定的能力。----全量微调、局部微调、增量微调
LoRA微调属于局部微调

LlamaFactory微调大模型流程记录

LlamaFactory框架安装:

项目github官网下载地址:

python 复制代码
https://github.com/hiyouga/LlamaFactory/tree/main

官方建议依赖版本:

根据上述官方依赖版本,我采用python版本是3.11,torch==2.5.0对应的cuda版本是11.8,具体如下:

python 复制代码
# 创建python3.11版本的虚拟环境
conda create -n llamafactory python=3.11  -y

# 安装torch版本是2.5.0
pip install torch==2.5.0 torchvision==0.20.0 torchaudio==2.5.0 --index-url https://download.pytorch.org/whl/cu118

接下来是重要的一步:安装flash-attention

该包采用pip安装的话,我在安装过程中出现卡顿的问题,所以,直接从其github官网下载对应版本的**.whl**文件包

python 复制代码
https://github.com/Dao-AILab/flash-attention

根据llama-factory官方推荐,安装的是v2.7.3

python 复制代码
https://github.com/Dao-AILab/flash-attention/releases/tag/v2.7.3


安装:

python 复制代码
pip install flash_attn-2.7.3+cu11torch2.5cxx11abiFALSE-cp311-cp311-linux_x86_64.whl

然后,安装llama-factory的正常依赖:

python 复制代码
cd LlamaFactory
pip install -e .
相关推荐
Allen.Su7 天前
大模型 LoRA 微调全流程实战 - 车载问答全流程(跑通 + 参数详解 + 训练日志逐行解读 + 模型合并)
人工智能·python·lora·大模型微调
承渊政道11 天前
【从零开始大模型开发与微调:基于PyTorch与ChatGLM】(实战训练自己的ChatGPT从续写模型到对齐助手:RLHF、奖励模型与PPO精读)
人工智能·pytorch·chatgpt·预训练·rlhf·大模型微调
一枚爱吃大蒜的程序员13 天前
CSDN文章-注意力约束QLoRA教育大模型微调
人工智能·机器学习·语言模型·qlora·大模型微调·注意力约束
weixin_440213291 个月前
大模型参数高效微调:PEFT、LoRA、QLoRA、DoRA原理与对比
lora·大模型·peft·qlora·dora·大模型微调·参数高效微调
uncle_ll1 个月前
Llama 3 私有化落地全栈实战:从 Ollama 极速部署到 LLaMA Factory LoRA 定制微调
llm·nlp·llama·ollama·大模型微调
puamac2 个月前
LlamaFactory 部署说明文档
人工智能·llamafactory·rtx 5060 ti
puamac2 个月前
LlamaFactory QLoRA SFT 微调实操指南
人工智能·llamafactory
长葡萄的叶子2 个月前
LLaMA-Factory进行模型微调、合并与Ollama部署全流程指南
模型微调·llamafactory
GRITJW2 个月前
从固定数据到在线策略:SFT、RL 与 OPD 如何重塑模型分布
强化学习·大模型微调
山鬼谣me3 个月前
大模型训练
llamafactory·微调大模型