LLaMA-Factory学习(1)简介及安装步骤

  • 操作系统:ubuntu22.04
  • IDE:Visual Studio Code
  • 编程语言:Python 3.10

LLaMA-Factory 简介

LLaMA-Factory 是一个开源的 全栈大模型微调框架,支持从预训练到指令微调(SFT)、强化学习(RLHF)等全流程训练。其核心特点包括:

  • 支持多种模型:Llama、LLaMA-3、Mistral、Qwen、Baichuan、ChatGLM 等。
  • 灵活的微调方法:全参数微调(Full)、冻结微调(Freeze)、LoRA、QLoRA 等。
  • 低资源训练:通过量化(INT4/INT8)和高效算法(如 GaLore、Unsloth)降低显存占用。
  • 可视化界面:提供 llamafactory-cli webui 的网页界面,方便非开发者快速上手。
  • 部署与推理:支持 API、Gradio Web 界面和命令行推理。

为什么学习 LLaMA-Factory

1.自从有了大模型后,不管企业还是个人都对大模型有了强烈的需求,通过公网访问这些大模型比如deepseek或者通义千问,用户担心隐私泄露,不愿意在公网上上传自己的私有数据,从而有了私有化部署大模型的需求。

2.用户可能会希望给大模型喂上自己的数据,这样就能对你的提问有了准确的回答,尤其是企业内部的一些数据,或者一些比较专业的行业数据。

  1. LLaMA-Factory 就能实现大模型微调,添加进去自己的数据进去。而且不需要重新训练大模型。

LLaMA-Factory 安装

1.先创建一个anaconda环境llama_factory

bash 复制代码
conda create -n llama_factory python=3.10

如下图:
2.进入llama_factory环境

bash 复制代码
conda activate llama_factory

3.在github上下载llama_factory

bash 复制代码
git clone --depth 1 https://github.com/hiyouga/LLaMA-Factory.git

进入到目录:

bash 复制代码
cd LLaMA-Factory

4.安装 LLaMA Factory 相关依赖

bash 复制代码
pip install -e ".[torch,metrics]"

5.检验是否安装成功

bash 复制代码
llamafactory-cli version

输出:

bash 复制代码
----------------------------------------------------------
| Welcome to LLaMA Factory, version 0.9.3.dev0           |
|                                                        |
| Project page: https://github.com/hiyouga/LLaMA-Factory |
----------------------------------------------------------

表示安装成功

LaMA Board 可视化微调(由 Gradio 驱动)

bash 复制代码
llamafactory-cli webui

会跳出webui的界面,如下图:

相关推荐
LucianaiB2 天前
使用GpuGeek高效完成LLaMA大模型微调:实践与心得分享
ai·llama·ai自动化·gpugeek
为啥全要学3 天前
LLaMA-Factory 微调 Qwen2-7B-Instruct
llama·大模型微调·llamafactory
一把年纪学编程3 天前
dify 连接不上ollama An error occurred during credentials validation:
llama
陈奕昆4 天前
五、【LLaMA-Factory实战】模型部署与监控:从实验室到生产的全链路实践
开发语言·人工智能·python·llama·大模型微调
fydw_7154 天前
大语言模型RLHF训练框架全景解析:OpenRLHF、verl、LLaMA-Factory与SWIFT深度对比
语言模型·swift·llama
AI大模型顾潇5 天前
[特殊字符] 本地部署DeepSeek大模型:安全加固与企业级集成方案
数据库·人工智能·安全·大模型·llm·微调·llama
modest —YBW5 天前
Ollama+OpenWebUI+docker完整版部署,附带软件下载链接,配置+中文汉化+docker源,适合内网部署,可以局域网使用
人工智能·windows·docker·语言模型·llama
青衫客365 天前
使用本地部署的 LLaMA 3 模型进行中文对话生成
大模型·llama
cainiao0806056 天前
《大模型微调实战:Llama 3.0全参数优化指南》
llama
鸿蒙布道师6 天前
英伟达开源Llama-Nemotron系列模型:14万H100小时训练细节全解析
深度学习·神经网络·opencv·机器学习·自然语言处理·数据挖掘·llama