LLama_Factory配置及模型微调实践

一:下载及配置

1.安装llama_factory(开源项目)

复制代码
 git clone --depth 1 https://github.com/hiyouga/LLaMA-Factory.git

2.验证安装

复制代码
llamafactory-cli version

3.查看pip下载源(python库)

复制代码
pip config list

# 国外源下载太慢了,且都是大的AI工具包

可以考虑换国内的清华源

复制代码
pip config set global.index-url https://pypi.tuna.tsinghua.edu.cn/simple
pip config set global.trusted-host pypi.tuna.tsinghua.edu.cn

4.跑大模型所需要的依赖

复制代码
pip install -e ".[torch,metrics]"

下错了版本,卸载(上述命令默认安装的是cpu版本的torch)

复制代码
pip uninstall torch torchaudio torchvision -y

下载适配torch

bash 复制代码
pip install torch==2.9.0 torchvision==0.24.0 torchaudio==2.9.0 --index-url https://download.pytorch.org/whl/cu126

# 这是笔者的

"""
torch-2.9.0+cu126 ✅ GPU 版 PyTorch

torchaudio-2.9.0+cu126 ✅ 音频库

torchvision-0.24.0+cu126 ✅ 视觉库

triton-3.5.0 ✅ 加速库

cu126,即cuda12.6版本
"""

检测gpu是否可用

复制代码
python -c "import torch; print(torch.cuda.is_available())"

# 显示True即可

补充:若是在windows里已经配置好了pytorch,gpu可用,则可以下载windows相同的版本。如何查看版本信息呢?

bash 复制代码
# 打开cmd,进入python
python

# 输出pytorch信息,检测gpu是否可用(直接粘贴)
import torch
print(torch.__version__)   # pytorch自身版本(发布的命名)
print(torch.cuda.is_available())   # gpu是否可用
print(torch.version.cuda)    # 编写pytorch的cuda版本

"""
补充:ctrl+Z 退出python
      nvidia-smi显示的是你的显卡支持的最高的cuda版本,可以向下兼容
"""

5.启动

复制代码
llamafactory-cli webui

复制地址,在windows浏览器打开

二:微调

功能解释:

量化:给模型瘦身,太大显卡跑不起来;越小瘦的越多,一般推荐4

量化算法:使用哪种方法给模型瘦身;跑模型:GPTQ,微调:BitsAndBytes(bnb)

模型下载

hugging face下载连不上网络

复制代码
# 打开cmd
pip install modelscope

# 进入你想安装model的路径
modelscope download --model qwen/Qwen2.5-7B-Instruct
相关推荐
AI78402 天前
开源模型改写AI格局:Llama、通义千问、Mistral如何挑战闭源巨头
人工智能·开源·llama
leoZ2313 天前
本地跑大模型实战(七):llama.cpp 性能调优,让推理更快更省
java·人工智能·spring·生成对抗网络·语言模型·自然语言处理·llama
leoZ2313 天前
实战复盘:用 Claude Code 从零搭一个 GitHub PR 统计工具
java·人工智能·python·深度学习·自然语言处理·github·llama
yagami_gagami3 天前
第四届黄河流域公安院校电子物证个人赛服务器取证
linux·服务器·网络·mysql·安全·docker·llama
不喝水的鱼儿4 天前
本地部署 260K 上下文 Qwen-3.6-35B-A3B 与 Ornith-1.0-35B 模型及 VSCode Copilot 参数调优记录
ide·vscode·语言模型·copilot·llama
(轻舟已过万重山)5 天前
第16章 主流开源模型选型:Qwen/LLaMA/GLM/Mistral 怎么选
人工智能·开源·llama
染指11105 天前
72.高级RAG-sql检索器
python·sql·mysql·llama·llamaindex·高级rag
孪生质数-7 天前
AI 应用实践篇——让大模型真正开始工作
linux·运维·服务器·人工智能·深度学习·语言模型·llama
刹那芳华19927 天前
基于 Docker 的 LLaMA-Factory 全流程部署指南
docker·容器·llama
grey_csdn12 天前
1928_llama.cpp部署Qwen 3.6-35B-A3B扩充识图功能
llama