LLaMA Factory模型微调实战

目录:

一、LLaMA Factory官网

LLaMA Factory官网地址

二、LLaMA Factory的安装

安装地址

powershell 复制代码
git clone --depth 1 https://github.com/hiyouga/LLaMA-Factory.git
cd LLaMA-Factory
pip install -e ".[torch,metrics]"

项目上使用conda虚拟环境安装效果更好,官网命令供参考。

三、web界面



测试回答,模型回答的不是很理想,所有我们需要进行微调处理。

四、模型微调



训练完成后,需要导出模型:

五、法律大模型微调

1、准备数据集

2、数据集数据处理



格式构建出来了。

3、dataset_info.json文件中配置处理的数据集

配置后就能在web页面找到我们配置的数据集。

接下来就是训练模型,使用web界面进行训练。



Abort里面可以加载模型和导入模型,上面训练完成后,可以通过这里导出模型,然后加载模型检测训练的效果。

4、加载模型检测

相同问题测试,效果要好很多,比之前更加简洁就能拿到答案。

相关推荐
GPU实战笔记7 小时前
本地跑不动 llama.cpp,临时租云 GPU 怎么搭?从启动服务到环境复用
java·服务器·网络·人工智能·深度学习·llama
牛马工作号3 天前
RK3588 使用 rk-llama.cpp + RKNPU2 部署 Qwen3.5:从零开始的 NPU 本地大模型实战
人工智能·语言模型·llama
书源丶3 天前
Qwen3-Embedding-0.6B 纯 CPU
网络·语言模型·embedding·llama
论文复现现场4 天前
Llama/Qwen 70B 部署需要几张 RTX 4090?2卡、4卡、8卡显存、量化与 vLLM 选型
llama·qwen·vllm·大模型推理·大模型部署·rtx4090
谢白羽4 天前
在4×B300用SGLang部署DeepSeek-V4.1 Flash优化实录
笔记·python·llm·llama·sglang
renzao_ai8 天前
本地 35B 大模型部署实战:Ollama 跑 Ornith-35B 全流程
python·llama·免费ai大模型
Είναι η κοπέλα8 天前
本地大模型部署完全指南:Ollama / vLLM / llama.cpp / MLX 四大引擎横评与选型实战
macos·llama·vllm
小饕8 天前
RK3588 NPU 跑大模型实测:rknn-llm 解码 25.9 tok/s,是 llama.cpp 的 4 倍!附三天完整踩坑记录
人工智能·机器人·llama
一航jason8 天前
Android平台推理框架及试用场景模型对比
android·人工智能·ai·架构·ai编程·llama
一航jason8 天前
Android 端侧大模型推理框架对比
android·人工智能·ai·ai编程·llama·ai-native