书生·浦语大模型实战营-学习笔记4

XTuner 大模型单卡低成本微调实战

Finetune简介

常见的两种微调策略:增量预训练、指令跟随

指令跟随微调

数据是一问一答的形式

对话模板构建

每个开源模型使用的对话模板都不相同

指令微调原理:

由于只有答案部分是我们期望模型来进行回答的内容,所以我们只对答案部分进行损失的计算

增量预训练微调

数据都是陈述句,没有问答形式

LoRA & QLoRA

XTuner中使用的微调原理:LoRA & QLoRA

如果我们要对整个模型的所有参数都进行调整的话,需要非常大的显存才能够进行训练,但是用LoRA的方法就不需要这么大的显存开销了

比较:全参数微调、LoRA、QLoRA

全参数微调:整个模型都要加载到显存中,所有模型参数的优化器也都要加载到显存中,显存不够根本无法进行·

LoRA:模型也是要先加载到显存中,但是我们只需要保存LoRA部分的参数优化器,大大减小了显存占用

QLoRA:加载模型时就使用4bit量化的方式加载(相当于不那么精确的加载),但是可以节省显存开销,QLoRA部分的参数优化器,还可以在GPU和CPU之间进行调度【这是Xtunner进行整合的功能 】,显存满了就自动去内存中去跑。

XTuner介绍


XTuner快速上手

  1. 安装
bash 复制代码
pip install xtuner
  1. 挑选配置模版
bash 复制代码
xtuner list-cfg -p internlm_20b
  1. 一键训练
bash 复制代码
xtuner train internlm_20b_qlora_oasst1_512_e3
  1. Config 命名规则

|-------|---------------------------------|
| 模型名 | internlm_20b ( 无 chat 代表是基座模型 ) |
| 使用算法 | qlora |
| 数据集 | oasst1 |
| 数据长度 | 512 |
| Epoch | e3, epoch 3 |

!在这里插入图片描述(https://img-blog.csdnimg.cn/direct/67e55262c53d4d988fa0948795877b8c.png) !在这里插入图片描述(https://img-blog.csdnimg.cn/direct/2746f7cf958b47a1b2b388a43f5a9260.png) !在这里插入图片描述(https://img-blog.csdnimg.cn/direct/3a93273b4b84489ca5be2e991156e1d6.png) !在这里插入图片描述(https://img-blog.csdnimg.cn/direct/3a14ced892df4f02a58633f803aff1e9.png)

XTunner支持多数据的样本拼接,增加运行效率,输入模型,统一的进行梯度的传播

自定义数据集建议使用json格式

8GB显卡玩转LLM



动手实战环节

https://github.com/InternLM/tutorial/blob/main/xtuner/README.md

相关推荐
Chen—LSN7 分钟前
C语言——文件操作(2)
c语言·开发语言·c++·经验分享·笔记·算法·c#
程序员yu29 分钟前
会编网络:别被入门教程骗了,Python实用能力不在语法本身
开发语言·python·学习·算法
Lintongzg33 分钟前
千卡训练的隐形账单:通信不是瓶颈
笔记·学习·性能优化·llm
dadaobusi34 分钟前
学习: SIOV
学习
AI浩38 分钟前
Migician:揭示多模态大语言模型中自由形式多图定位的魔力
人工智能·语言模型·自然语言处理
硅谷秋水39 分钟前
从语言模型到作用于世界的系统:智能体AI在数字、社交、虚拟及物理环境中的进展与局限
人工智能·机器学习·语言模型·自然语言处理
LuminousCPP1 小时前
从零开始学 C++(三):类和对象入门|从 struct 到 class,理解封装、对象与 this 指针
c++·笔记·学习·类和对象
zhyongrui1 小时前
Codex 桌面端汉化:从菜单到主界面的实现思路
chatgpt·codex·汉化·easygpt
梦帮科技2 小时前
万亿 Token 工业级语料洗炼:MinHash LSH 兆级去重、语义纯化与元提示词泄漏绝对阻断
人工智能·深度学习·神经网络·生成对抗网络·自然语言处理·数据挖掘
传奇开心果编程2 小时前
【Flutter入门练中学】第11课:状态管理进阶与声明式路由
android·学习·flutter·ui·ios