【书生浦语第二期实战营学习笔记&作业(四)】

课程文档:https://github.com/InternLM/Tutorial/blob/camp2/xtuner/readme.md

作业文档:https://github.com/InternLM/Tutorial/blob/camp2/xtuner/homework.md

书生浦语第二期实战营学习笔记&作业(四)

1.1、微调理论讲解及 XTuner 介绍

  • 两种Finetune范式: 增量预训练和指令跟随
    增量预训练和指令跟随 区别:
  • 一条数据的一生:


1.2 微调方案 LoRA & QLoRA


LoRA介绍 : LLM的参数量主要集中在模型中的Linear,训练这些参数会耗费大量的显存。
LoRA 通过在原本的Linear旁,新增一个支路,包含两个连续的小Linear,新增的这个支路通常叫做 Adapter。

Adapter 参数量远小于原本的Linear,能大幅降低训练的显存消耗

LoRA & QLoRA对比

2.1 XTuner简介

2.2 XTuner快速上手


2.3 XTuner数据引擎


3.1 多模态LLM

  • 多模态LLM原理简介

  • LLaVA方案简介

LLaVA方案

作业:

  1. 准备数据集
  2. 模型训练


    对话测试:
    微调后的模型

    微调前的模型

    Web demo 部署:
相关推荐
码到成龚10 分钟前
《数字图像处理基础》学习06-图像几何变换之最邻近插值法缩小图像
图像处理·学习
fa_lsyk36 分钟前
mysql window安装(学习使用)
学习·mysql·adb
熬夜的猪1 小时前
现代安全密码哈希算法
java·学习·算法·安全·哈希算法
kuiini1 小时前
C 语言学习-06【指针】
c语言·学习
King.6241 小时前
sql工具!好用!爱用!
大数据·数据库·人工智能·sql·学习
坚硬果壳_2 小时前
《硬件架构的艺术》笔记(七):处理字节顺序
笔记·硬件架构
一只小菜鸡..2 小时前
241125学习日志——[CSDIY] [InternStudio] 大模型训练营 [17]
学习
许小禾上学记2 小时前
Python 爬虫从入门到(不)入狱学习笔记
爬虫·python·学习
惠惠软件3 小时前
误删了照片,甚至对存储卡进行了格式化 都可以找到丢失的图片,并让您恢复它们 支持一键恢复或永久删除丢失的照片、视频、音乐、文档等-供大家学习研究参考
学习
2303_Alpha3 小时前
数据结构——哈夫曼编码
c语言·数据结构·笔记·算法·图论