内涵:Low-Rank Adaptation (LoRA)

  • 它既可以在large language model中用,也可以再diffusion中用,只要是矩阵乘法应该都可以吧。

  • 固定层来增加一点新层,然后做finetune. 下面中的adapter和prefixLayer是什么?

它的操作其实就是将一个全fine tune的操作dd的矩阵乘,转换为两个dr, r*d的矩阵乘。显然这样极大的降低了finetune的参数量。

它的好处是可以通过config, 将full fine tuning作为一个特例存在。你认为underperform,就调大参数,调高rank即可。

训练完之后,推理几乎不会有额外的lantency,因为它是可以合并推理的。

这部分size小(几十M)可以放在内存中;可以在一个batch中训练不同的Loar

再有,就是,(这是MOE吗)

  • CNN时代的33卷积变换为两个31和1*3的卷积串联起来。
  • Repvgg在训练的时候拆分,在推理的时候合并。

我们真的需要fine tuning所有的参数吗?我们fine tuning的代价与这个矩阵的rank有什么关系?

相关推荐
大熊背1 小时前
研读《一种用于随机值脉冲噪声的检测统计量》中想到的一种软光敏实现算法
人工智能·软光敏·分块白平衡
YuKeeHgg1 小时前
HuabSmart Skills:一个开源的 AI Skill、Agent、Prompt 与 MCP 能力库
人工智能·ai·prompt·华彬智融
猪脚踏浪1 小时前
使用现有用户系统系统整合open webui
人工智能
newsxun1 小时前
光智融合,空间新生|Jupiter SR 亮相光博会CIOE 2026
大数据·人工智能
海宇数据1 小时前
零信任架构实战:基于海宇柠檬查出险-登记证构建自动化残值评估网关
人工智能·python·架构·自动化
深度学习lover1 小时前
<数据集>蚜虫识别<目标检测>
人工智能·深度学习·yolo·目标检测·计算机视觉·蚜虫识别
孙启超1 小时前
【AI开发之Rust】第 1 课:认识 Rust 与开发环境 —— 装好工具链,跑通第一个程序
开发语言·人工智能·后端·ai·rust·安全架构
桃西西呀1 小时前
GPT-6 Astra 强到被锁起来:拆开它的 computer-use 架构、可搜索记忆与计费悬崖
人工智能·gpt·llm
开发笔记-阿牛1 小时前
嵌入式蓝牙开发:AC2005B 芯片技术解析 —— 省晶振设计、13dBm 射频与 Auracast 广播音响开发指南
人工智能·单片机·音视频