DoRA: Weight-Decomposed Low-Rank Adaptation

摘要 (Abstract):

DoRA 是一种新的参数高效微调(PEFT)方法,它通过将预训练权重分解为幅度(magnitude)和方向(direction)两个组成部分来进行微调。这种方法特别利用了LoRA来进行方向更新,以有效减少可训练参数的数量。DoRA 的目标是模仿全微调(FT)的学习能力,同时避免额外的推理开销。实验结果表明,DoRA 在多个下游任务上,如常识推理、视觉指令调整和图像/视频文本理解,始终优于LoRA。

核心方法 (Core Method):

DoRA 方法的核心在于将预训练的权重矩阵分解为幅度向量(m)和方向矩阵(V),然后对这两个部分进行微调。具体来说,DoRA 使用LoRA 对方向矩阵 V 进行更新,同时允许幅度向量 m 单独训练。这种分解策略简化了LoRA的任务,使其专注于方向适应,同时保持了幅度的可调性。DoRA 的公式可以表示为 W' = m (V + ΔV)/norm = m (W + BA)/norm,其中 ΔV 是通过两个低秩矩阵 B 和 A 学习得到的增量方向更新。

实验结果 (Experimental Results):

DoRA 在多个下游任务上对LLaMA、LLaVA和VL-BART进行微调,实验结果显示DoRA在不牺牲推理效率的情况下,始终优于LoRA。例如,在常识推理任务上,DoRA 在LLaMA-7B/13B上的表现比LoRA提高了3.4/+1.0,在视觉指令调整任务上,DoRA 在LLaVA-7B上提高了0.6,在图像/视频文本理解任务上,DoRA 在VL-BART上提高了0.9/+1.9。

结论 (Conclusion):

DoRA 提供了一种新的PEFT方法,它通过权重分解来实现与FT相似的学习容量,同时保持了与LoRA相同的推理效率。DoRA 在多个任务和模型上的表现优于LoRA,证明了其在参数高效微调方面的潜力。

参考链接 (Reference Link):

相关推荐
天远数科3 分钟前
零信任架构实战:基于天远车辆出险记录核验构建自动化信贷网关
运维·人工智能·架构·自动化
weixin_750330234 分钟前
OPC一人公司技术服务商对比:从单体架构到AI Agent协同的演进
大数据·人工智能·架构
腾渊信息科技公司8 分钟前
腾渊科技重磅出品——企业级AI研发落地指南:从编码提效到审查治理的完整方案
人工智能·科技·腾渊科技·腾渊信息科技
不会就选b9 分钟前
数据结构之栈的算法题(OJ)
linux·数据结构·算法
geneculture9 分钟前
融智学及其序位逻辑:一项认知本体论的重构纲领——从「物意文三分」到「道零点」的完整公理化体系
人工智能·信息科学·哲学与科学统一性·融智时代(杂志)·序位逻辑·邹晓辉融智学·融智学报
柳叶方舟10 分钟前
Nature:AI 第一次把生物学发现做成“假设—实验—数据分析”闭环?
大数据·论文阅读·人工智能·数据分析·健康医疗
课件帮13 分钟前
教师考编面试模拟授课课件怎么做?课件帮AI生成教案+PPT+数字人试讲
人工智能·面试·powerpoint
beiju17 分钟前
Agent 跑得很勤,不代表系统有价值:从 Output Metrics 到 Outcome Metrics
人工智能
joinwell5218 分钟前
Agent 中断后,原任务如何安全接管?从恢复标记到效果事实
人工智能·后端·架构
武汉星际互动21 分钟前
从“反复跑”到“一次办”:边聊边办如何打通政务咨询与办理?
人工智能·政务