高效微调理解(prompt-tuning,p-tuning v1,p-tuning v2,lora)

高效微调(prompt-tuning,p-tuning v1,p-tuning v2,lora)

1.prompt-tuning:

例子理解;保持原本模型参数不变,通过训练提示词的参数调整prompt,使其与下游任务匹配。

例子:

2.p-tuning:

与prompt-tuning不同的是, prompt 不再是固定的文本,而是通过可学习的向量来表示

例子:

3.p-tuning v2:

与p-tuning不同的是v2在每一层(encoder / decoder)都加入learned prefix

4.lora:

Lora方法指的是在大型语言模型上对指定参数增加额外的低秩矩阵,也就是在原始PLM旁边增加一个旁路,做一个降维再升维的操作。并在模型训练过程中,固定PLM的参数,只训练降维矩阵A与升维矩阵B。而模型的输入输出维度不变,输出时将BA与PLM的参数叠加。用随机高斯分布初始化A,用0矩阵初始化B。

结构图:

相关推荐
2601_962296289 分钟前
Pytorch转ONNX详解
pytorch·深度学习·框架·onnx·模型转换
Csvn14 分钟前
第 20 章 质量保障 Harness 与评测体系
人工智能·aigc·agent
4SAPI15 分钟前
2026年大模型API接入选型指南:企业与个人用户的架构、稳定性与成本考量
大数据·开发语言·数据库·人工智能·架构·php
paopaokaka_luck16 分钟前
非遗文物数字化系统(AI非遗问答、ONNX图像识别、协同过滤推荐、ECharts数据分析、非遗知识浏览与互动、文创商城订单闭环、文化活动报名签到、社区交流)
前端·javascript·vue.js·人工智能·数据分析·echarts
我会飞biubiubiu20 分钟前
同一个 AI,为啥有人用出花,有人用出屎?——聊聊上下文工程
人工智能
Csvn21 分钟前
评测体系怎么交付?四件套 + 迁移指南——模块一收官(E05)
人工智能
秦先生在广东21 分钟前
Anthropic Agent Skills 开源发布:Claude 技能系统的定义与扩展指南
人工智能
大熊背24 分钟前
冯‑克里斯映射估计算法逻辑
深度学习·机器学习·计算机视觉·白平衡·色调映射·冯-克里斯映射估计
147API29 分钟前
蒸馏模型上线后怎样设置教师回退,避免失败请求反复烧钱
大数据·人工智能·深度学习·机器学习·蒸馏
aaajavac30 分钟前
让本地 AI Agent 通过 MCP 协议操控浏览器:Browser Copilot 实战指南
人工智能·copilot·开发工具