Fine Tuning——Prompt-Learning && Delta Tuning

预训练大模型只能提供较好的初始化,面对纷繁复杂的NLP任务场景,需要进一步的微调训练。

T5
  • 110亿参数
  • 从训练"分类层"转为 训练 "encoder-decoder"
  • sequence to sequence 序列到序列的训练,输出token而不是分类
  • demonstration 例证
GPT3
  • 1750亿参数

    模型太大,单机根本无法微调

  • 没有任何参数被微调,通过prompt方式使用

  • Descriptions(Prompts) + Few-shot examples to generate tokens

    in-context leaning :大模型见过几个examples再输出

  • 优点

    更好的语言理解和语言生成效果

    更大的容积去学习新的知识

Fine tuning 的改变

以前的方法微调要改变全部模型的参数,在GPT3上是不现实的,在110b其实就很难了

每个任务对应一个100多亿的模型,100个任务就有100个模型,从存储角度来讲也不现实

高效的微调大模型 Effective Model Adaptation

从task 和 data的角度出发

prompt-learning

给模型加入一些额外的上下文 trigger出一些token

让输入数据变得更具体

从优化的角度出发

delta Tuning

用小参数去驱动大参数

相关推荐
QQ39575332372 分钟前
智能量化交易的未来:中阳科技的创新之路
人工智能
远洋录17 分钟前
状态管理实战:一次 Redux 到 React Query 的重构之旅
前端·人工智能·react
AI服务老曹31 分钟前
云、边、端分布式一体化计算架构,进行统一调度和统一监控的智慧物流开源了
人工智能·分布式·重构·架构·开源·音视频
hunteritself33 分钟前
OpenAI直播发布第4天:ChatGPT Canvas全面升级,免费开放!
人工智能·gpt·chatgpt·openai
冰冰的coco38 分钟前
概率、似然、最小二乘
人工智能·机器学习·概率论
B站计算机毕业设计超人41 分钟前
计算机毕业设计Python+知识图谱大模型AI医疗问答系统 健康膳食推荐系统 食谱推荐系统 医疗大数据 机器学习 深度学习 人工智能 爬虫 大数据毕业设计
大数据·人工智能·python·深度学习·机器学习·知识图谱·数据可视化
加德霍克1 小时前
Opencv之识别图片颜色并绘制轮廓
图像处理·人工智能·opencv·学习·计算机视觉
OJAC近屿智能1 小时前
苹果全家桶接入ChatGPT,近屿智能邀您共绘AI蓝图
人工智能·ai·chatgpt·aigc
MongoDB 数据平台1 小时前
Alan Chhabra:MongoDB AI应用程序计划(MAAP) 为客户提供价值
数据库·人工智能·mongodb
网智圈--一起AI赋能网络1 小时前
【AI+网络/仿真数据集】1分钟搭建云原生端到端5G网络
网络·人工智能·5g·云原生·信息与通信