Fine Tuning——Prompt-Learning && Delta Tuning

预训练大模型只能提供较好的初始化,面对纷繁复杂的NLP任务场景,需要进一步的微调训练。

T5
  • 110亿参数
  • 从训练"分类层"转为 训练 "encoder-decoder"
  • sequence to sequence 序列到序列的训练,输出token而不是分类
  • demonstration 例证
GPT3
  • 1750亿参数

    模型太大,单机根本无法微调

  • 没有任何参数被微调,通过prompt方式使用

  • Descriptions(Prompts) + Few-shot examples to generate tokens

    in-context leaning :大模型见过几个examples再输出

  • 优点

    更好的语言理解和语言生成效果

    更大的容积去学习新的知识

Fine tuning 的改变

以前的方法微调要改变全部模型的参数,在GPT3上是不现实的,在110b其实就很难了

每个任务对应一个100多亿的模型,100个任务就有100个模型,从存储角度来讲也不现实

高效的微调大模型 Effective Model Adaptation

从task 和 data的角度出发

prompt-learning

给模型加入一些额外的上下文 trigger出一些token

让输入数据变得更具体

从优化的角度出发

delta Tuning

用小参数去驱动大参数

相关推荐
why-geo1 分钟前
从“会聊天”到“能办事”:Meta Muse与国内个人AI智能体的竞速赛
大数据·人工智能
秦先生在广东13 分钟前
重构开发团队:深度解析 Agency Agents 多智能体协作系统的架构与落地
人工智能
howdoyoudo20260615 分钟前
当新案例冲击旧框架:分类系统的宿命与修正路径
大数据·网络·数据库·人工智能·安全·ai·分类
秦先生在广东16 分钟前
Agency Agents:跨平台 AI 编程智能体生态的架构解析与工程实践
人工智能
袖清暮雨18 分钟前
机器学习之逻辑回归
人工智能·机器学习·ai
二川bro18 分钟前
Firecracker
人工智能
秦先生在广东22 分钟前
解构 gstack:如何以 23 个 AI 角色重塑全栈开发工作流
人工智能
释厄62324 分钟前
学术引用本体论——WorkBuddy 学术科学文化三违反
网络·人工智能·算法
一隅论数智26 分钟前
RDF(Resource Description Framework)介绍和使用举例(二)
大数据·人工智能·经验分享·笔记·学习·架构·政务
ccstuck27 分钟前
AI安全系列:开源RAG系统测试
人工智能·安全·开源·ai安全