SELF-INSTRUCT: Aligning Language Models with Self-Generated Instructions

本文是LLM系列文章,针对《SELF-INSTRUCT: Aligning Language Models with Self-Generated Instructions》的翻译。

自我指导:将语言模型与自生成的指令相结合

  • 摘要
  • [1 引言](#1 引言)
  • [2 方法](#2 方法)
  • [3 来自GPT3的自学数据](#3 来自GPT3的自学数据)
  • [4 实验结果](#4 实验结果)
  • [5 相关工作](#5 相关工作)
  • [6 结论](#6 结论)

摘要

大型"指令调整"语言模型(即,微调以响应指令)已经证明了将零样本推广到新任务的显著能力。然而,它们在很大程度上依赖于人类书面指令数据,而这些数据在数量、多样性和创造性方面往往是有限的,因此阻碍了调优模型的通用性。我们介绍了SELFINSTRUCT,这是一个通过自举自己的生成来提高预训练语言模型的指令跟随能力的框架。我们的管道从语言模型中生成指令、输入和输出样本,然后过滤无效或类似的样本,然后使用它们来微调原始模型。将我们的方法应用于普通的GPT3,我们证明了在SUPERNATURALINSTRUCTIONS上比原始模型有33%的绝对改进,与使用私人用户数据和人工注释训练的InstructionGPT001的性能相当。为了进一步评估,我们为新任务策划了一组专家书面指令,并通过人工评估表明,使用SELF-instruction调整GPT3的性能大大优于使用现有公共指令数据集,仅与InstructionGPT001相差5%的绝对差距。SELF-instruction提供了一种几乎无注释的方法,用于将预训练的语言模型与指令对齐,我们发布了我们的大型合成数据集,以促进未来对指令调整的研究

1 引言

2 方法

3 来自GPT3的自学数据

4 实验结果

5 相关工作

6 结论

我们介绍了SELF-instruction,这是一种通过LMs自己生成指令数据来提高其指令跟随能力的方法。在对普通GPT3进行实验时,我们为不同的任务自动构建了一个由52K指令组成的大规模数据集,并在此数据上微调GPT3,使SUPERNI比原始GPT3有33%的绝对改进。此外,我们还为新颖的任务策划了一套专家书面说明。对该集的人工评估表明,使用SELF-instruction调优GPT3的性能大大优于使用现有公共指令数据集,并且与InstructionGPT001的性能非常接近。我们希望"自我指导"可以作为调整预训练的LMs以遵循人类指令的第一步,未来的工作可以建立在这些数据的基础上,以改进指令遵循模型。

相关推荐
qzhqbb44 分钟前
基于统计方法的语言模型
人工智能·语言模型·easyui
冷眼看人间恩怨1 小时前
【话题讨论】AI大模型重塑软件开发:定义、应用、优势与挑战
人工智能·ai编程·软件开发
2401_883041081 小时前
新锐品牌电商代运营公司都有哪些?
大数据·人工智能
AI极客菌2 小时前
Controlnet作者新作IC-light V2:基于FLUX训练,支持处理风格化图像,细节远高于SD1.5。
人工智能·计算机视觉·ai作画·stable diffusion·aigc·flux·人工智能作画
阿_旭2 小时前
一文读懂| 自注意力与交叉注意力机制在计算机视觉中作用与基本原理
人工智能·深度学习·计算机视觉·cross-attention·self-attention
王哈哈^_^2 小时前
【数据集】【YOLO】【目标检测】交通事故识别数据集 8939 张,YOLO道路事故目标检测实战训练教程!
前端·人工智能·深度学习·yolo·目标检测·计算机视觉·pyqt
Power20246663 小时前
NLP论文速读|LongReward:基于AI反馈来提升长上下文大语言模型
人工智能·深度学习·机器学习·自然语言处理·nlp
数据猎手小k3 小时前
AIDOVECL数据集:包含超过15000张AI生成的车辆图像数据集,目的解决旨在解决眼水平分类和定位问题。
人工智能·分类·数据挖掘
好奇龙猫3 小时前
【学习AI-相关路程-mnist手写数字分类-win-硬件:windows-自我学习AI-实验步骤-全连接神经网络(BPnetwork)-操作流程(3) 】
人工智能·算法
沉下心来学鲁班4 小时前
复现LLM:带你从零认识语言模型
人工智能·语言模型