【大模型原理与技术-毛玉仁】第五章 模型编辑

5 模型编辑

5.1 模型编辑简介

大语言模型有时会产生一些不符合人们期望的结果,如偏见、毒性和知识错误等。

偏见 是指模型生成的内容中包含刻板印象和社会偏见等不公正的观点,毒性 是指模型生成的内容中包含有害成分,而知识错误则是指模型提供的信息与事实不符。

然而,重新预训练存在成本过高等缺陷,微调存在过拟合、灾难性遗忘等缺陷。

为规避重新预训练和微调方法的缺点,模型编辑应运而生。其旨在精准、高效地修正大语言模型中的特定知识点,能够满足大语言模型对特定知识点进行更新的需求。

模型编辑思想

模型编辑定义

模型编辑挑战

模型编辑性质

常用数据集

在模型编辑的相关研究中,使用最广泛的是由Omer Levy 等人提出的zsRE数据集。

zsRE是一个问答任务的数据集,通过众包模板问题来评估模型对于特定关系(如实体间的"出生地"或"职业"等联系)的编辑能力。

在模型编辑中,zsRE数据集用于检查模型能否准确识别文本中的关系,以及能否根据新输入更新相关知识,从而评估模型编辑方法的准确性

5.2 模型编辑经典方法

如果将大语言模型比作冒险游戏中的勇者,那么模型编辑可被看作一种满足"升级"需求的方法,可以分别从内外两个角度来考虑。

外部拓展法:通过设计特定的训练程序,使模型在保持原有知识的同时学习新信息。

内部修改法:通过调整模型内部特定层或神经元,来实现对模型输出的精确控制。

外部拓展法

外部拓展法包括知识缓存法附加参数法

内部修改法

内部修改法包括元学习法定位编辑法

方法比较

5.3 附加参数法:T-Patcher

补丁的位置

补丁的形式

补丁的实现

5.4 定位编辑法:ROME

知识存储位置

知识存储机制

精准知识编辑

5.5 模型编辑应用

精准模型更新

保护被遗忘权

由于大语言模型在训练和处理过程中也会记忆和使用个人信息,所以同样受到被遗忘权的法律约束。

机器遗忘

提升模型安全

相关推荐
草莓熊Lotso1 小时前
Linux 文件描述符与重定向实战:从原理到 minishell 实现
android·linux·运维·服务器·数据库·c++·人工智能
Coder_Boy_2 小时前
技术发展的核心规律是「加法打底,减法优化,重构平衡」
人工智能·spring boot·spring·重构
会飞的老朱4 小时前
医药集团数智化转型,智能综合管理平台激活集团管理新效能
大数据·人工智能·oa协同办公
聆风吟º5 小时前
CANN runtime 实战指南:异构计算场景中运行时组件的部署、调优与扩展技巧
人工智能·神经网络·cann·异构计算
Codebee7 小时前
能力中心 (Agent SkillCenter):开启AI技能管理新时代
人工智能
聆风吟º8 小时前
CANN runtime 全链路拆解:AI 异构计算运行时的任务管理与功能适配技术路径
人工智能·深度学习·神经网络·cann
uesowys8 小时前
Apache Spark算法开发指导-One-vs-Rest classifier
人工智能·算法·spark
AI_56788 小时前
AWS EC2新手入门:6步带你从零启动实例
大数据·数据库·人工智能·机器学习·aws
User_芊芊君子8 小时前
CANN大模型推理加速引擎ascend-transformer-boost深度解析:毫秒级响应的Transformer优化方案
人工智能·深度学习·transformer
智驱力人工智能9 小时前
小区高空抛物AI实时预警方案 筑牢社区头顶安全的实践 高空抛物检测 高空抛物监控安装教程 高空抛物误报率优化方案 高空抛物监控案例分享
人工智能·深度学习·opencv·算法·安全·yolo·边缘计算