【知识增强】A Survey of Knowledge-Enhanced Pre-trained LM 论文笔记

A Survey of Knowledge-Enhanced Pre-trained Language Models

Linmei Hu, Zeyi Liu, Ziwang Zhao, Lei Hou, Liqiang Nie, Senior Member, IEEE and Juanzi Li

2023年8月的一篇关于知识增强预训练模型的文献综述

论文思维导图

思维导图网页上看不清的话,可以存储到本地再看

大纲笔记

摘要: 预训练语言模型(PLMs)是在大型文本语料库上通过自我监督学习方法进行训练的一种语言模型,在自然语言处理(NLP)的各种任务中都取得了良好的性能。然而,虽然具有巨大参数的plm能够有效地拥有从大量训练文本中学习到的丰富知识,并在微调阶段有利于下游任务,但也存在一定的局限性,如缺乏外部知识导致推理能力较差 。研究人员致力于将知识整合到plm中 ,以解决这些问题。在本文中,我们对知识增强预训练语言模型(KE-PLMs)进行了全面的回顾,以对这一蓬勃发展的领域提供一个清晰的认识。我们分别为 自然语言理解(NLU)自然语言生成(NLG) 引入了合适的分类,以强调自然语言处理的两个主要任务。对于NLU,我们将知识类型分为四类:语言知识文本知识知识图谱(KG)规则知识 。该方法分为基于KG 的和基于检索 的两种。最后,我们指出了KE-PLM的一些有前景的发展方向。











相关推荐
开心星人7 小时前
【论文阅读】UNIT: Backdoor Mitigation via Automated Neural Distribution Tightening
论文阅读
regret~7 小时前
【论文笔记】ViT-CoMer
论文阅读
勤劳的进取家7 小时前
论文阅读:Self-Collaboration Code Generation via ChatGPT
论文阅读·chatgpt
Siyu_Zhu2 天前
可解释性AI 综述《Explainable AI for Industrial Fault Diagnosis: A Systematic Review》
论文阅读
寻丶幽风2 天前
论文阅读笔记——双流网络
论文阅读·笔记·深度学习·视频理解·双流网络
学术交流2 天前
2025年金融创新、区块链与信息技术国际会议(FRCIT 2025 2025)
论文阅读·金融·区块链·论文笔记
钟屿2 天前
Cold Diffusion: Inverting Arbitrary Image Transforms Without Noise论文阅读
论文阅读·图像处理·人工智能·深度学习·计算机视觉
0x2112 天前
[论文阅读]ControlNET: A Firewall for RAG-based LLM System
论文阅读
0x2113 天前
[论文阅读]Formalizing and Benchmarking Prompt Injection Attacks and Defenses
论文阅读·prompt
爱补鱼的猫猫3 天前
24、DeepSeek-V3论文笔记
论文阅读