文本摘要是从一段长文本中提取出最重要的信息,并生成一个简短而有意义的摘要。这个过程可以分为两种主要方法:
抽取式摘要(Extractive Summarization):从原文中直接提取出关键句子或段落,组成摘要。这种方法不会改变原文的内容,只是选择了最能代表文章主题的部分。
- 无监督:Lead,Centroid,Cluster,TextRank
- 有监督:R2N2,NeuralSum,SummaRuNNer,BertSum
生成式摘要(Abstractive Summarization):这种方法通过理解原文内容,然后用自己的语言生成一个简短的总结。生成式摘要可能包含与原文不同的词语或句子结构,但它依然能够传达原文的核心信息。Seq2seq经典架构:优点------不限于原文自由生成摘要、摘要展示了文本的关键信息;缺点------容易产生重复
PGN(Pointer-Generator Network)架构:使用生成概率进行取舍,要么从词汇表生成一个单词,要么从原文本复制一个单词,相对减少了摘要重复问题
评估方法:
- BLEU(Bilingual evaluation understudy):主要计算精确度
- ROUGE(Recall-Oriented Understudy for Gisting Evaluation:基于召回率,评价标准------ROUGE-N和ROUGE-L
文本摘要简介
好好学习Py2024-08-16 16:30
相关推荐
秋916 分钟前
Python工程师面试常问提问和回答(AI工程化方向 · 2026版)炎武丶航19 分钟前
LeNet-5深度学习详解:从手写数字识别到代码实战sitellla19 分钟前
Pydub:用 Python 处理音频,不写废话TechWayfarer28 分钟前
云服务器地域怎么选:用离线IP数据库识别用户来源并优化部署梦想不只是梦与想31 分钟前
Python 中的进程(Process)郑洁文32 分钟前
基于Python的恶意流量监测系统的设计与实现星辰徐哥33 分钟前
Python AI基础:Matplotlib与Seaborn数据可视化AI玫瑰助手35 分钟前
Python流程控制:for循环与range函数的搭配使用anew___38 分钟前
2026年Python爬虫技术完全指南:从入门到实战Jinkxs39 分钟前
Python基础 - 初识内置函数 Python自带的便捷工具