-
BERTopic:
- 简介: 基于预训练的语言模型BERT(Bidirectional Encoder Representations from Transformers)的主题模型,通过将文档嵌入到BERT空间中并进行聚类,实现主题提取。
- 作者: 出自Cherubin等人的研究(2021)。
-
BigARTM (Big Additive Regularization Topic Model):
- 简介: BigARTM是一种多模态、多目标的主题模型,可以处理大规模文本集合,并且允许用户通过添加正则化项来引导主题模型学习特定的模式。
- 作者: 出自"BigARTM: Open-Source Library for Regularized Multimodal and Multilingual Topic Modeling"(2015)。
-
LDA2Vec:
- 简介: LDA2Vec是一种将词向量和主题模型(Latent Dirichlet Allocation, LDA)结合的方法,通过将LDA中的主题表示嵌入到词嵌入空间中,实现更好的语义建模。
- 作者: 出自"Dynamic Topic Models for Tracking Research Communities over Time"(2016)。
-
ETM (Embedding Topic Model):
- 简介: ETM是一种将主题嵌入到连续空间的模型,通过学习主题嵌入向量,将文档嵌入到主题空间中,以获得更丰富的语义表示。
- 作者: 出自"A Neural Probabilistic Topic Model"(2019)。
-
Biterm Topic Model (BTM):
- 简介: BTM是一种基于二项分布的主题模型,通过对文档中的词对(biterms)进行建模,实现了在大规模文本集上高效的主题建模。
- 作者: 出自"Modeling Bimodal Texts with the Biterm Topic Model"(2014)。
nlp文本主题提取算法总结
mqdlff_python2024-01-25 20:25
相关推荐
虹科数字化与AR4 分钟前
安宝特案例丨AR+AI赋能轨道交通制造:破解人工装配难题的创新实践陈敬雷-充电了么-CEO兼CTO4 分钟前
字节跳动开源Coze,开启AI Agent开发新时代?说私域8 分钟前
基于开源AI智能名片链动2+1模式与S2B2C商城小程序的微商品牌规范化运营研究强德亨上校11 分钟前
2025年7月21–28日AI开发周报:新模型、新战略与开源亮点亚马逊云开发者11 分钟前
Amazon Bedrock Runtime API集成指南——从Invoke Model API迁移到Converse API,简化生成式AI应用开发算家计算12 分钟前
FLUX.1 Kontext LoRA专用炼丹炉使用教程:加快训练进程,减少实例费用消耗!江山如画,佳人北望14 分钟前
pytorch常用函数DM今天肝到几点?22 分钟前
【7.26-7.28胜算云AI日报:首个开源3D世界生成模型腾讯混元、微软预示 8 月 GPT-5 发布、Nemotron推理、商汤悟能、DM夺金】学术小八29 分钟前
第六届物联网、人工智能与机械自动化国际学术会议 (IoTAIMA 2025)青梅主码30 分钟前
麦肯锡全球研究院发布《2025 年技术趋势展望》:到 2030 年,半导体行业可能面临显著的人才缺口