-
BERTopic:
- 简介: 基于预训练的语言模型BERT(Bidirectional Encoder Representations from Transformers)的主题模型,通过将文档嵌入到BERT空间中并进行聚类,实现主题提取。
- 作者: 出自Cherubin等人的研究(2021)。
-
BigARTM (Big Additive Regularization Topic Model):
- 简介: BigARTM是一种多模态、多目标的主题模型,可以处理大规模文本集合,并且允许用户通过添加正则化项来引导主题模型学习特定的模式。
- 作者: 出自"BigARTM: Open-Source Library for Regularized Multimodal and Multilingual Topic Modeling"(2015)。
-
LDA2Vec:
- 简介: LDA2Vec是一种将词向量和主题模型(Latent Dirichlet Allocation, LDA)结合的方法,通过将LDA中的主题表示嵌入到词嵌入空间中,实现更好的语义建模。
- 作者: 出自"Dynamic Topic Models for Tracking Research Communities over Time"(2016)。
-
ETM (Embedding Topic Model):
- 简介: ETM是一种将主题嵌入到连续空间的模型,通过学习主题嵌入向量,将文档嵌入到主题空间中,以获得更丰富的语义表示。
- 作者: 出自"A Neural Probabilistic Topic Model"(2019)。
-
Biterm Topic Model (BTM):
- 简介: BTM是一种基于二项分布的主题模型,通过对文档中的词对(biterms)进行建模,实现了在大规模文本集上高效的主题建模。
- 作者: 出自"Modeling Bimodal Texts with the Biterm Topic Model"(2014)。
nlp文本主题提取算法总结
mqdlff_python2024-01-25 20:25
相关推荐
alphaAIstack几秒前
大语言模型推理能力从何而来?zenRRan22 分钟前
Qwen2.5-VL Technical Report!!! 操作手机电脑、解析化学公式和乐谱、剪辑电影等,妥妥六边形战士 !...让我安静会30 分钟前
Obsidian·Copilot 插件配置(让AI根据Obsidian笔记内容进行对话)Allen_LVyingbo35 分钟前
Scrum方法论指导下的Deepseek R1医疗AI部署开发Watermelo6171 小时前
从DeepSeek大爆发看AI革命困局:大模型如何突破算力囚笼与信任危机?Donvink1 小时前
【DeepSeek-R1背后的技术】系列九:MLA(Multi-Head Latent Attention,多头潜在注意力)计算机软件程序设计1 小时前
深度学习在图像识别中的应用-以花卉分类系统为例Ainnle1 小时前
企业级RAG开源项目分享:Quivr、MaxKB、Dify、FastGPT、RagFlow小天努力学java2 小时前
AI赋能传统系统:Spring AI Alibaba如何用大模型重构机票预订系统?鸟哥大大2 小时前
【Python】pypinyin-汉字拼音转换工具