-
BERTopic:
- 简介: 基于预训练的语言模型BERT(Bidirectional Encoder Representations from Transformers)的主题模型,通过将文档嵌入到BERT空间中并进行聚类,实现主题提取。
- 作者: 出自Cherubin等人的研究(2021)。
-
BigARTM (Big Additive Regularization Topic Model):
- 简介: BigARTM是一种多模态、多目标的主题模型,可以处理大规模文本集合,并且允许用户通过添加正则化项来引导主题模型学习特定的模式。
- 作者: 出自"BigARTM: Open-Source Library for Regularized Multimodal and Multilingual Topic Modeling"(2015)。
-
LDA2Vec:
- 简介: LDA2Vec是一种将词向量和主题模型(Latent Dirichlet Allocation, LDA)结合的方法,通过将LDA中的主题表示嵌入到词嵌入空间中,实现更好的语义建模。
- 作者: 出自"Dynamic Topic Models for Tracking Research Communities over Time"(2016)。
-
ETM (Embedding Topic Model):
- 简介: ETM是一种将主题嵌入到连续空间的模型,通过学习主题嵌入向量,将文档嵌入到主题空间中,以获得更丰富的语义表示。
- 作者: 出自"A Neural Probabilistic Topic Model"(2019)。
-
Biterm Topic Model (BTM):
- 简介: BTM是一种基于二项分布的主题模型,通过对文档中的词对(biterms)进行建模,实现了在大规模文本集上高效的主题建模。
- 作者: 出自"Modeling Bimodal Texts with the Biterm Topic Model"(2014)。
nlp文本主题提取算法总结
mqdlff_python2024-01-25 20:25
相关推荐
GitCode官方1 天前
参会预告 | AtomGit 邀您共赴 TritonNext 2026 技术大会,解锁 AI 系统与编译生态新机遇MobiusStack1 天前
Cursor团队最新文章解读丨动态上下文发现,重新定义AI记忆Rui_Freely1 天前
Vins-Fusion之 相机—IMU在线标定(十一)沛沛老爹1 天前
Web开发者5分钟上手:Agent Skills环境搭建与基础使用实战DeepFlow 零侵扰全栈可观测1 天前
3分钟定位OA系统GC瓶颈:DeepFlow全栈可观测平台实战解析想用offer打牌1 天前
一站式讲清Spring AI Alibaba的OverAllState和RunnableConfig生成论实验室1 天前
生成论之基:“阴阳”作为元规则的重构与证成——基于《易经》与《道德经》的古典重诠与现代显象数据分享者1 天前
对话对齐反馈数据集:12000+高质量人类-助手多轮对话用于RLHF模型训练与评估-人工智能-大语言模型对齐-人类反馈强化学习-训练符合人类期望的对话模型Java后端的Ai之路1 天前
【人工智能领域】- 卷积神经网络(CNN)深度解析_清欢l1 天前
Dify+test2data实现自然语言查询数据库