-
BERTopic:
- 简介: 基于预训练的语言模型BERT(Bidirectional Encoder Representations from Transformers)的主题模型,通过将文档嵌入到BERT空间中并进行聚类,实现主题提取。
- 作者: 出自Cherubin等人的研究(2021)。
-
BigARTM (Big Additive Regularization Topic Model):
- 简介: BigARTM是一种多模态、多目标的主题模型,可以处理大规模文本集合,并且允许用户通过添加正则化项来引导主题模型学习特定的模式。
- 作者: 出自"BigARTM: Open-Source Library for Regularized Multimodal and Multilingual Topic Modeling"(2015)。
-
LDA2Vec:
- 简介: LDA2Vec是一种将词向量和主题模型(Latent Dirichlet Allocation, LDA)结合的方法,通过将LDA中的主题表示嵌入到词嵌入空间中,实现更好的语义建模。
- 作者: 出自"Dynamic Topic Models for Tracking Research Communities over Time"(2016)。
-
ETM (Embedding Topic Model):
- 简介: ETM是一种将主题嵌入到连续空间的模型,通过学习主题嵌入向量,将文档嵌入到主题空间中,以获得更丰富的语义表示。
- 作者: 出自"A Neural Probabilistic Topic Model"(2019)。
-
Biterm Topic Model (BTM):
- 简介: BTM是一种基于二项分布的主题模型,通过对文档中的词对(biterms)进行建模,实现了在大规模文本集上高效的主题建模。
- 作者: 出自"Modeling Bimodal Texts with the Biterm Topic Model"(2014)。
nlp文本主题提取算法总结
mqdlff_python2024-01-25 20:25
相关推荐
有为少年2 分钟前
Welford算法 | 从单一到批次godspeed_lucip3 分钟前
LLM和Agent——专题3: Agentic Workflow 入门(1)打小就很皮...4 分钟前
基于 Python + LangChain + React 的 AI 流式对话与历史存储实战小沈跨境10 分钟前
Temu 运营进阶之路 工具选型与凌风体系分析迁移科技15 分钟前
案例丨AI+3D视觉,赋能制药行业拆垛及破包更精准高效NQBJT20 分钟前
万字拆解 NeckFix:AI 脖子前倾检测的算法原理与工程实现数智工坊26 分钟前
【Inner Monologue论文阅读】: 首次将大语言模型嵌入机器人控制闭环,实现自我反思和动态行为调整AI帮小忙33 分钟前
Debian/Ubuntu 系linux操作系统Kali Linux 2026 里安装 Hermes Agent乌恩大侠35 分钟前
基站正在成为 AI 计算节点:NVIDIA Aerial 推动 RAN 架构重构钓了猫的鱼儿40 分钟前
基于深度学习+AI的水下目标目标检测与预警系统(Python源码+数据集+UI可视化