nlp文本主题提取算法总结

  1. BERTopic:

    • 简介: 基于预训练的语言模型BERT(Bidirectional Encoder Representations from Transformers)的主题模型,通过将文档嵌入到BERT空间中并进行聚类,实现主题提取。
    • 作者: 出自Cherubin等人的研究(2021)。
  2. BigARTM (Big Additive Regularization Topic Model):

    • 简介: BigARTM是一种多模态、多目标的主题模型,可以处理大规模文本集合,并且允许用户通过添加正则化项来引导主题模型学习特定的模式。
    • 作者: 出自"BigARTM: Open-Source Library for Regularized Multimodal and Multilingual Topic Modeling"(2015)。
  3. LDA2Vec:

    • 简介: LDA2Vec是一种将词向量和主题模型(Latent Dirichlet Allocation, LDA)结合的方法,通过将LDA中的主题表示嵌入到词嵌入空间中,实现更好的语义建模。
    • 作者: 出自"Dynamic Topic Models for Tracking Research Communities over Time"(2016)。
  4. ETM (Embedding Topic Model):

    • 简介: ETM是一种将主题嵌入到连续空间的模型,通过学习主题嵌入向量,将文档嵌入到主题空间中,以获得更丰富的语义表示。
    • 作者: 出自"A Neural Probabilistic Topic Model"(2019)。
  5. Biterm Topic Model (BTM):

    • 简介: BTM是一种基于二项分布的主题模型,通过对文档中的词对(biterms)进行建模,实现了在大规模文本集上高效的主题建模。
    • 作者: 出自"Modeling Bimodal Texts with the Biterm Topic Model"(2014)。
相关推荐
qq_43696218几秒前
奥威BI+AI数据分析解决方案
人工智能·数据挖掘·数据分析·ai数据分析
freexyn7 分钟前
Matlab自学笔记五十二:变量名称:检查变量名称是否存在或是否与关键字冲突
人工智能·笔记·算法·matlab
roc-ever11 分钟前
用Python做有趣的AI项目5:AI 画画机器人(图像风格迁移)
人工智能·python·深度学习
说私域12 分钟前
从大众传媒到数字生态:开源AI智能名片链动2+1模式S2B2C商城小程序驱动的营销革命
人工智能·小程序·开源·零售
群联云防护小杜13 分钟前
云服务器被黑客攻击应急响应与加固指南(上)
运维·服务器·人工智能·tcp/ip·自动化·压力测试
九亿AI算法优化工作室&34 分钟前
结合大语言模型的机械臂抓取操作学习
人工智能·学习·语言模型·自然语言处理
kaamelai34 分钟前
Kaamel视角下的MCP安全最佳实践
大数据·人工智能·安全
我要学脑机37 分钟前
基于常微分方程的神经网络(Neural ODE)
人工智能·深度学习·神经网络
有颜有货1 小时前
2025汽车制造企业数字化转型路径参考
人工智能·汽车·制造·数字化转型
阿星AI工作室1 小时前
小白也能用AI开发「小红书自动归档多维表格」采集神器,躺平整理笔记真香
人工智能