-
什么是TextCNN
Yoon Kim在论文(2014 EMNLP) Convolutional Neural Networks for Sentence Classification提出TextCNN,该模型将卷积神经网络CNN应用到文本分类任务,是卷积神经网络应用到文本分析的开创性工作之⼀。
-
TextCNN的结构
TextCNN的结构图如下:

具体包含如下结构:
-
Embedding层
将词的One-hot表示映射为稠密向量表示。
-
一维卷积层
宽度设为词嵌入维度,高度为卷积核大小(超参数),在word-level上进行一维卷积。虽然文本经过词嵌入后是二维数据,但是在embedding-level上的二维卷积没有意义。同一卷积核大小一般设置多个卷积核来提取不同的特征。
-
时序最大池化层
对一个卷积核得到的feature map取最大值,由于一个卷积核是在word-level即按照时序进行卷积的,所以称为时序最大池化(max-over-time pooling)。
-
全连接层
将各个卷积、池化后的结果拼接后经过最后一层或多层全连接层将特征转化为label的概率分布。
-
-
TextCNN学到了什么
TextCNN不同大小的卷积核学习到的是卷积核大小n对应的某个n-gram特征,时序最大池化层提取句子中该特征的最大取值,最后的全连接层组合这些n-gram特征进行分类。因此,TextCNN能够学习到很多用于分类的局部的特征,适用于短文本的分类,而对于有较长依赖关系的长文本分类效果较差。
工智能基础知识总结--什么是TextCNN
Runjavago2024-01-07 15:27
相关推荐
墨染天姬18 分钟前
【AI】端侧AIBOX可以部署哪些智能体AI成长日志22 分钟前
【Agentic RL】1.1 什么是Agentic RL:从传统RL到智能体学习2501_9481142434 分钟前
2026年大模型API聚合平台技术评测:企业级接入层的治理演进与星链4SAPI架构观察小小工匠36 分钟前
LLM - awesome-design-md 从 DESIGN.md 到“可对话的设计系统”:用纯文本驱动 AI 生成一致 UI 的新范式黎阳之光1 小时前
黎阳之光:视频孪生领跑者,铸就中国数字科技全球竞争力小超同学你好1 小时前
面向 LLM 的程序设计 6:Tool Calling 的完整生命周期——从定义、决策、执行到观测回注智星云算力1 小时前
本地GPU与租用GPU混合部署:混合算力架构搭建指南jinanwuhuaguo1 小时前
截止到4月8日,OpenClaw 2026年4月更新深度解读剖析:从“能力回归”到“信任内建”的范式跃迁xiaozhazha_1 小时前
效率提升80%:2026年AI CRM与ERP深度集成的架构设计与实现枫叶林FYL1 小时前
【自然语言处理 NLP】7.2.2 安全性评估与Constitutional AI