2007-2024年 上市公司-投资者情绪数据(xlsx)

01、数据简介 2007-2024年上市公司-投资者情绪数据(xlsx)资源-CSDN下载https://download.csdn.net/download/2401_84585615/92636898

依据任晓松、孙莎、马茜(2024)所提出的方法体系,投资者情绪指标构建遵循系统化流程:

其一,数据获取。定向采集 2007 至 2024 年财经网络社区(涵盖股票主题贴吧及行业论坛)发布的所有股票相关帖子,提取发帖人标识、发布时间、标题文本、阅读量等结构化信息。

其二,文本预处理。对采集的原始文本开展净化操作:先过滤无效与重复内容,接着用 jieba 分词工具进行中文分词,剔除通用及领域特定停用词,最后借助 TF - IDF 算法把文本数据转化为机器可识别的数值向量。

其三,情感分类与日度情绪计算。运用朴素贝叶斯分类模型将帖子划分为乐观、中性、悲观三类情感倾向。针对上市企业 i,依据第 n 日乐观帖子数(posi,n​)与悲观帖子数(negi,n​),通过公式 smi,n​​=ln(1+negi,n​1+posi,n​​)构建情绪因子,加 1 平滑保障数值稳定,对数变换实现数据分布规范。

其四,年度情绪指标构建。以自然年为观测周期,对周期内所有交易日的情绪因子 smi,n​​进行算术平均,得到衡量企业 i 在第 t 年投资者情绪水平的综合指标 senti,t​,有效捕捉市场参与者中长期情感特征。该指标体系整合网络文本大数据与机器学习技术,为量化分析投资者心理偏差对资本市场影响提供可操作测量工具。

02、相关数据

包含股票代码、年份、s_in、sent_(i,t) 。

相关推荐
码界筑梦坊14 分钟前
353-基于Python的大湾区气候数据可视化分析系统
开发语言·python·信息可视化·数据分析·django·vue·毕业设计
nancy_princess16 分钟前
attention基础概念1
人工智能
做个文艺程序员17 分钟前
华为昇腾NPU部署开源大模型全攻略(以Qwen3-8B为例)
人工智能·深度学习·华为
智算菩萨40 分钟前
【论文精读】Automated machine learning for positive-unlabelled learning
论文阅读·人工智能·机器学习·论文笔记·贝叶斯优化·自动机器学习·无标签学习
小程故事多_801 小时前
破解Agent“半途摆烂”困局,OpenDev凭Harness架构,撕开Code Agents的工程化真相
人工智能·架构·aigc·harness
吴佳浩1 小时前
Vibe Coding 时代:Vue 消失了还是 React 太强?
人工智能
Elastic 中国社区官方博客1 小时前
Elasticsearch:如何在 Elastic AI Builder 里使用 DSL 来查询 Elasticsearch
大数据·人工智能·elasticsearch·搜索引擎·ai·全文检索
musicml1 小时前
从 Vibe Coding 到 SDD(规范驱动开发):AI 原生时代的软件工程化实践
人工智能·驱动开发·软件工程
Deepoch1 小时前
Deepoc具身模型:重塑无人机无遥控器作业
人工智能·科技·无人机·具身模型·deepoc
i建模1 小时前
Claude Code在编程之外的能力
人工智能