数据分析

airank1 小时前
大数据·人工智能·数据分析·aigc
2026年GEO服务商选型指南:系统梳理服务商分类框架、主流服务商能力横评、企业级选型六大维度及避坑要点,帮助企业在AI搜索时代做出科学决策。GEO(生成式引擎优化)是指通过结构化内容建设、权威信源铺设与知识图谱构建,使品牌信息在豆包、DeepSeek、千问、Kimi、元宝等AI大模型回答中被准确、正面、优先引用的系统性优化工程,其核心目标是让品牌成为AI原生的可信答案。
residual_fan13 小时前
人工智能·算法·数据挖掘·数据分析
深度渐进收缩学习(DPSL):面向强噪声与类内分散的机械复合故障诊断方法在高端机械装备的健康监测领域,发表于《Measurement》的论文《Mechanical compound fault diagnosis via suppressing intra-class dispersions: A deep progressive shrinkage perspective》针对强噪声环境下的复合故障诊断问题展开了深入探讨。
BYSJMG13 小时前
大数据·python·信息可视化·数据分析·spark·课程设计·美食
计算机毕设选题做什么好?基于大数据的用户美食数据分析与可视化,PySpark预处理+ECharts大屏,含Isolation Forest异常检测算法精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
追风少年ii14 小时前
数据分析·分子动力学·分子对接·结构生物学
课前准备--3D-QSAR与药物结构优化3D-QSAR(Three-Dimensional Quantitative Structure–Activity Relationship,三维定量构效关系)的核心思想,是把一系列具有相似作用机制的活性化合物放到统一的三维空间中,分析分子不同空间位置的立体场、静电场等性质与生物活性之间的定量关系,再利用模型预测新化合物活性,从而指导药物结构优化。
BYSJMG18 小时前
大数据·人工智能·hadoop·数据分析·spark·课程设计
计算机毕设选题做什么好?基于大数据的用户健身行为数据分析与可视化系统,Hadoop+Spark处理精彩专栏推荐订阅:在下方主页👇🏻👇🏻👇🏻👇🏻💖🔥作者主页:计算机毕设木哥🔥 💖
benchmark_cc1 天前
开发语言·python·数据分析·pandas·量化交易·股票数据·quantdash
REST API 和 Python SDK 应该怎么选?量化交易数据接口选型实战一句话结论:如果主要使用 Python 做量化研究和数据处理,Python SDK 通常更直接;如果需要跨语言、服务化或更底层地控制 HTTP 请求,REST API 更灵活。对于同一个数据服务,两者并不是非此即彼,而是不同工程层级的接口。
砚底藏山河1 天前
java·数据库·python·金融·数据分析
【量化纯GET实战 #23】多股票相关性:用收益率看板块联动两只股票日收益率的相关系数越接近 1,说明它们走势越同步(常在同板块);接近 0 或负,则更互补,适合做组合分散。下面算 600519 与 000858 的相关系数。
quantdash_cc1 天前
开发语言·python·数据分析·量化交易·股票数据·quantdash
量化数据源怎么选:稳定性、实时性和数据完整性到底该如何权衡?一句话结论:量化数据源没有单一的“最好”,真正应该比较的是稳定性、实时性、完整性与数据口径是否满足策略和系统的实际需求。
hfywmsj1 天前
人工智能·python·数据分析·广州餐饮铺位招租
广州餐饮铺位招租数据分析:选址权重模型与租金评估实操读完本文你将掌握:如何用结构化数据思维评估广州餐饮铺位招租信息,建立一套可量化的选址评估模型,并在签约前识别租金与转让费中的隐性风险。本文以广州北京路汉风粤味美食街招租数据为样本,给出可复现的分析方法。
quantdash_cc1 天前
开发语言·python·数据分析·量化交易·股票数据·quantdash
Python 股票 K 线数据质量校验:字段、缺失值、重复行和价格异常一句话结论:量化策略的可信度取决于数据质量。本文提供一套基于 Python + Pandas 的 K 线数据质量校验流程,覆盖字段完整性、缺失值统计、重复行检测和价格逻辑校验,并展示如何结合 QuantDash 构建自动化数据质量检查管线。
Wang's Blog1 天前
数据分析·自动化·excel
Vibe Coding一人即团队系列62: Excel数据分析与可视化自动化在数据分析与可视化的常规工作流中,Excel 文件处理、数据清洗、图表生成及报告撰写通常需要多部门协作,且耗时数天。借助 Claude 的 Skills 机制,可以将上述流程整合为一条自动化流水线。
wang_yb2 天前
数据分析·databook
Beta 分布:如何用“成功”和“失败”来预测下次尝试想象一下这个场景:明天你要去一家新开的网红餐厅。你翻开点评软件,看到过去 10 个人里,有 7 个人给了好评。
databook2 天前
python·数据挖掘·数据分析
Beta 分布:如何用“成功”和“失败”来预测下次尝试想象一下这个场景:明天你要去一家新开的网红餐厅。你翻开点评软件,看到过去 10 个人里,有 7 个人给了好评。
residual_fan2 天前
算法·数据挖掘·数据分析
数据缺失填补算法之CUR-Estimator在复杂工业装备运行监测与多变量时间序列分析中,传感器偶发故障、工况多变以及采样频率动态调整常常导致序列数据存在非均匀间隔与数据缺失问题。
IT毕设实战小研2 天前
大数据·机器学习·信息可视化·数据分析·毕业设计·旅游
基于大数据的白鹿的抖音评论分析与可视化7> 🔥作者:it毕设实战小研🔥💖简介:java、微信小程序、安卓;定制开发,远程调试 代码讲解,文档指导,ppt制作💖 精彩专栏推荐订阅:在下方专栏👇🏻👇🏻👇🏻👇🏻 Java精彩实战毕设项目案例 小程序精彩项目案例 Python大数据项目案例
2601_962077982 天前
python·机器学习·数据挖掘·数据分析·编程
利用Python,四步掌握机器学习需学习 或者R, 以此来理解以及应用机器学习技术, 这两者是和C、Java、PHP相类似的编程语言, 然而, 因 以及R都较为年轻, 并且更“远离”CPU, 故而它们显得简省一些, 相较于R仅用来处理数据, 借助像是机器学习、统计算法以及漂亮的绘图来分析数据, 的优势是它适用于诸多其他问题。因为凭借更广阔的分布, 也就是运用Jango托管网站, 涉及自然语言处理NLP, 要访问推ter等网站的API, 与此同时, 像存在更多的传统语言那般, 比如较为流行的C。
躺柒2 天前
信息可视化·数据分析·可视化·数据可视化·多媒体·超媒体·跨媒体
读数据可视化23跨媒体数据(上)1.1. 媒体1.1.1. Media1.1.2. 是人与人之间信息交流的中介,是信息的载体,也称为*媒介
Mr数据杨2 天前
人工智能·数据分析·kaggle竞赛
汽车故障时间与类别预测实战 从 Kaggle 结构化赛题理解预测性维护建模这个 Kaggle 赛题表面上是入门练习,实际对应的是典型的车辆故障预测场景。任务核心并非单纯做一次分类提交,而是从结构化运行数据中识别故障发生规律,判断故障类型,并尽量贴近故障发生时点,这与车队运维、售后预警和预测性维护中的真实问题高度一致。
SelectDB技术团队2 天前
数据分析·高并发·技术选型·多表join·查询加速·复杂分析·高频查询
Apache Doris 多表 Join 比 Starrocks 更快?ClickBench 与 RTABench 实测对比摘要:Apache Doris 提供 Bucket Shuffle Join、Colocation Join、Shuffle Join、Broadcast Join 四种 Join 方式,并在多表关联基准上表现突出:ClickBench 多表 Join 分析比 StarRocks 快约 10%、RTABench Hot Run 排名第一、SSB-Flat 100GB 耗时仅为 StarRocks 的一半。SelectDB 是 Apache Doris 的商业化公司,提供企业级支持与云服务。
residual_fan2 天前
人工智能·算法·数据挖掘·数据分析
持续对比强化学习(Continual Contrastive Reinforcement Learning)论文分享在处理复杂时序监测数据与动态演化环境时,传统机器学习模型往往面临训练与部署相互割裂、无法适应数据流持续增长以及类别分布极度不平衡等挑战。论文《Continual contrastive reinforcement learning: Towards stronger agent for environment-aware fault diagnosis of aero-engines through long-term optimization under highly imbalance scenari