浅论数据分析的智能化和自动化趋势

浅论数据分析的智能化自动化趋势

回顾这半年学到的东西,最近体会到数据分析有智能化的趋势,体现在机器学习模型出现在各个数据分析环节,进而导致了数据分析自动化的趋势,即数据分析的各个环节越来越少地需要人工的干预。

首先,接触到是Boruta算法的流行,这是一个用机器学习模型进行相关变量筛选的算法,最早介绍是在2010年,替代的是传统的根据统计学方法结合临床重要性(主观因素),比如P值和Pearson相关性(热图),或线性回归方法,比如Lasso。传统的方法一般都需要人工参与决定变量筛选的标准,比如P值是0.1还是0.05,Lasso的lambda参数是最小值还是其它,而相对Boruta算法的特点是不需要人工选择,不是说没有参数可以设置,而是设置和不设置结果差别不大。

后来,了解到数据缺失值的补充有一个python包叫做datawig,同样是使用机器(深度)学习的算法对缺失数据,包括分类数据和数值数据,进行插补。传统的变量插补的方法,因为不够智能,需要人为地去判断或选择一些插补的方法或者参数,而机器学习的方法明显的特点是少人工干预。

再后来,就是最近和大家介绍的,机器学习+SHAP分析深入分析变量间关系,可以展现变量间的相关性的趋势和关键点以及交互作用,全程也不需要进行太多的干预。

以上方法逐渐形成一种趋势,体现出两点,1.机器学习算法在数据分析领域的应用;2. 数据分析的自动化趋势。之前数据分析过程中需要人工参与的环节,比如变量筛选环节和数据插补环节,因为机器学习的介入,已经不需要太多人工的参与,体现智能化和自动化的趋势。智能化和自动化是一直以来的趋势,变成现实,可能就在最近。

相关推荐
wangqiaowq1 分钟前
FFmpeg的下载使用
人工智能
2601_959480153 分钟前
Moneta Markets亿汇:“芯片巨头开拓处理器市场”
人工智能
Sharewinfo_BJ4 分钟前
Power BI 5月重磅更新:8大新功能全面提升数据分析效率
大数据·人工智能·数据分析
weixin_459778724 分钟前
当 AI 开始理解企业:金融复杂系统下的智能体实践
人工智能·ai·金融·ai编程·ai-native
知识浅谈4 分钟前
人工智能日报 每日AI新闻(2026年5月29日):Claude Opus 4.8、AI 工作流收购与内容版权升温
人工智能
weixin_468466855 分钟前
机器学习与深度学习新手区分指南
人工智能·python·深度学习·机器学习·计算机视觉·ai·机器视觉
AI算法沐枫5 分钟前
基于YOLO26深度学习的【果园荔枝检测与计数】系统设计与实现【python源码+Pyqt5界面+数据集+训练代码】
开发语言·人工智能·python·深度学习·qt·学习·机器学习
AI服务老曹5 分钟前
统一安防底座:基于 GB28181 与 RTSP 的边缘计算 AI 视频管理平台架构演进(附 Docker 部署与源码交付机制)
人工智能·音视频·边缘计算
逻辑君6 分钟前
Foresight研究报告【20260010】
人工智能·算法·机器学习
中电金信6 分钟前
中电金信分布式核心系统与鲲鹏实现“原生开发”,共筑数智金融新范式
大数据·人工智能