数据分析师之Excel数据清洗

前言

目前,掌握一定的Excel技能时,怎么通过自己的技能实现数据分析的操作,就需要进行具体项目的实战,本身数据分析这个行业是非常吃经验的,既然我们是小白入坑,就需要多做实战演练,才能够实际的拿到这一行的敲门砖

数据分析流程

分析流程:明确需求->确认思路->处理数据->分析数据->展示数据,撰写报告->效果反馈

处理数据

数据清洗:选择子集->列名重命名->删除重复值->缺失值处理->一致化处理

**删除重复值:**找到不可重复的字段(例如ID之类),观察重复值是否完全一致,后保留唯一项

**缺失值处理:**缺失值数量较少,可直接删除该行数据;文本型,如果和其他列有关联关系(如省份和地州),可以自行判断填充,若实在无关联关系,可以放弃该维度的分析;缺失值数量大,数值型进行填充(均值、中位数)

**一致化处理:**对于某些数据列,需要规范数据类型之类的内容

**异常值处理:**对于某些数据是不符合需求要求的数据可以进行剔除

相关推荐
洛克大航海2 小时前
Ubuntu安装Hbase
大数据·linux·数据库·ubuntu·hbase
GIOTTO情3 小时前
媒介宣发的技术革命:Infoseek如何用AI重构企业传播全链路
大数据·人工智能·重构
ApacheSeaTunnel4 小时前
新兴数据湖仓手册·从分层架构到数据湖仓架构(2025):数据仓库分层的概念与设计
大数据·数据仓库·开源·数据湖·dataops·白鲸开源·底层技术
落雪财神意4 小时前
股指10月想法
大数据·人工智能·金融·区块链·期股
柳贯一(逆流河版)4 小时前
ElasticSearch 实战:全文检索与数据聚合分析的完整指南
大数据·elasticsearch·全文检索
白鲸开源4 小时前
最佳实践:基于Apache SeaTunnel从MySQL同步到PostgreSQL
大数据·mysql·postgresql
QYResearch4 小时前
2025年全球移动变电站市场占有率及行业竞争格局分析报告
大数据
字节跳动数据平台4 小时前
为何底层数据湖决定了 AI Agent 的上限?
大数据
QYResearch4 小时前
自主机器人扫雪机行业现状与分析
大数据