数据分析师之Excel数据清洗

前言

目前,掌握一定的Excel技能时,怎么通过自己的技能实现数据分析的操作,就需要进行具体项目的实战,本身数据分析这个行业是非常吃经验的,既然我们是小白入坑,就需要多做实战演练,才能够实际的拿到这一行的敲门砖

数据分析流程

分析流程:明确需求->确认思路->处理数据->分析数据->展示数据,撰写报告->效果反馈

处理数据

数据清洗:选择子集->列名重命名->删除重复值->缺失值处理->一致化处理

**删除重复值:**找到不可重复的字段(例如ID之类),观察重复值是否完全一致,后保留唯一项

**缺失值处理:**缺失值数量较少,可直接删除该行数据;文本型,如果和其他列有关联关系(如省份和地州),可以自行判断填充,若实在无关联关系,可以放弃该维度的分析;缺失值数量大,数值型进行填充(均值、中位数)

**一致化处理:**对于某些数据列,需要规范数据类型之类的内容

**异常值处理:**对于某些数据是不符合需求要求的数据可以进行剔除

相关推荐
chemddd3 小时前
excel 工作需要会的
excel
好开心啊没烦恼4 小时前
Python 数据分析:计算,分组统计1,df.groupby()。听故事学知识点怎么这么容易?
开发语言·python·数据挖掘·数据分析·pandas
醇氧5 小时前
【wps】 excel 删除重复项
excel·wps
盛夏绽放13 小时前
Vue3 中 Excel 导出的性能优化与实战指南
vue.js·excel
诗旸的技术记录与分享13 小时前
Flink-1.19.0源码详解-番外补充3-StreamGraph图
大数据·flink
资讯分享周14 小时前
Alpha系统联结大数据、GPT两大功能,助力律所管理降本增效
大数据·gpt
G皮T15 小时前
【Elasticsearch】深度分页及其替代方案
大数据·elasticsearch·搜索引擎·scroll·检索·深度分页·search_after
TDengine (老段)15 小时前
TDengine STMT2 API 使用指南
java·大数据·物联网·时序数据库·iot·tdengine·涛思数据
Tomorrow'sThinker16 小时前
[特殊字符] Python 自动查找替换 Excel 单元格内容 —— 高效批量处理
excel
Shipley Leo16 小时前
如何在Excel中每隔几行取一行
excel