数据分析师之Excel数据清洗

前言

目前,掌握一定的Excel技能时,怎么通过自己的技能实现数据分析的操作,就需要进行具体项目的实战,本身数据分析这个行业是非常吃经验的,既然我们是小白入坑,就需要多做实战演练,才能够实际的拿到这一行的敲门砖

数据分析流程

分析流程:明确需求->确认思路->处理数据->分析数据->展示数据,撰写报告->效果反馈

处理数据

数据清洗:选择子集->列名重命名->删除重复值->缺失值处理->一致化处理

**删除重复值:**找到不可重复的字段(例如ID之类),观察重复值是否完全一致,后保留唯一项

**缺失值处理:**缺失值数量较少,可直接删除该行数据;文本型,如果和其他列有关联关系(如省份和地州),可以自行判断填充,若实在无关联关系,可以放弃该维度的分析;缺失值数量大,数值型进行填充(均值、中位数)

**一致化处理:**对于某些数据列,需要规范数据类型之类的内容

**异常值处理:**对于某些数据是不符合需求要求的数据可以进行剔除

相关推荐
cxr82839 分钟前
BMAD-METHOD 54个高级引导方法深度研究简报
大数据·人工智能
Crazy CodeCrafter44 分钟前
租金要交,但客流为零,要关店了?
大数据·运维·经验分享·自动化·开源软件
我不介意孤独1 小时前
Ray + LanceDB + Daft 构建大规模向量数据分析管道
数据挖掘·数据分析·分布式计算·ray·lancedb·daft·大规模数据分析
最初的↘那颗心2 小时前
Spark Job 调度机制拆解:从 Action 算子到 Task 执行
大数据·spark·分布式计算
wuyaolong0072 小时前
PostgreSQL 中进行数据导入和导出
大数据·数据库·postgresql
balmtv2 小时前
Claude技术架构深度拆解:从宪法AI到混合推理智能体的演进之路
大数据·人工智能·架构
Lab_AI3 小时前
电子实验记录本(ELN)助力熙华药业核心竞争力提升
大数据·人工智能·实验室管理·eln·药物研发·ai制药·电子实验记录本
diygwcom3 小时前
vue3+handsontable实现在线可编辑excel
excel
hg01183 小时前
2026年非洲能源大会在南非开普敦开幕
大数据·能源
Hello.Reader3 小时前
Flink Task Lifecycle 一篇讲透 StreamTask 与 Operator 生命周期
java·大数据·flink