数据分析的具体流程

1.导入
  • 表格导入数据时要注意数据的格式问题
  • 非表格导入

可以先将文档放入word中

将换行符(^p)替换为|||,选择特殊格式中的段落标记

进行全部替换

以每一列最后的数据/平,作为换行的标志

将所整理的信息导入excel,对数据进行分列

选择分隔符合

因为是多个|,所以要勾选连续

选择分列的时候,要在后面新插入一列,否则会把后面的数据覆盖掉

或者可以选择固定的宽度进行分列

2.清洗
  • 清洗的对象
  • 合并的单元格

如果是整列的空值并且填充(ctrl+g)

选择空值

输入等号选择K2

ctrl+enter(填充完成)

取消零散的合并的单元格ctrl+f

查找替换,选择选项

选择对齐-选合并的单元格

  • 空值或空行ctrl+g

直接用空值定位,用其余的颜色表示

使用counta( )函数,统计非空单元格个数(ctrl+enter)查看个数

进行筛选,选择非总数的个数

  • 重复值

1.利用提亮的方式判断数据是否一致

提亮重复值

2.直接删除重复值

  • 脏数据(图片,批注,空格,对齐方式)

上面是空格,下面什么也没有,将空格进行提亮(ctrl+h)

有这个样子的批注信息

清除批注

有一些杂乱的图片信息(ctrl+g)选择对象 ctrl+x直接删除图片

  • 数据的提取

1.直接提取信息

提取生日,尽量使用文本,因为日期的省略零 的位数不同,后面生不成

选中生日这一列,然后ctrl+e智能识别点击确定

点击数据分列,转换为日期

2.直接通过分列进行提取

直接进行分列

需要中间这部分,将数据类型改为日期

  • 数据的分离

vlookup分离

  • 数据的校验

检查错误的和空格用颜色提亮标出(ctrl+g)

计数或数值计数(有助于发现错误)

  • 数据验证功能
3.处理
4.展现

1.子表格(sheet1 )重命名

2.想让别人看到哪里就在哪里保存退出

3.行高列宽要好看(直接双击上面的边缘)

4.表头配色,冻结首行,进行筛选

5.条件格式(突出显示、数据条、图标集、色阶)

6.筛选和排序

文本筛选,数字筛选,日期筛选

自定义筛选和多条件筛选

?代表单个的任意字符*代表任意多个字符

自定义排序

相关推荐
饼干哥哥4 天前
开源Skills|搭建亚马逊动态关键词库系统,每天抓SSS级机会词
人工智能·深度学习·数据分析
倔强的石头_6 天前
企业工商数据源站点:无验证无拦截,批量获取工商数据完整方案
数据分析
hboot12 天前
AI工程师第二课 - 数据处理
人工智能·python·数据分析
王小王-12313 天前
基于 Hive 的网易云音乐数据分析及可视化系统
hive·hadoop·数据分析·音乐数据分析·网易云音乐分析·hive音乐分析·hadoop网易云
Database_Cool_13 天前
大规模数据分析降本指南:AnalyticDB Serverless 弹性架构实战
数据仓库·阿里云·架构·数据分析·serverless
YangYang9YangYan13 天前
2026初入职场学习数据分析的价值
学习·数据挖掘·数据分析
有Li13 天前
PTCMIL:基于提示 token 聚类的全切片图像多实例学习分析文献速递/多模态医学影像最新进展
论文阅读·学习·数据挖掘·聚类·文献·医学生
数睿数据无代码开发13 天前
打破数据孤岛:深度解析 smardaten 数据连接器核心功能
数据挖掘·无代码
砚底藏山河13 天前
沪深A股:如何获取基金持股数据
java·python·数据分析·maven
jarreyer13 天前
【数据分析绘图】excel绘图和bi工具区别
数据挖掘·数据分析·excel