(CDA数据分析师笔记)第六章 业务分析方法十一

第四章描述性统计分析

概述

统计学解决问题的步骤:收集数据、处理数据、分析数据、解释数据。

收集数据是数据分析的前提,直接来源的数据是一手数据,间接来源的数据是二手数据。

调查和实验的区别:调查强调的是不对数据对象进行干扰,任其自然发展,收集发展过程中的数据;实验强调的是有目的的对数据对象进行因素干扰,从而验证这些因素对数据对象是否产生影响,以及产生何种影响。

处理数据:包括将收集的数据进行数据编码、数据库搭建、数据录入、数据审核(包括数据完整性、准确性、时效性、适用性等。)按照研究问题的需要进行数据筛选、数据分组、数据分割、数据合并、数据变形、数据转换等;并进行数据质量评估、数据特征分析、数据可视化分析等探索性分析;这主要是数据清洗岗位的工作。

分析数据:是数据分析师的核心工作。数据分析方法分两大类,描述性统计分析方法和推断性统计分析方法。

描述性统计分析方法:结合数据,对实际问题进行分布特征的描述,也称数据分布特征的描述性分析方法。

推断性统计分析方法:根据掌握的样本数据对总体进行估计或检验,侧重于对总体特征的估计或检验推断,即包括参数估计、假设检验。

参数估计:当总体信息未知时,通过抽取样本来估计总体信息。

假设检验:假设知晓总体某个信息,但无法确认信息是否正确,因此需要抽取样本信息进行假设检验。

注意:部分人认为预测也是推断性统计分析方法中的一种。原因是估计和预测的不同,估计时,总体是存在的、确定的、未知的,即对一个已经发生的事物状态进行估计。预测时,预测的情况是不存在的、不确定的、未知的,即对一个未发生的事物进行预测。两者一个是事后估计,一个是事前预测,本质不同。

复杂数据分析方法:以基本数据分析方法为基础,常结合某类具体问题、某类特殊数据、某类特殊对象等,融合描述性统计分析方法和推断性统计分析方法。例如:相关分析、时间序列分析、生存分析。

解释数据:统计学最后的环节,连接分析数据与解决实际问题的重要桥梁。

相关推荐
小叶爱吃鱼34 分钟前
python-数据可视化(大数据、数据分析、可视化图像、HTML页面)
大数据·python·信息可视化·数据分析
笑鸿的学习笔记1 小时前
虚幻引擎5-Unreal Engine笔记之摄像头camera
笔记·ue5·虚幻
JJ1M81 小时前
MYSQL笔记
数据库·笔记·mysql
IT从业者张某某1 小时前
信奥赛-刷题笔记-栈篇-T2-P1165日志分析0519
android·java·笔记
lilye662 小时前
精益数据分析(71/126):从移情到黏性——创业阶段的关键跨越与数据驱动策略
数据挖掘·数据分析
一张假钞2 小时前
平均与方差
数据分析
逼子格2 小时前
硬件工程师笔记——三极管Multisim电路仿真实验汇总
笔记·嵌入式硬件·硬件工程·硬件工程师·三极管·硬件工程师真题·multisim电路仿真
杨超越luckly2 小时前
HTML应用指南:利用POST请求获取全国申通快递服务网点位置信息
大数据·前端·信息可视化·数据分析·html
breaksoftware2 小时前
51单片机编程学习笔记——无源蜂鸣器演奏《祝你生日快乐》
笔记·学习·51单片机
huangyuchi.2 小时前
【Linux】初见,基础指令
linux·运维·服务器·笔记·开发工具·指令·基础指令