【R基础】一组数据计算均值、方差与标准差方法及意义

【R基础】一组数据计算均值、方差与标准差方法及意义

均值、方差与标准差是用来描述数据分布情况

均值:用来衡量一组数据整体情况。

数据离散程度度量标准:

方差(均方,s^2,总体参数,离均差平方和):衡量数据集内样本间分散程度。单位是平方,没具体意义,故使用标准差。

总体方差

s2=[(x1-x)2 +...(xn-x)^2]/n

标准差(又称:均方差):是方差的算术平方根,单位与总体一致。

s=sqrt(s^2)

描述数据的离散程度,反映数据与其均值间的偏离程度,绝对值越大,数据越分散,数据间差异性越大,代表大部分数值和其平均值之间差异较大。较小的标准差,代表这些数值较接近平均值,数据集中。

平均数相同的两组数据,标准差未必相同。

变异系数CV=标准差/均值 *100%

平均值+标准差:

假设一组数据完全符合状态分布,那么这个数据集中 均值± 标准差可以快速了解数据集的整体变动情况。样本值落入-σ 到+σ即±σ区间的概率为68.3%;落入±2σ和±3σ区间的概率分别为95.4%和99.7%

标准误: 也称标准误差,,是描述对应的样本统计量抽样分布的离散程度及衡量对应样本统计量抽样误差大小的尺度。样本容量越大,标准误越小,那么抽样误差就越小,就表明所抽取的样本能够较好地代表总体。



R语言实操

javascript 复制代码
> # 创建一个样本数据
> data <- c(1:15)
> # 均值
> m<-mean(data)
> #计算标准差SD
> s<-sd(data)
> # 样本容量
> n<-length(data)
> #计算标准误
> se<-s/sqrt(n)
> m
[1] 8
> s
[1] 4.472136
> n
[1] 15
> se
[1] 1.154701
m
[1] 8
> s
[1] 4.472136
> n
[1] 15
> se
[1] 1.154701
相关推荐
坚果派·白晓明7 小时前
【鸿蒙PC三方库移植适配框架解读系列】第八篇:扩展lycium框架使其满足rust三方库适配
c语言·开发语言·华为·rust·harmonyos·鸿蒙
花间相见7 小时前
【PaddleOCR教程01】PP-OCRv5 全面指南:从模型架构到实战部署
开发语言·r语言
小短腿的代码世界7 小时前
Qt 股票订单撮合引擎:高频交易系统的核心心脏
开发语言·数据库·qt·系统架构·交互
谙弆悕博士9 小时前
快速学C语言——第16章:预处理
c语言·开发语言·chrome·笔记·创业创新·预处理·业界资讯
yuan199979 小时前
基于 C# 实现的 Omron HostLink (FINS) 协议 PLC 通讯
开发语言·c#
qq_4228286210 小时前
android图形学之SurfaceControl和Surface的关系 五
android·开发语言·python
如竟没有火炬11 小时前
用队列实现栈
开发语言·数据结构·python·算法·leetcode·深度优先
折哥的程序人生 · 物流技术专研11 小时前
《Java 100 天进阶之路》第17篇:Java常用包装类与自动装箱拆箱深入
java·开发语言·后端·面试
C+++Python11 小时前
C 语言 动态内存分配:malloc /calloc/realloc /free
c语言·开发语言
水木流年追梦12 小时前
大模型入门-应用篇3-Agent智能体
开发语言·python·算法·leetcode·正则表达式