方差和标准差

核心定义

标准差 是衡量一组数据离散程度波动大小的最常用、最重要的指标。它描述的是数据点相对于其平均值的平均偏离距离。

简单来说:

  • 标准差小 → 数据点紧密围绕在平均值周围,波动小,更稳定。

  • 标准差大 → 数据点分散得离平均值远,波动大,变异性强。


为什么需要标准差?(与平均值的对比)

平均值告诉我们数据的"中心"在哪里,但它掩盖了数据的分布情况。

例如:两个班级的数学平均分都是75分。

  • A班分数:[74, 75, 76, 75, 75] → 非常集中。

  • B班分数:[90, 60, 100, 50, 55] → 非常分散。

它们的平均值相同 ,但离散程度天差地别。标准差就是用来量化这种"离散程度"的。


计算公式与符号

  1. 总体标准差:当你的数据是整个研究群体时使用。

  • σ:总体标准差(读作"西格玛")

  • N:总体中数据的个数

  • xix:每个数据点

  • μ:总体平均值

  1. 样本标准差:当你的数据只是从总体中抽取的一个样本时使用(更常见)。

    • s:样本标准差

    • n:样本中数据的个数

    • xˉ:样本平均值

    • 关键区别 :分母是 n−1 而不是 n,这称为"贝塞尔校正",目的是用样本标准差来无偏估计总体标准差。

计算步骤(以样本标准差为例):

  1. 计算样本平均值 xˉ。

  2. 计算每个数据点与平均值的差:xi−xˉ。

  3. 将每个差值平方:(xi−xˉ)2为了消除负号并放大较大偏差)。

  4. 求这些平方差的:∑(xi−xˉ)2∑(xi​−xˉ)2。

  5. 除以 n−1,得到方差 s2s2。

  6. 方差 开平方根,即得到标准差 s。

关键点与解释

  1. 单位 :标准差的单位和原始数据的单位相同(因为方差开了平方根),这使其比方差更易于解释。

  2. 经验法则(正态分布)

    对于一个近似正态分布的数据集:

    • 约68%的数据落在均值 ±1 个标准差范围内。

    • 约95%的数据落在均值 ±2 个标准差范围内。

    • 约99.7%的数据落在均值 ±3 个标准差范围内

相关推荐
阿古大王14 小时前
Youtube视频笔记工具怎么选:NoteAi、billNotes、NoteGPT 横向对比
人工智能
科技新资讯14 小时前
AIGC重构工业设计 一号设计解锁智造新势能
人工智能·重构·aigc
东方小月14 小时前
从零开发一个 Coding Agent(八):如何使用 Agent 类管理对话状态
前端·人工智能
这张生成的图像能检测吗14 小时前
(论文速读)基于鸡群算法变分模式分解的超低温振动传感器去噪
人工智能·信号处理·信号去噪·鸡群算法·模态分解
AI即插即用14 小时前
即插即用系列 | IEEE TMI PLG-HN:原型学习引导的 CNN-Transformer 混合网络,攻克乳腺肿瘤分割难题
人工智能·深度学习·神经网络·学习·目标检测·cnn·transformer
AIyy86615 小时前
2026小红书封面AI绘图工具横评:实测各平台出图质感与平台适配度
人工智能
致Great15 小时前
科研人的 AI,不该只回答问题:我用字节TraeWork 跑了一遍真实研究任务
算法
纵有疾風起15 小时前
线性表的定义与基本操作 — 从逻辑结构到 ADT 接口
数据结构·算法·408·线性表·adt
自由能燃气设备15 小时前
燃气容积式热水器厂家选购指南:2026年商用热水设备采购避坑手册
大数据·数据库·数据仓库·人工智能
Nomarsgo15 小时前
3C电子智能制造产线嵌入式工控机解决方案——基于研华 MIC-770H 打造高性能、紧凑型智能制造边缘控制平台
人工智能·科技·视觉检测·电脑·制造