概率论-独立同分布

独立同分布(i.i.d.,Independent and Identically Distributed)

随机变量序列中每个变量相互独立服从同一概率分布

维度 说明
独立 每个样本的取值不影响其他样本。例如,抛硬币10次,第5次结果不影响第6次。
同分布 所有样本来自同一个概率分布。例如,抛同一枚公平硬币10次,每次正面概率均为0.5。

例子

  1. 抛硬币

    连续抛掷同一枚公平硬币10次,每次结果独立且正面概率恒为0.5 → 这是i.i.d.。

  2. 非i.i.d.的反例

    • 非独立:第一次抛硬币的结果决定第二次是否抛硬币(如"正面则停止")。
    • 非同分布:前5次用公平硬币,后5次改用正面概率0.8的偏硬币。

扩展

为什么机器学习需要i.i.d.?

  • 训练集与测试集需同分布:若训练数据来自"夏季西瓜",测试数据却是"冬季西瓜",模型会失效(分布偏移)。
  • 理论保证:泛化误差界(如Hoeffding不等式)的推导依赖i.i.d.假设。

真实数据常违反i.i.d.(如时间序列、用户行为随时间变化),此时需领域自适应重加权等技术修正。

相关推荐
大江东去浪淘尽千古风流人物4 天前
【SLAM】GenRobot / IO-AI / Scale / Appen 能力对比表(机器人数据与闭环视角)
人工智能·机器学习·机器人·大模型·概率论·端侧部署·巨身智能
陆嵩7 天前
GMRES 方法的数学推导及其算法表示
算法·概率论·arnoldi·gmres·minres·givens·hessenberg
niuniudengdeng12 天前
基于时序上下文编码的端到端无文本依赖语音分词模型
人工智能·数学·算法·概率论
SCLchuck12 天前
人工智能-概率密度估计
人工智能·python·概率论·概率密度估计
MPCTHU12 天前
随机信号分析| 01 随机信号分析大纲
概率论·信号
杨哥儿12 天前
探秘离散时间更新过程:固定配额下的稳态年龄分布研究
线性代数·机器学习·概率论
MPCTHU13 天前
随机信号分析|04 带通随机信号
概率论·信号
闻缺陷则喜何志丹13 天前
【高等数学】导数与微分
c++·线性代数·算法·矩阵·概率论
MPCTHU13 天前
随机信号分析| 05 随机信号通过线性系统
概率论·信号
MPCTHU13 天前
随机信号分析| 02 随机信号的平稳性分析
概率论·信号