R拟合 | 一个分布能看到三个峰,怎么拟合出这三个正态分布的参数? | 高斯混合模型 与 EM算法

1. 效果

已知数据符合上图分布,怎么求下图的三个分布的参数mu, sigma,及每个分布的权重 lambda?

2. 代码: 高斯混合模型(Gaussian Mixture Model,简称GMM)

复制代码
library(mixtools)
set.seed(123) # 确保结果可重复

# 假设x是你的观测数据
x <- rnorm(1000, mean=c(-2, 0, 2), sd=c(1, 1, 1))
x <- c(x, x + 5, x - 5) # 模拟三峰数据

# 绘制密度图
par(mfrow=c(2,1))
plot(density(x), main="三峰密度图", xlab="观测值", xlim=c(-10, 10))

# 拟合三峰正态混合模型
mix <- normalmixEM(x, k=3, maxit=1000, epsilon=1e-4)
summary(mix)
abline(v=mix$mu, col="red", lty=2, lwd=2)

# 绘制拟合结果
# plot(mix, which=2, main="拟合结果")
plot(mix, density = TRUE, w = 1.1)
#plot(mix, which = 2)  # 第2种图,会显示混合分布曲线

3.获取参数

复制代码
> summary(mix)
summary of normalmixEM object:
          comp 1   comp 2   comp 3
lambda  0.513487 0.110986 0.375528
mu     -3.613972 6.917701 2.934937
sigma   2.609374 1.088864 2.020785
loglik at estimate:  -8589.094


> mix$mu
[1] -3.613972  6.917701  2.934937
> mix$sigma
[1] 2.609374 1.088864 2.020785

> mix$lambda
[1] 0.5134868 0.1109857 0.3755276

其中 lambda 是混合模型中的权重参数。每个在0到1之间。和是1。

4.名词解释

  • 高斯混合模型(Gaussian Mixture Model,简称GMM) 是一种概率模型,用于表示由多个高斯分布(正态分布)组成的复杂分布。

  • 谱学习算法(Spectral Learning Algorithms)是一类利用线性代数中的矩阵分解技术来估计模型参数的方法,在自然语言处理、机器学习等领域有广泛的应用。

Ref:

相关推荐
jiang_changsheng1 天前
环境管理工具全景图与深度对比
java·c语言·开发语言·c++·python·r语言
JicasdC123asd1 天前
使用Faster R-CNN模型训练汽车品牌与型号检测数据集 改进C4结构 优化汽车识别系统 多类别检测 VOC格式
r语言·cnn·汽车
请你喝好果汁6411 天前
## 学习笔记:R 语言中比例字符串的数值转换,如GeneRatio中5/100的处理
笔记·学习·r语言
怦怦蓝1 天前
DB2深度解析:从架构原理到与R语言的集成实践
开发语言·架构·r语言·db2
新新学长搞科研1 天前
【CCF主办 | 高认可度会议】第六届人工智能、大数据与算法国际学术会议(CAIBDA 2026)
大数据·开发语言·网络·人工智能·算法·r语言·中国计算机学会
Piar1231sdafa2 天前
战斗车辆状态识别与分类 --- 基于Mask R-CNN和RegNet的模型实现
r语言·cnn
陳土2 天前
R语言Offier包源码—1:read_docx()
r语言
善木科研喵2 天前
IF5.9分,α-硫辛酸如何缓解化疗神经毒性?网络毒理学结合网络药理学双重锁定关键通路!
数据库·数据分析·r语言·sci·生信分析·医学科研
Piar1231sdafa3 天前
椅子目标检测新突破:Cascade R-CNN模型详解与性能优化_1
目标检测·r语言·cnn
Loacnasfhia93 天前
基于Mask R-CNN与RegNetX的钢水罐及未定义物体目标检测系统研究_1
目标检测·r语言·cnn