R语言优雅的进行广义可加模型泊松回归分析

泊松回归(Poisson regression)是以结局变量为计数结果时的一种回归分析。泊松回归在我们的生活中应用非常广泛,例如:1分钟内过马路人数,1天内火车站的旅客流动数,1天内的银行取钱人数,一周内的销售经营数据等等都可以使用泊松回归进行分析。

既往已经有文章《R语言进行泊松回归》初步的介绍了泊松回归,本期介绍下如何使用tidygam包来优雅的进行泊松回归,tidygam包主要是通过mgcv包来进行分析,通过对tidygam包对mgcv包的数据转换后,上手难度大大降低,可以轻松优雅的进行泊松回归分析。

咱们先导入R包和数据,数据使用的是tidygam自带的gest数据

r 复制代码
library(tidygam)
library(mgcv)
library(dplyr)
library(ggplot2)
data("gest")
theme_set(theme_light())

这个数据是一个10、11和12个月婴儿的手势数量的数据,这个数据表包含了来自孟加拉、中国和英国背景的60名婴儿所做的三种手势的计数。我解释一下变量名:dyad是ID标识的意思,background:表明来自哪个国家,months:月份,只有10,11,12共3个月,gesture手势的类型,count:手势的计数,这个是 结局变量

先生成gam模型

r 复制代码
gs <- gam(
  count ~ s(months, k = 3),
  data = gest,
  family = poisson
)

这个模型gam是mgcv包生成的,解析模型,表明月数和手势计数是相关的

生成预测值

r 复制代码
gs_pred <- predict_gam(gs)

绘图,一定要用series标明绘制哪个变量

r 复制代码
gs_pred %>%
  plot(series = "months")

R包介绍,这个时候生成的Y周是count的对数值,因此我们还需要转换一下

r 复制代码
predict_gam(gs, tran_fun = exp) %>%
  plot(series = "months")

如果咱们想了解不同国家的分类,可以再gam函数中设定

r 复制代码
gs_by <- gam(
  count ~ s(months, by = background, k = 3),
  data = gest,
  family = poisson
)

解析模型,表明不同的国家婴儿,手势计数都是和月份相关

r 复制代码
summary(gs_by)

接下来咱们可以绘制分类图形,需要再comparison处指明根据哪个变量分类

r 复制代码
gs_by %>%
  predict_gam(length_out = 20, series = "months", tran_fun = exp) %>%
  plot(comparison = "background")

R包指出,虽然使用plot函数绘图,但是它的本质上是一个ggplot2绘制的图片,所以咱们可以使用ggplot的方法修改它

r 复制代码
gs_by %>%
  predict_gam(length_out = 20, series = "months", tran_fun = exp) %>%
  plot(comparison = "background") +
  scale_color_brewer(type = "qual") + scale_fill_brewer(type = "qual")

咱们如果考虑有2个非连续的变量,可以再模型里面定义

r 复制代码
gs_by_2 <- gam(
  count ~ s(months, by = background, k = 3) +
    s(months, by = gesture, k = 3),
  data = gest,
  family = poisson
)

解析模型,这里虽然有变量交叉,但是这种做法并不是交互效应,应该理解为亚组更加准确

r 复制代码
summary(gs_by_2)

绘图

r 复制代码
gs_by_2 %>%
  predict_gam(length_out = 20, series = "months", tran_fun = exp) %>%
  plot(comparison = "gesture") +
  scale_color_brewer(type = "qual") + scale_fill_brewer(type = "qual") +
  facet_grid(~ background)

如果咱们想了解background和gesture的交互关系,要先生成一个交互变量

r 复制代码
gest <- gest %>%
  mutate(back_gest = interaction(background, gesture))

然后咱们使用这个交互变量进行模型分类

r 复制代码
gs_i <- gam(
  count ~ s(months, by = back_gest, k = 3),
  data = gest,
  family = poisson
)
summary(gs_i)

绘图,

r 复制代码
predict_gam(
  gs_i, tran_fun = exp,
  separate = list(back_gest = c("background", "gesture"))
) %>%
  plot(series = "months", comparison = "gesture") +
  facet_grid(~ background)

这样一个亚组交互图形就生成好啦。

相关推荐
wk灬丨4 小时前
Android Kotlin Flow 冷流 热流
android·kotlin·flow
让学习成为一种生活方式4 小时前
R包下载太慢安装中止的解决策略-R语言003
java·数据库·r语言
晨曦_子画4 小时前
编程语言之战:AI 之后的 Kotlin 与 Java
android·java·开发语言·人工智能·kotlin
大福是小强4 小时前
005-Kotlin界面开发之程序猿初试Composable
kotlin·界面开发·桌面应用·compose·jetpack·可组合
&岁月不待人&6 小时前
Kotlin by lazy和lateinit的使用及区别
android·开发语言·kotlin
小白学大数据9 小时前
正则表达式在Kotlin中的应用:提取图片链接
开发语言·python·selenium·正则表达式·kotlin
小码贾1 天前
评估 机器学习 回归模型 的性能和准确度
人工智能·机器学习·回归·scikit-learn·性能评估
spssau1 天前
多分类logistic回归分析案例教程
分类·数据挖掘·数据分析·回归·回归分析·logistic回归·spssau
qq_433716951 天前
测试分层:减少对全链路回归依赖的探索!
自动化测试·软件测试·功能测试·测试工具·回归·pytest·postman
小馒头学python1 天前
【机器学习】机器学习回归模型全解析:线性回归、多项式回归、过拟合与泛化、向量相关性与岭回归的理论与实践
人工智能·python·机器学习·回归·线性回归