决定系数R2 浅谈三 : 决定系数R2与相关系数r的关系、决定系数R2是否等于相关系数r的平方

今天浅谈一下本人对决定系数R2相关系数r 的理解,我们在做回归分析、简单线性回归、多元线性回归、对模型进行算法训练时,常常会见到决定系数R2和相关系数r,在很多资料中对这两者的关系解释也是含糊不清,有的说决定系数R2就是等于相关系数r,有的说他两没有任何关系。那么两者到底有无关系请看我关于两者的一些讨论。

1 相关系数r(Correlation coefficient)

相关系数r的定义如下:

由以上定义式可知,相关系数r描述的时自变量 X与因变量Y之间的线性关系强度和方向

2 决定系数 R2(coefficient of determination)

决定系数R2衡量的是回归模型所能解释的变异量占总变异量 的比例,其中关于决定系数R2的定义可以参考我前面的文章,此处便不再定义,文章链接如下:决定系数R2 浅谈一 : 决定系数R2为什么计算出来小于0/为负数、大于1/远大于1、决定系数R2为什么计算出来不在0~1之间-CSDN博客

3 R2与r2的关系

两者何时才能等价呢,实际上决定系数R2和相关系数r2只有在简单线性回归 中才能是完全等价 的,此处的等价也仅限于 最后的结果相等

简单线性回归 指的就是一元线性回归,即一个自变量和一个因变量。

实际上,我们根据决定系数和相关系数的定义就可以得知,两者完全不是一个概念上的东西

1)决定系数的计算只跟预测值和观测值相关,说直白点,它最终的计算结果只与因变量Y相关。

2)相关系数的计算涉及到自变量和因变量,并未涉及到预测值。

3)相关系数r一般是在建模前对数据集中的自变量X和因变量Y进行一个相关性分析;

4)而决定系数R2是在对数据集建模后对预测值和观测值进行一个计算,来观察模型的预测效果,两者的计算目的都不相同。

4 结论

1)当模型是简单线性回归时(一元线性回归),决定系数R2的计算结果等于相关系数r的平方。

2)当模型涉及多个自变量(两个及以上)时,决定系数R2的计算结果等于相关系数r的平方两者计算结果不相等。

3)相关系数r反应的是自变量与因变量之间的线性程度;决定系数R2反应的是回归模型对数据集的拟合程度;两者并无联系。

以上也仅仅是个人总结的观点,具体证明可参考统计学的书籍和相关资料。

如有不足之处,还请各位批评指正!

记得点赞,收藏,关注一键三连,谢谢未来的各位工程师、教授、院士......!

相关推荐
hkNaruto几秒前
【AI】AI学习笔记:直接使用Python+BM25算法实现RAG的可行性以及实用价值
人工智能·笔记·学习
琛説2 分钟前
【时间序列】MSSP股票数据集(含市场情绪、上证指数等指标)
深度学习·数据分析
Lv11770089 分钟前
WinForm常用控件功能介绍及使用模板
笔记·c#·visual studio·winform
飞Link12 分钟前
【Water】数据增强中的数据标注、数据重构和协同标注
算法·重构·数据挖掘
棒棒的皮皮16 分钟前
【深度学习】YOLO 模型典型应用场景分析(安防 / 自动驾驶 / 工业质检 / 医疗影像 / 智慧城市)
人工智能·深度学习·yolo·计算机视觉·自动驾驶
week_泽17 分钟前
第7课:管理长期记忆的关键架构决策 - 学习笔记_7
java·笔记·学习·ai agent
koo36418 分钟前
pytorch深度学习笔记15
pytorch·笔记·深度学习
漫随流水21 分钟前
leetcode算法(559.N叉树的最大深度)
数据结构·算法·leetcode·二叉树
池塘的蜗牛22 分钟前
NR PDSCH和CSI 正交导频设计
算法
CodeCaptain25 分钟前
dify的知识检索在编排中的释义与作用
经验分享·ai·dify