回归模型拟合效果的统计指标: 决定系数 R2 r2 r2_score

决定系数 (Coefficient of Determination),通常用 R 2 R^2 R2 表示,是一种衡量回归模型拟合效果的统计量。它表示模型解释自变量和因变量之间变异程度的比例。决定系数的值在 [ 0 , 1 ] [0, 1] [0,1] 之间,值越接近 1,模型的拟合效果越好。

决定系数的计算公式:

R 2 = 1 − SSR SST R^2 = 1 - \frac{\text{SSR}}{\text{SST}} R2=1−SSTSSR

其中:

  • SSR(残差平方和) :模型的预测值与真实值之间误差的平方和,即:
    SSR = ∑ i = 1 n ( y i − y ^ i ) 2 \text{SSR} = \sum_{i=1}^{n} (y_i - \hat{y}_i)^2 SSR=i=1∑n(yi−y^i)2

    其中, y i y_i yi 是实际值, y ^ i \hat{y}_i y^i 是预测值。

  • SST(总平方和) :实际值与其平均值之间的差异的平方和,即:
    SST = ∑ i = 1 n ( y i − y ˉ ) 2 \text{SST} = \sum_{i=1}^{n} (y_i - \bar{y})^2 SST=i=1∑n(yi−yˉ)2

    其中, y ˉ \bar{y} yˉ 是实际值的平均值。

决定系数的解释:

  1. R² = 1:表示模型完美拟合数据,即所有实际值都被模型准确预测。
  2. R² = 0:表示模型的预测效果与简单的平均值预测效果相同。即,模型没有解释因变量的变异。
  3. R² < 0 :当模型的预测值比平均值预测得更差时, R 2 R^2 R2 可以为负数,这表示模型没有任何解释能力。

决定系数的意义:

  • 决定系数可以用来衡量模型对数据的解释力。较高的 R 2 R^2 R2 表明模型较好地解释了数据中的变异,但它不能直接说明模型是否是最优模型,或是否适合所有情况。
  • R 2 R^2 R2 仅衡量线性关系的好坏,对于非线性回归模型,可能需要使用其他性能度量指标(如调整后的 R 2 R^2 R2、AIC、BIC 等)。

示例:如何解释 R 2 R^2 R2

假设在一个简单的线性回归中, R 2 = 0.85 R^2 = 0.85 R2=0.85,这意味着模型可以解释 85% 的数据变异,而剩余的 15% 可能是由于其他未被模型捕捉的因素导致的误差。

总结来说,决定系数 R 2 R^2 R2 是用于评估回归模型性能的重要指标,特别是衡量模型对数据中变异的解释能力。

相关推荐
杜子不疼.2 分钟前
计算机视觉热门模型手册:Spring Boot 3.2 自动装配新机制:@AutoConfiguration 使用指南
人工智能·spring boot·计算机视觉
无心水2 小时前
【分布式利器:腾讯TSF】7、TSF高级部署策略全解析:蓝绿/灰度发布落地+Jenkins CI/CD集成(Java微服务实战)
java·人工智能·分布式·ci/cd·微服务·jenkins·腾讯tsf
北辰alk7 小时前
RAG索引流程详解:如何高效解析文档构建知识库
人工智能
九河云7 小时前
海上风电“AI偏航对风”:把发电量提升2.1%,单台年增30万度
大数据·人工智能·数字化转型
wm10437 小时前
机器学习第二讲 KNN算法
人工智能·算法·机器学习
沈询-阿里8 小时前
Skills vs MCP:竞合关系还是互补?深入解析Function Calling、MCP和Skills的本质差异
人工智能·ai·agent·ai编程
xiaobai1788 小时前
测试工程师入门AI技术 - 前序:跨越焦虑,从优势出发开启学习之旅
人工智能·学习
盛世宏博北京8 小时前
云边协同・跨系统联动:智慧档案馆建设与功能落地
大数据·人工智能
TGITCIC9 小时前
讲透知识图谱Neo4j在构建Agent时到底怎么用(二)
人工智能·知识图谱·neo4j·ai agent·ai智能体·大模型落地·graphrag
逆羽飘扬9 小时前
DeepSeek-mHC深度拆解:流形约束如何驯服狂暴的超连接?
人工智能