机器学习 - 模型性能评估

F1度量

F1度量是用于评估分类模型性能的一个综合指标,它同时考虑了查准率(Precision, P)和查全率(Recall, R)。F1度量的公式如下:

F 1 = 2 × P × R P + R F1 = \frac{2 \times P \times R}{P + R} F1=P+R2×P×R

其中,查准率和查全率的定义分别是:

  • 查准率(P): P = T P T P + F P P = \frac{TP}{TP + FP} P=TP+FPTP
  • 查全率(R): R = T P T P + F N R = \frac{TP}{TP + FN} R=TP+FNTP

其中,TP(True Positive)是真正例,FP(False Positive)是假正例,FN(False Negative)是假负例。

F1度量也可以写成:

F 1 = 2 × T P 样例总数 + T P − T N F1 = \frac{2 \times TP}{\text{样例总数} + TP - TN} F1=样例总数+TP−TN2×TP

在右上角,还给出了F1的倒数形式:

1 F 1 = 1 2 ( 1 P + 1 R ) \frac{1}{F1} = \frac{1}{2} \left( \frac{1}{P} + \frac{1}{R} \right) F11=21(P1+R1)

加权F度量(Fβ)

如果我们对查准率和查全率有不同的偏好,可以使用加权F度量(Fβ),其中β是一个权重参数。Fβ的公式为:

F β = ( 1 + β 2 ) × P × R ( β 2 × P ) + R F_{\beta} = \frac{(1 + \beta^2) \times P \times R}{(\beta^2 \times P) + R} Fβ=(β2×P)+R(1+β2)×P×R

其中,β的值决定了查准率和查全率的权重:

  • 当β > 1时,查全率的权重更大。
  • 当β < 1时,查准率的权重更大。

在图片中,还给出了Fβ的倒数形式:

1 F β = 1 1 + β 2 ( 1 P + β 2 R ) \frac{1}{F_{\beta}} = \frac{1}{1 + \beta^2} \left( \frac{1}{P} + \frac{\beta^2}{R} \right) Fβ1=1+β21(P1+Rβ2)

这个公式可以帮助我们理解在不同的β值下,查准率和查全率对Fβ的贡献。

总结:

  • F1度量 是查准率和查全率的调和平均。
  • 加权F度量(Fβ) 允许我们对查准率和查全率给予不同的权重。
相关推荐
G皮T3 小时前
【人工智能】ChatGPT、DeepSeek-R1、DeepSeek-V3 辨析
人工智能·chatgpt·llm·大语言模型·deepseek·deepseek-v3·deepseek-r1
九年义务漏网鲨鱼3 小时前
【大模型学习 | MINIGPT-4原理】
人工智能·深度学习·学习·语言模型·多模态
元宇宙时间4 小时前
Playfun即将开启大型Web3线上活动,打造沉浸式GameFi体验生态
人工智能·去中心化·区块链
开发者工具分享4 小时前
文本音频违规识别工具排行榜(12选)
人工智能·音视频
产品经理独孤虾4 小时前
人工智能大模型如何助力电商产品经理打造高效的商品工业属性画像
人工智能·机器学习·ai·大模型·产品经理·商品画像·商品工业属性
老任与码4 小时前
Spring AI Alibaba(1)——基本使用
java·人工智能·后端·springaialibaba
蹦蹦跳跳真可爱5894 小时前
Python----OpenCV(图像増强——高通滤波(索贝尔算子、沙尔算子、拉普拉斯算子),图像浮雕与特效处理)
人工智能·python·opencv·计算机视觉
雷羿 LexChien4 小时前
从 Prompt 管理到人格稳定:探索 Cursor AI 编辑器如何赋能 Prompt 工程与人格风格设计(上)
人工智能·python·llm·编辑器·prompt
两棵雪松5 小时前
如何通过向量化技术比较两段文本是否相似?
人工智能
heart000_15 小时前
128K 长文本处理实战:腾讯混元 + 云函数 SCF 构建 PDF 摘要生成器
人工智能·自然语言处理·pdf