吴恩达机器学习笔记 二十七 决策树中连续值特征的选择 回归树

还是猫狗分类的案例,假如再增加一个特征weight,该值是一个连续的值,如何在决策树中使用该特征?

如下图所示,尝试不同的阈值 ,如 weight<=9 , 此时左边有四个样本,都为猫,右边有六个样本,其中一个为猫,计算信息增益(绿色的那个)。同理,把条件设为weight<=8,划分后左边有两个样本,全是猫,右边有八个样本,其中三个是猫,计算信息增益(蓝色的那个),可以发现边界设为9时信息增益最大,所以就按照这个标准分。

决策树用于分类问题-->推广到回归问题:回归树

用决策树来预测一个数字而不是类别

用于回归问题时,我们不追求减少熵,而是期望能够降低分类后每个子集 weight 的方差 。如下图,计算不同分类后的左右两支子树的带权重方差和,再用根节点的方差减去这个数,得到方差的减少量,方差减少的越多越好,所以选择 ear shape 作为分割特征。

相关推荐
三块可乐两块冰18 分钟前
【第二十二周】机器学习笔记二十一
人工智能·笔记·机器学习
IMPYLH21 分钟前
Lua 的 type 函数
开发语言·笔记·后端·junit·lua
永远都不秃头的程序员(互关)25 分钟前
昇腾CANN算子开发实践:从入门到性能优化
人工智能·python·机器学习
明月照山海-27 分钟前
机器学习周报二十五
人工智能·机器学习
YANshangqian29 分钟前
QOwnNotes(事务笔记管理)
笔记
思成不止于此38 分钟前
MySQL 查询基础(一):列选择、算数运算与别名使用
数据库·笔记·sql·学习·oracle
m0_704887891 小时前
Day 27
人工智能·python·机器学习
木枷1 小时前
LLama-factory数据报错
人工智能·机器学习·llama
深蓝海拓1 小时前
用于优化和改进YOLO11的一些方法
人工智能·python·yolo·机器学习
犯困的橘子1 小时前
PCIE Latency Tolerance Reporting (LTR) Mechanism笔记
笔记·pcie ltr