机器学习(五)--决策树

决策树

一种对实例进行分类 的树形结构,通过多层判断区分目标所属类别本质:通过多层判断,从训练数据集中归纳出一组分类规则。

优点:

➤ 计算量小,运算速度快

➤ 易于理解,可清晰查看各属性的重要性

缺点:

➤ 忽略属性间的相关性

➤ 样本类别分布不均匀时,容易影响模型表现

不同特征建立不同的决策树

决策树的构造

ID3利用信息熵原理选择信息增益最大的属性作为分类属性,递归地拓展决策树的分枝,完成决策树的构造

信息熵(entropy)是度量随机变量不确定性 的指标,熵越大,变量的不确定性就越大。

追问1:没太理解信息熵的,举个例子说明

追问2:知道了信息熵,那他对决策树有什么用处呢?

比如说以下是一个判读是否适合学习ai课程的决策树,我们要从哪个特征开始算起呢,这时候就要计算信息熵与信息增益

ID 动力 想提升能力 有兴趣 时间 类别
1 一般
2 一般
3 很强
4 一般
5 一般
6 一般
7 一般
8 一般
9 很强
10 很弱

按照以上步骤分别计算各类特征

特征 信息增益值
有兴趣 0.6100
想提升能力 0.4200
时间 0.4200
动力 0.3668

在本次计算中,"有兴趣" 的信息增益最大(0.6100),因此决策树会优先选择 "有兴趣" 作为根节点的分裂特征。

相关推荐
甲维斯4 小时前
Claude Opus5手搓“NewAPI Plus”首轮成果!
人工智能
程序猿DD5 小时前
分享两个我每天都在用的 Skill,拖进豆包就能跑,限时领 30 天会员
人工智能
阿里云大数据AI技术5 小时前
Agentic Search 2.0:从单轮对话迈向企业级 AI 搜索自动驾驶Agent
人工智能·elasticsearch·agent
东风破_5 小时前
从 messages 数组到 Memory:大模型到底是怎么“记住”上一轮对话的?
人工智能
AEI5 小时前
四年间大模型的演进历程
人工智能·面试·程序员
狂师6 小时前
阿里开源:skill-up,一款Agent Skill 评测工具!
人工智能·开源·agent
武子康6 小时前
同一套 Agent Runtime,为什么 Web、Headless 和 Python SDK 仍然不是同一个产品
人工智能·llm·agent
天天代码码天天6 小时前
一个纯 C 的 OCR Runtime,又向前走了一步:lw.PPOCR.C preview.5 发布
人工智能
程序员cxuan6 小时前
Claude 官方的学习教程,太强了。
人工智能·后端·程序员
小强闯江湖6 小时前
不只是让 AI 写代码:ViewCompose 把 Android UI 做成了可编译、可渲染的闭环
android·人工智能·kotlin