20240803---特征选择与稀疏学习

1.特征选择:在机器学习任务中,通过样本的特征预测样本所对应的值。

(1)无关特征:通过空气的湿度、环境的温度、风力、当地人的男女比例来预测明天是否下雨。男女比例属于无关特征。

(2)冗余特征:通过房屋的面积、卧室的面积、车库的面积、城市消费水平、城市税收水平等特征来预测房价。这里面的税收水平就说多余特征。

因为税收水平和消费水平存在相关性,我们只要两者取其一就可以。(因为另一个能从其中一个推演出来)

线性相关,用线性模型做回归会出现多重共线性,会导致过拟合。

(3)减少特征:不仅减少过拟合、减少特征数量(降维)、提高模型泛化能力,而且还可以使模型获得更好的解释性,增强对特征和特征值之间的理解,加快模型的训练速度,一般的,还会获得更好的性能。问题是,在面对未知领域时,很难有足够的认识去判断特征与目标之间的相关性,特征与特征之间的相关性。这时候就需要用一些数学或工程上的方法来帮助我们更好地进行特征选择。

2.特征选择的方法

1)过滤法(Filter):

按照发散性或者相关性对各个特征进行评分,设定阈值或者待选择阈值的个数,选择特征










2)包裹法(Wrapper)︰

根据目标函数,每次选择若干特征或者排除若干特征,直到选择出最佳的子集。





3)嵌入法(Embedding):

先使用某些机器学习的算法和模型进行训练,得到各个特征的权值系数,根据系数从大到小选择特征。类似于Filter方法,但是是通过训练来确定特征的优劣。





补充:

三、稀疏表示




四、字典学习

(1)字典学习



(2)字典学习的解法


看到了p60,明天还有ppt1和pp3要看

相关推荐
2301_781143563 分钟前
C语言学习笔记(五)
笔记·学习
炽烈小老头7 分钟前
【每天学习一点算法 2026/04/01】零钱兑换
学习·算法
学电子她就能回来吗9 分钟前
liunx嵌入式基础:socket通信
linux·运维·服务器·人工智能·单片机·嵌入式硬件·学习
我能坚持多久9 分钟前
C++入门基础知识
开发语言·c++·学习
如雨随行202016 分钟前
【Vim】学习笔记(9)命令模式
笔记·学习·vim
charlie11451419120 分钟前
2026年正点原子开发板移植方案——从0开始的Rootfs之路(5)WSL + NFS 网络启动踩坑记:从挂载失败到成功启动的完整历程
linux·网络·驱动开发·学习·嵌入式·嵌入式linux
头疼的程序员21 分钟前
计算机网络:自顶向下方法(第七版)第七章 学习分享(四)
网络·学习·计算机网络
如雨随行202022 分钟前
【Vim】学习笔记(8)tips-2
笔记·学习·vim
HyperAI超神经24 分钟前
在线教程丨华中科大与小红书 hi lab开源dots.mocr,SOTA级OCR模型完美还原文档结构,图形也能转 SVG
人工智能·深度学习·学习·机器学习·gpu·orc·vllm
RrEeSsEeTt30 分钟前
【HackTheBox】- BoardLight 靶机学习
linux·学习·网络安全·渗透测试·kali·红队·hackthebox