过拟合(overfitting):模型只能拟合训练数据的状态。即过度训练。
避免过拟合的几种方法:
①增加全部训练数据的数量(最为有效的方式)
②使用简单的模型(简单的模型学不够,复杂的模型学的太多),这里的简单指的是不要过于复杂
③正则化 (对目标函数后加上正则化项):使得这个"目标函数+正则化项"的值最小,即为正则化,用防止参数变得过大(参数值变小,意味着对目标函数的影响变小),λ是正则化参数,代表正则化惩罚的强度,当λ=0时,意味着不使用正则化,反正λ越大,代表对参数的变大抑制作用越强。
两种正则化方法:①L1正则化使得对判定为不需要的参数会直接让它变为0,即直接去除不要的变量
②L2正则化会抑制参数,使变量的影响不会过大。
欠拟合(underfitting):与过拟合状态相反,即过度不训练。过拟合就是能很好拟合训练数据,对测试数据的拟合效果不好;欠拟合是既不能拟合训练数据,又不能拟合测试数据;所以要判断模型是过拟合还是欠拟合通过测试数据的精度数值观测是无法区分的。
那么怎么通过数值判断模型是过拟合还是欠拟合状态?欠拟合:训练精度下降,测试精度上升
欠拟合图像特点:训练曲线和测试曲线最终趋于一个定值,这个定值明显大于1
过拟合:训练精度一直很高,测试精度上升
过拟合图像特点:训练曲线趋于一个定值a,测试曲线趋于一个定值b,a和b之间有一定且明显的差距
机器学习——正则化、欠拟合、过拟合、学习曲线
爱吃泡芙的小白白2025-03-16 20:24
相关推荐
超级架构师38 分钟前
【机器学习与数据科学全领域速查表】豆豆3 小时前
机器学习 day02ayiya_Oese4 小时前
[数据处理] 6. 数据可视化没有梦想的咸鱼185-1037-16634 小时前
【大语言模型ChatGPT4/4o 】“AI大模型+”多技术融合:赋能自然科学暨ChatGPT在地学、GIS、气象、农业、生态与环境领域中的应用老艾的AI世界4 小时前
AI制作祝福视频,直播礼物收不停,广州塔、动态彩灯、LED表白(附下载链接)IT古董5 小时前
【漫话机器学习系列】250.异或函数(XOR Function)Blossom.1185 小时前
虚拟现实(VR)与增强现实(AR)在教育领域的应用:开启沉浸式学习新时代奋斗者1号5 小时前
机器学习之数据转换策略odoo中国5 小时前
机器学习实操 第二部分 神经网路和深度学习 第14章 使用卷积神经网络进行深度计算机视觉绝顶大聪明5 小时前
[sklearn机器学习概述]机器学习-part3