机器学习-正则化线性回归

如上图我们不需要对b进行正则化,w控制着特征的影响强度,W太大会容易让模型对训练数据过于敏感,造成过拟合,而B是偏置项,相当于对所有样本添加了一个固定值,,他的大小对模型的影响很小,不会导致过拟合额,他只影响模型的整体平移

我么看一下正则化是做了什么

我们对正则化的式子展开并且重新排列,会发现 后面的一项其实就是 没有正则化线性回归时候的梯度下降方程,我们看前一项, w和一个东西想成,如果我们找到一些数据带入到这一块中,如右图,我们可以发现 相当于是将W乘以了一个参数,这个参数的大小和 lamdba 有关,在右边的数据可以看出,相当于每次都对W乘以了一个小于1 但是近似与1的数进行变化,相当于每次都对W进行了一次小缩放,以防止过拟合

实际上 学习率是一个很小的数字,样本数据也是足够多的,lamdba 也是最够小的,这会导致 W会乘以一个小于1的但是很接近于1的数字,对W进行 打折每次都会打折,进行迭代

我们从式子可以看出,

lamdba 是和这个w相乘的系数是成反比的,

这个系数和模型的拟合能力是成反比的,

所以lamdba和模型的拟合能力是成正比的

lamdba 越大,系数越小 ,对W的惩罚越大,w就会越小,模型就越简单,模型就会欠拟合

lamdba 越小,对w的约束就会越小,模型就会过拟合,

lamdba 就是W的调节器,是反相关的

w的大小决定了模型的拟合深度,w大过拟合,W小欠拟合

lamdba 越大 模型就会欠拟合

lamdba 越小 模型就会过拟合

推导过程如小图

相关推荐
海上彼尚3 分钟前
Cursor 模型的强度实测排行
前端·人工智能·后端
ai小陈6 分钟前
PyTorch Profiler性能分析实战:定位GPU训练中的慢算子
人工智能·深度学习·机器学习·ai·性能优化·gpu算力
罗西的思考13 分钟前
[Agent Memory / 强化学习] MemPO源码学习笔记 ---(1)--- 总体
人工智能·算法·机器学习
冬奇Lab18 分钟前
DeepSeek Harness 系列(02):万物皆插件——Cordis 核心设计深度解读
人工智能·deepseek
老金带你玩AI22 分钟前
image 2.5刷屏了:有人拿它做广告,有人已经做出了动画
人工智能
FII工业富联科技服务22 分钟前
GPT-6 Astra发布,Agent的竞争开始从“会调用工具”走向“完成完整工作”
大数据·人工智能·gpt·架构·机器人·制造
Mr数据杨26 分钟前
议会事务多标签文本分类实战 从 Open Data St Gallen 看推荐排序建模
人工智能·数据分析·kaggle竞赛
梦想的颜色28 分钟前
【AI速览】2026年 9月 GPT‑6 Astra 深度解析:Agent 时代的前沿旗舰,能力、成本、落地痛点与选型判断
人工智能·openai·agent·astra·vibecoding·大模型测评·gpt6
向星而行_star33 分钟前
# OpenAI 发布 GPT Image 2.5:生成提速 50%,还能“指哪改哪“,AI 生图进入修图时代
人工智能·gpt·openai·gpt6·image2.5·星途ai
ofoxcoding1 小时前
GPT Image 2.5 API 实战:Python 调用实现图片生成与编辑
人工智能·python·gpt·ai