深度学习中的正则化和归一化

https://blog.csdn.net/wuxusanren/article/details/131175185

归一化是一种将数据按比例缩放,使之落入一个小的特定区间的过程。归一化的主要目的是消除不同量纲及单位影响,提高数据间的可比性,同时也有助于加快算法的收敛速度。如softmax等,也常用于数据预处理

正则化是制定一些规则,防止模型过拟合,通常是在loss中体现,如L1正则化(loss + λ |weight|,有助于产生稀疏解,不重要的参数会变成0,因为绝对值的倒数是不变的),L2正则化(loss + λ * weight**2,有助于使模型参数趋于平滑,即参数值不会太大也不会太小,因为次方倒数随着随着数值变大而变大,数值变小而变小); 还有dropout,early stop等防止过拟合

相关推荐
用户818187062746几秒前
第14章 行为治理与访问控制
人工智能
忘路之远近i11 分钟前
受够阿里云自带终端后,我用 Cursor + grill-me 做了个运维面板
服务器·开发语言·人工智能·python·阿里云·云计算
朱涛的自习室14 分钟前
Munk AI 桌面端「预告」
android·前端·人工智能
www_comsci16 分钟前
【语言、教育类主题EI会议|Call For Paper】第二届人工智能与计算社会科学国际研讨会
人工智能·语言模型
祝威廉16 分钟前
四条语句跑完机器学习:让模型成为一个 SQL 函数
人工智能·sql·机器学习
superz丶21 分钟前
Claude Code / Codex 已经有 Harness,项目里还需要自己搭吗?
人工智能
TMT星球23 分钟前
荣耀将阿莱电影工作流融入机器人手机
人工智能·智能手机·机器人
沫儿笙25 分钟前
焊接机器人气保焊省气设备
人工智能·机器人
cxr82825 分钟前
物理信息约束生成式AI高分子逆向设计方法
人工智能·智能体·逆向设计合成·材料合成
Margrop26 分钟前
用了 40 年的 TCP,为什么被 HTTP/3“抛弃”了?
人工智能