机器学习和深度学习-- 李宏毅(笔记与个人理解)Day 14

Day 14 Classfication (short version)

二分类的时候 用sigmoid 那不就是 logistic 回归嘛(softmax 的二分类等价)

Loss

哦 今天刚学的 ,KL散度 ,看来cross-entropy 和KL散度是等价的咯~ 我感觉我的直觉没错
这里MSE离得很远的时候会梯度消失,致使训练变得困难;

tell me WHY?

非线性激活函数:当使用非线性激活函数(如Sigmoid或Tanh)时,在输入值非常大或非常小的情况下,这些激活函数的梯度会接近于零。因此,如果在MSE损失函数的情况下,预测值与目标值之间的差异很大,经过激活函数的反向传播会产生非常小的梯度。

但是Cross Entropy 两个差距很大的时候整体乘积并不会无限大 --- 因为本质上描述的是两个概率分布的差异

相关推荐
nnsix31 分钟前
设计模式 - 模板方法模式 笔记
笔记·设计模式·模板方法模式
RainCity2 小时前
Java Swing 自定义组件库分享(六)
java·笔记·后端
羊群智妍3 小时前
2026 AI搜索优化:企业级GEO监测工具选型手册
笔记
多年小白3 小时前
紫光国微(002049) 分析
大数据·科技·深度学习·ai
NashSKY3 小时前
EM 算法完整推导与本质剖析
算法·机器学习·概率论
动物园猫4 小时前
金属外表多种生锈检测数据集分享(适用于YOLO系列深度学习分类检测任务)
深度学习·yolo·分类
cyyt4 小时前
深度学习周报(5.11~5.17)
人工智能·深度学习
搬砖的小码农_Sky4 小时前
如何在RX 7900 XTX显卡上运行ROCm?
深度学习·机器学习·gpu算力
RSTJ_16254 小时前
PYTHON+AI LLM DAY FOURTY-EIGHT
开发语言·人工智能·python·深度学习
x_yeyue5 小时前
2026第十七届蓝桥杯c++B组省赛题解
笔记·算法·蓝桥杯·acm·题解