【mechine learning-九-梯度下降】

梯度下降

上一节讲过,随机的寻找w和b使损失最小不是一种合适的方法,梯度下降算法就是解决解决这个问题的,它不仅可以用于线性回归,还可以用于神经网络等深度学习算法,是目前的通用性算法。

更加通用的梯度下降算法

之前二维关于w和b的损失函数(无特殊说明,均以均方误差成本函数为例)如下:,

但是在更多的例子里,或者说更加复杂的神经网络里面,w是很多个,目前很多模型都是超过几千亿参数:

已经无法使用随机法来解决最小化J这个损失,必须用更加通用的梯度下降算法来解决最小化损失的问题。

算法步骤

假设某一个模型的成本函数也就是Loss fuction如上(不是线性回归也不是均方误差):

如何从这里面找到J的最小值呢?方法如下:

  1. 设定w和b初始值。如图中左边这条线的起点。
  2. 从现在的位置旋转360度,找到J下降最快的点,向下走一步。(这意味着你走的是最快下山的路)
  3. 以下降后的位置,重复上述步骤,直到发现走到了一个局部最小的山谷底,也就是J的具备最小值。

梯度下降有意思的一件事情,假设随机选择的起始点是另外一个位置,比如右面这条线的起始点,那么找到的就是右边这个局部的最低点,这两个是完全不同的最低点。至于具体怎么实现算法留在下一节。

相关推荐
liruiqiang053 分钟前
机器学习 - 如何理解几何学中的超平面 ?
机器学习·支持向量机·几何学
脚踏实地的大梦想家10 分钟前
【机器学习】P1 机器学习绪论
人工智能·机器学习
小众AI10 分钟前
Tabby - 开源的自托管 AI 编码助手
人工智能·开源·ai编程
驼同学.18 分钟前
[Deep Learning] Anaconda+CUDA+CuDNN+Pytorch(GPU)环境配置-2025
人工智能·pytorch·深度学习
MichaelIp1 小时前
Pytorch基础教程:从零实现手写数字分类
人工智能·pytorch·python·深度学习·神经网络·机器学习·分类
魔珐科技1 小时前
数字人助力企业出海增长,魔珐科技亮相2025晋江跨境电商峰会
大数据·人工智能·科技
CES_Asia1 小时前
亚洲科技创新之夜即将闪耀CES Asia 2025首日
人工智能·科技·机器人·智能音箱·智能电视
huoyingcg1 小时前
解锁数字化展厅:科技赋能下的全新体验
人工智能·科技·计算机视觉·3d·动画·虚拟现实
pzx_0011 小时前
【论文阅读】基于空间相关性与Stacking集成学习的风电功率预测方法
论文阅读·人工智能·算法·机器学习·bootstrap·集成学习
大模型之路2 小时前
OpenAI Whisper:语音识别技术的革新者—深入架构与参数
人工智能·whisper·语音识别