【mechine learning-九-梯度下降】

梯度下降

上一节讲过,随机的寻找w和b使损失最小不是一种合适的方法,梯度下降算法就是解决解决这个问题的,它不仅可以用于线性回归,还可以用于神经网络等深度学习算法,是目前的通用性算法。

更加通用的梯度下降算法

之前二维关于w和b的损失函数(无特殊说明,均以均方误差成本函数为例)如下:,

但是在更多的例子里,或者说更加复杂的神经网络里面,w是很多个,目前很多模型都是超过几千亿参数:

已经无法使用随机法来解决最小化J这个损失,必须用更加通用的梯度下降算法来解决最小化损失的问题。

算法步骤

假设某一个模型的成本函数也就是Loss fuction如上(不是线性回归也不是均方误差):

如何从这里面找到J的最小值呢?方法如下:

  1. 设定w和b初始值。如图中左边这条线的起点。
  2. 从现在的位置旋转360度,找到J下降最快的点,向下走一步。(这意味着你走的是最快下山的路)
  3. 以下降后的位置,重复上述步骤,直到发现走到了一个局部最小的山谷底,也就是J的具备最小值。

梯度下降有意思的一件事情,假设随机选择的起始点是另外一个位置,比如右面这条线的起始点,那么找到的就是右边这个局部的最低点,这两个是完全不同的最低点。至于具体怎么实现算法留在下一节。

相关推荐
工业机器人销售服务2 分钟前
空调阀板微米级密封涂胶:伯朗特机器人均匀出胶,密封胶层紧实无气泡缺陷
人工智能
guslegend4 分钟前
第2节:规范驱动开发SSD,让AI永远在轨道上
人工智能·大模型
xixixi7777712 分钟前
算力网络双轮驱动:800G 光模块价格再降、1.6T 商用提速,AI-eSIM 用户破亿重构身份生态
网络·人工智能·ai·大模型·光模块·通信·运营商
数字哨兵(和中)13 分钟前
数字底座全面升级,IPv6 与 AI 共筑数字经济新高地
人工智能
李伟_Li慢慢15 分钟前
从惯性和矩详解惯性矩
人工智能·算法·机器人
黎阳之光15 分钟前
实景三维重构赋能智慧仓储,黎阳之光打造仓库全域透明管控新生态
大数据·人工智能·算法·安全·数字孪生
YUDAMENGNIUBI18 分钟前
day31_RNN及其变体
人工智能·rnn·深度学习
未来和明天21 分钟前
领嵌iLeadE-588边缘计算盒子IOT数据流+AI视频流支持远程调试手机监控
人工智能·物联网·边缘计算
EnCi Zheng22 分钟前
09aaa-LayerNorm是什么?
人工智能
黎阳之光25 分钟前
黎阳之光:以原创硬核通信,定义无人系统与应急指挥新边界|7030‑46无线图数自组网电台技术解析
大数据·人工智能·物联网·算法·数字孪生