机器学习之梯度下降法直观理解

形象化举例,由上图所示,假如最开始,我们在一座大山上的某处位置,因为到处都是陌生的不知道下山的路,所以只能摸索着根据直觉,走一步算一步。在此过程中,每走到一个位置的时候,都会求解当前位置的梯度,沿着梯度的负方向,也就是当前最陡峭的位置向下走一步,然后继续求解当前位置梯度,向这一步所在位置沿着最陡峭最易下山的位置走一步。不断循环求梯度,就这样一步步地走下去,一直走到我们觉得已经到了山脚。

当然这样走下去,有可能我们不能走到山脚,而是到了某一个局部的山势低处。由此,从上面的解释可以看出,梯度下降不一定能够找到全局的最优解,有可能是一个局部的最优解。当然,如果损失函数是凸函数,梯度下降法得到的解就一定是全局最优解。

核心思想归纳:

  1. 初始化参数,随机选取取值范围内的任意数;
  2. 迭代操作:
    a) 计算当前梯度;
    b) 修改新的变量;
    c) 计算朝最陡的下坡方向走一步;
    d) 判断是否需要终止,如否,返回a)
  3. 得到全局最优解或者接近全局最优解。
相关推荐
user_admin_god几秒前
第 11 篇:实践三 —— 表单 / 合同字段抽取
java·人工智能·spring boot·语言模型
北极有牛1 分钟前
cuda算子--矩阵转置
人工智能·算法
诺鸭船长4 分钟前
上帝之手Blender丨从入门到榨干
人工智能
lucas_AI5 分钟前
第 9 讲 · 编译期优化:让编译器和反汇编告诉你真相
人工智能
无限压榨切图仔5 分钟前
加了“去 AI 味”Skill,水稿还是水:AI 写作流程缺的不是润色
人工智能·程序员
天远数科8 分钟前
零信任架构实战:基于天远车型识别精准构建自动化二手车评估网关
人工智能·ai·工具分享
用户19172912708314 分钟前
多 Agent 并行不打架:worktree 隔离与反馈回流落地(附脚本)
人工智能
亦暖筑序14 分钟前
AgentScope Java 实战:Agent 的状态存在哪、怎么恢复、怎么隔离?
人工智能·后端·agent
jsl_jsl_jsl15 分钟前
《Bun 后端怎么变桌面软件:Tauri 2 三进程架构与崩溃自愈》
人工智能
lucas_AI18 分钟前
第 10 讲 · PGO 实战:让程序的真实运行数据指导编译
人工智能