支持向量机(第二十九节课内容总结)

1. 分类边界与支持向量的几何意义

  • 超平面:用于将不同类别的数据分开,在二维情况下是直线,在更高维空间中是超平面。

  • 定义:超平面由权重向量 w 和偏置 b 定义,方程为 wTx+b=0。

  • 支持向量:距离超平面最近的样本点,位于分类边界两侧,对决策边界有决定性影响。

2. 核心优化目标------最大化间隔(Margin)

  • 间隔(Margin):两类支持向量到超平面的最短距离。

  • 优化目标:最大化间隔 D,等价于最大化 ∥w∥2​ 或最小化 ∥w∥2。

  • 鲁棒性:通过最大化间隔,提高模型对噪声和异常值的容忍度。

3. 分类约束条件的设计

  • 约束条件:所有训练样本满足 yi​(wTxi​+b)≥1,其中 yi​ 为类别标签(+1 或 -1)。

  • 拉格朗日乘子:引入 αi​ 将不等式约束转化为等式约束,构建拉格朗日函数进行优化。

4. 拉格朗日乘子法与对偶问题的求解

  • 拉格朗日乘子法:将原问题转化为对偶问题。

  • 对偶问题:在对偶问题中,参数 αi​ 成为主变量,满足 αi​≥0 且 ∑αi​yi​=0。

  • 模型参数:w=∑αi​yi​xi​,b 由 b=yi​−wTxi​ 推导得出。

  • 预测模型:y^​=sign(∑αi​yi​xiT​xj​+b)。

5. 数学推导中的关键技巧与目的

  • 误差为零:通过引入 yi​(wTxi​+b)≥1 的条件,确保模型预测与真实标签一致。

  • 简化计算:通过对目标函数进行放缩(如乘以 21​)简化计算。

  • 等价转换:利用 ∥w∥−1 的最大化等价于 ∥w∥ 的最小化。

  • 求导处理:通过处理 αi​ 转换变量,减少参数数量,提升求解效率。

相关推荐
大江东去浪淘尽千古风流人物1 小时前
【VLN】VLN(Vision-and-Language Navigation视觉语言导航)算法本质,范式难点及解决方向(1)
人工智能·python·算法
努力学算法的蒟蒻1 小时前
day79(2.7)——leetcode面试经典150
算法·leetcode·职场和发展
2401_841495642 小时前
【LeetCode刷题】二叉树的层序遍历
数据结构·python·算法·leetcode·二叉树··队列
AC赳赳老秦2 小时前
2026国产算力新周期:DeepSeek实战适配英伟达H200,引领大模型训练效率跃升
大数据·前端·人工智能·算法·tidb·memcache·deepseek
2401_841495642 小时前
【LeetCode刷题】二叉树的直径
数据结构·python·算法·leetcode·二叉树··递归
budingxiaomoli2 小时前
优选算法-字符串
算法
qq7422349842 小时前
APS系统与OR-Tools完全指南:智能排产与优化算法实战解析
人工智能·算法·工业·aps·排程
A尘埃3 小时前
超市购物篮关联分析与货架优化(Apriori算法)
算法
.小墨迹3 小时前
apollo学习之借道超车的速度规划
linux·c++·学习·算法·ubuntu
不穿格子的程序员3 小时前
从零开始刷算法——贪心篇1:跳跃游戏1 + 跳跃游戏2
算法·游戏·贪心