【西瓜书机器学习】第五章 神经网络

一起啃西瓜书(5)-神经网络《机器学习-周志华》 - 知乎 (zhihu.com)参考进行自我复习整理,侵删!

1、神经元模型
  1. 神经网络定义:神经网络是由 具有适应性简单单元 组成的广泛 并行互连 的网络。
  2. M-P神经元模型:输入、处理、输出

第二步超过阈值则兴奋(做出反应),否则不兴奋(没反应) ,通过f(x)阶跃函数实现,但阶跃函数不连续,使用sigmoid函数。

2、感知机
  1. 组成:两层,输入层 接受外界信号、输出层是"M-P神经元"。

  2. 明确:输入层 的神经元不是"M-P神经元",他们**没有"阈值"**可言,无激活函数

  3. 把阈值转换为类似权重*输入值 的形式:

  4. 学习规则:对于一个样例(x,y),当前感知机的输出为 𝑦^,也就是y为根据x得到的真实的y,也是我们期望感知机能得到的y,但是感知机实际输出的为 𝑦^,两者之间的差距为y- 𝑦^,为了使输出更接近,也就是使y- 𝑦^最小化,我们需要调整感知机参数(所有权重及阈值,阈值已经被转换为了权重形式),调整公式如下:

    也就是学习率越大,调整幅度越大;感知机输出与实际之间的差距越大,调整幅度越大;该神经元的输入值越大,调整幅度越大。同时我们也可以得到如下结论:

  • 若感知机预测正确,不需要调整
  • w向着预测正确的方向调整
  • 根据错误的程度对参数进行调
  1. 可解决问题:线性可分问题。也就是在坐标系中两种类型之间可以用一条线划分开,比如与或非问题可划分如下,其中蓝色为正样本,绿色为负样本。

但是异或问题至少要用两条线才可分割开,如下图所示,这也就意味着感知机无法解决该问题,需要引入两层感知机来解决。

相关推荐
Raink老师3 小时前
【AI面试临阵磨枪-70】Agent 系统如何做分布式调度、跨服务协作、故障恢复?
人工智能·面试·职场和发展
tedcloud1233 小时前
RTK部署教程:构建稳定的AI Workflow环境
服务器·javascript·人工智能·typescript·ocr
Raink老师4 小时前
【AI面试临阵磨枪-71】如何用 AI 优化推荐系统、内容审核、广告创意、搜索体验?
人工智能·面试·职场和发展
AI医影跨模态组学4 小时前
Biomarker Res(IF=11.5)安徽医科大学第一医院:基于机器学习的放射组学模型:子宫内膜癌患者的预后预测及机制探索
人工智能·深度学习·论文·医学·医学影像·影像组学
ftpeak4 小时前
Mooncake:以 KVCache 为中心的分离式 LLM 服务架构
人工智能·ai·架构·ai编程·ai开发
lqqjuly4 小时前
Transformer架构详解 - 第一、二部分:基础与核心思想、核心组件详解
深度学习·神经网络·自然语言处理
Terrence Shen4 小时前
Hermes agent的tools是怎么落地应用的系列
人工智能·llm·agent·hermes
Raink老师4 小时前
【AI面试临阵磨枪-72】电商全场景 AI Agent 设计(商品咨询 / 订单 / 物流 / 售后 / 退款)
人工智能·面试·职场和发展
仙女修炼史4 小时前
CNN更看重Texture还是shape:imagenet-trained cnns are biased
论文阅读·人工智能·cnn
视***间4 小时前
视程空间 AIR SC6N0-C-MB NX 16GB 规格详解与机器人/机器狗适配说明
人工智能·机器人·边缘计算·机器狗·ai算力·具身机器人·视程空间