GoogLeNet的不同版本

  • GoogLeNet 致敬 LeNet

GoogLeNet V1

  • Inception块,增加网络宽度,在卷积操作时可以提取不同尺度特征
  • 利用1×1卷积进行降维,减少参数量
  • 参数量计算:上一层通道数 × 卷积层的长度^2 × 下一层通道数
  • 采用模块化结构Stage
  • 最后进行全局平均池化average pooling能让输入图像大小不用固定
  • 辅助分类器,为训练提供更多梯度信息
  • 将网络模块化三个阶段,每个阶段内部feature map不变,结束后下降样到下个stage,这种模式在后面经常出现,如:resnet,mobilenet,shufflenet等

GoogLeNet V2

  • BatchNormalization(BN):数据归一化,对每个训练的mini-batch做归一化
    • BN使得模型可以使用较大的学习率而不用特别关心诸如梯度爆炸或消失等优化问题;
    • 降低了模型效果对初始权重的依赖;
    • 可以加速收敛,一定程度上可以不使用Dropout这种降低收敛速度的方法,但却起到了正则化作用,提高了模型泛化性;
    • 即使不使用ReLU也能缓解激活函数饱和问题;
    • 能够学习到从当前层到下一层的分布缩放(scaling(方差),shift(期望))系数
  • 问题
    • 网络训练过程中不止学习本层数据,而且要适应上层的分布,这里相当于规定了同一的输入格式,减少适应上层分布的过程。
  • 解决方法:将输入值减均值除上方差,z值化。

GoogLeNet V3

  • 贡献:
    • 提出通用的网络结构设计准则
    • 引入卷积分解提高效率(空间可分离卷积)
    • 引入高效的feature map降维
    • 平滑样本标注
  • 准则:
    • 避免特征表示上的瓶颈,尤其在神经网络的前若干层。(慎用)
      • 如果在网络的浅层35×35×320被降维到17×17×320,会丢失大量信息,后面不可逆。所以对feature map进行降维的同时会对channel进行升维。
    • 特征的数目越多收敛越快(不怎么流行)
      • 增加1×3和3×1激活输出,产生相互解耦的特征表示。
    • 合理压缩特征维度数(通道数),来减少计算量
      • 用1×1的卷积先降维,再特征提取,相邻通道信息比较像
    • 网络的深度和宽度需要等比例的放大和缩小
      • 没有具体给出指导,后期EfficientNet(V1,V2)才填了这个坑
    • "优化"辅助分类器
      • 去掉了
    • 优化池化操作
      • 并行做卷积和池化,然后再合并
    • 优化标签
      • 将one hot标签平滑一点
      • (1-label_smoothing)*one_hot_labels+label_smoothing/num_classes
      • label_smothing = 0.1
      • num_classes = 1000

GoogLeNet V4(不流行,太复杂而且没意义)

  • 以结果为导向,网络解释性不强。
  • 但是融合了残差网络
  • 缺点:人为赋予了模型大量的先验知识

GoogLeNet V5(很简单)

  • Xception
  1. 1×1卷积核在通道维度上进行相乘求和,3*3卷积核在空间维度上做信息处理
  2. 普通卷积同时在通道和空间上进行处理,普通的卷积核是三维的
  3. 先做通道上处理,后做空间上处理
  4. 解耦精度更高,计算量更小
    补充:
  • 如果训练的网络结果不好,不一定是网络结构不好,有可能是超参数不好。如梯度弥散
  • 模型自己学习到的知识比人为赋予的归纳偏置上限更高
  • 古人诚不欺我:大道至简
相关推荐
IT_陈寒3 分钟前
Redis缓存击穿把我整不会了,原来还有这手操作
前端·人工智能·后端
YuanDaima20489 分钟前
Linux 进阶运维与 AI 环境实战:进程管理、网络排错与 GPU 监控
linux·运维·服务器·网络·人工智能
跨境数据猎手17 分钟前
跨境商城反向海淘系统开发全流程逻辑(上)
人工智能·爬虫·系统架构
听你说3236 分钟前
丈八科技与浪潮海若达成战略合作:共建人工智能产测一体化超级工厂
人工智能·科技
初心未改HD36 分钟前
深度学习之Attention注意力机制详解
人工智能·深度学习
code_pgf1 小时前
模态生成器:原理详解与推荐开源项目
人工智能·深度学习·开源
ws2019071 小时前
AUTO TECH China 2026广州汽车零部件展:从整机集成迈向核心部件的产业跃升
大数据·人工智能·科技·汽车
文歌子1 小时前
DeepEarth 深度解析:AI 如何理解地球的时空规律
深度学习
MomentYY1 小时前
第 3 篇:让 Agent 学会分工,LangGraph 构建多 Agent系统
人工智能·python·agent
初心未改HD1 小时前
深度学习之Transformer架构详解
人工智能·深度学习·transformer