神经 网络

笔记记录
层次
复制代码
全连接层
卷积层
池化层
批量规范化层
激活函数
丢弃层
经典模型
复制代码
LeNet
AlexNet
VGG
Nin
GoogleNet
ResNet
DenseNet

神经网络层的主要类别

python 复制代码
    "基础结构层": ["全连接层", "卷积层", "池化层"],
    "序列处理层": ["RNN", "LSTM", "GRU", "Transformer"],
    "归一化层": ["BatchNorm", "LayerNorm", "InstanceNorm"],
    "正则化层": ["Dropout", "DropPath"],
    "注意力机制": ["自注意力", "交叉注意力", "多头注意力"],
    "嵌入层": ["词嵌入", "位置编码"],
    "激活函数": ["ReLU", "Sigmoid", "Tanh", "Softmax"],
    "特殊连接": ["残差连接", "跳跃连接"],
    "采样层": ["上采样", "下采样", "转置卷积"]

神经网络经典架构时间线

python 复制代码
    "2012": ["AlexNet"],           # 深度学习复兴
    "2014": ["VGG", "GoogLeNet"],  # 深度与宽度探索  
    "2015": ["ResNet", "UNet"],    # 残差连接,医学影像
    "2016": ["DenseNet"],          # 密集连接
    "2017": ["Transformer"],       # 注意力革命
    "2018": ["BERT", "GAN"],       # 预训练模型,生成模型
    "2020": ["Vision Transformer"] # CV的Transformer时代
架构选择指南
图像分类 ResNet, EfficientNet 平衡精度和效率
目标检测 YOLO, Faster R-CNN 实时vs高精度
语义分割 U-Net, DeepLab 医学影像,街景分割
机器翻译 Transformer, BERT 当前最优选择
文本生成 GPT系列 自回归语言模型
图像生成 GAN, VAE, Diffusion 高质量图像合成
语音识别 WaveNet, Conformer 时序信号处理
实用建议
  • 1.从预训练开始:使用在ImageNet等大数据集上预训练的模型
  • 2.迁移学习:针对特定任务微调最后几层
  • 3.架构搜索:使用EfficientNet等自动搜索的架构
  • 4.计算预算:根据可用资源选择合适规模的模型
  • 5.持续学习:关注新架构的发展,如Swin Transformer、ConvNeXt等
笔记记录
相关推荐
RWKV元始智能6 小时前
RWKV超并发项目教程,RWKV-LM训练提速40%
人工智能·rnn·深度学习·自然语言处理·开源
AI技术增长7 小时前
Pytorch图像去噪实战(六):CBDNet真实噪声去噪实战,解决合成噪声模型落地效果差的问题
pytorch·深度学习·机器学习
小糖学代码9 小时前
LLM系列:2.pytorch入门:8.神经网络的损失函数(criterion)
人工智能·深度学习·神经网络
Jmayday9 小时前
Pytorch:RNN理论基础
pytorch·rnn·深度学习
AI周红伟11 小时前
周红伟:GPT-Image-2深度解析:从技术原理到实战教程,为什么它能让整个AI圈炸锅?
人工智能·gpt·深度学习·机器学习·语言模型·openclaw
端平入洛12 小时前
梯度是什么:PyTorch 自动求导详解
人工智能·深度学习
Uopiasd1234oo12 小时前
上下文引导模块改进YOLOv26局部与全局特征融合能力双重提升
深度学习·yolo·机器学习
动物园猫14 小时前
工业织物缺陷目标检测数据集分享(适用于YOLO系列深度学习分类检测任务)
深度学习·yolo·目标检测
ACCELERATOR_LLC14 小时前
【DataWhale组队学习】DIY-LLM Task6 评估与基准测试
人工智能·深度学习·大模型·模型评估
狮子座明仔15 小时前
ThinkTwice: 让模型学会“做完题再检查一遍“,推理+自纠错联合训练只加3%开销
大数据·人工智能·深度学习