神经 网络

笔记记录
层次
复制代码
全连接层
卷积层
池化层
批量规范化层
激活函数
丢弃层
经典模型
复制代码
LeNet
AlexNet
VGG
Nin
GoogleNet
ResNet
DenseNet

神经网络层的主要类别

python 复制代码
    "基础结构层": ["全连接层", "卷积层", "池化层"],
    "序列处理层": ["RNN", "LSTM", "GRU", "Transformer"],
    "归一化层": ["BatchNorm", "LayerNorm", "InstanceNorm"],
    "正则化层": ["Dropout", "DropPath"],
    "注意力机制": ["自注意力", "交叉注意力", "多头注意力"],
    "嵌入层": ["词嵌入", "位置编码"],
    "激活函数": ["ReLU", "Sigmoid", "Tanh", "Softmax"],
    "特殊连接": ["残差连接", "跳跃连接"],
    "采样层": ["上采样", "下采样", "转置卷积"]

神经网络经典架构时间线

python 复制代码
    "2012": ["AlexNet"],           # 深度学习复兴
    "2014": ["VGG", "GoogLeNet"],  # 深度与宽度探索  
    "2015": ["ResNet", "UNet"],    # 残差连接,医学影像
    "2016": ["DenseNet"],          # 密集连接
    "2017": ["Transformer"],       # 注意力革命
    "2018": ["BERT", "GAN"],       # 预训练模型,生成模型
    "2020": ["Vision Transformer"] # CV的Transformer时代
架构选择指南
图像分类 ResNet, EfficientNet 平衡精度和效率
目标检测 YOLO, Faster R-CNN 实时vs高精度
语义分割 U-Net, DeepLab 医学影像,街景分割
机器翻译 Transformer, BERT 当前最优选择
文本生成 GPT系列 自回归语言模型
图像生成 GAN, VAE, Diffusion 高质量图像合成
语音识别 WaveNet, Conformer 时序信号处理
实用建议
  • 1.从预训练开始:使用在ImageNet等大数据集上预训练的模型
  • 2.迁移学习:针对特定任务微调最后几层
  • 3.架构搜索:使用EfficientNet等自动搜索的架构
  • 4.计算预算:根据可用资源选择合适规模的模型
  • 5.持续学习:关注新架构的发展,如Swin Transformer、ConvNeXt等
笔记记录
相关推荐
湘美书院--湘美谈教育3 小时前
湘美谈教育AI系列经验集锦:赋能整理聊斋志异大寓言
大数据·人工智能·深度学习·神经网络·机器学习
大模型最新论文速读5 小时前
小红书提出 RedKnot:分头处理 kv 缓存,延时降低 60%效果还提升
论文阅读·人工智能·深度学习·机器学习·缓存·自然语言处理
星浩AI6 小时前
(七)GPT2中文生成模型定制化微调训练[附源码]
pytorch·深度学习·llm
卡梅德生物科技小能手6 小时前
卡梅德生物科普MCAM(黑色素瘤细胞黏附分子)
人工智能·经验分享·深度学习
月疯7 小时前
torch:expand和repeate的区别
开发语言·python·深度学习
xianghongtao01168 小时前
把 Prompt 当成“可训练参数“:SkillOpt 如何用深度学习的纪律去优化 Agent 技能
人工智能·深度学习·性能优化·prompt
装不满的克莱因瓶8 小时前
PyTorch 与它的自动微分工具:Autograd
人工智能·pytorch·python·深度学习·神经网络·机器学习·ai
EQUINOX18 小时前
【ch03】Coding-attention-mechanisms
人工智能·深度学习·机器学习
老饼讲解-BP神经网络9 小时前
具体说说-RBF神经网络-newrbe函数和newrb函数的区别
人工智能·深度学习·神经网络
机器学习之心9 小时前
198种组合算法+优化CNN-LSTM+SHAP分析+新数据预测+多输出!深度学习可解释分析,强烈安利,粉丝必备
深度学习·算法·cnn-lstm·shap分析·198种组合算法