CNN神经网络调参技巧

一、基本网络结构

1.若干块,每块:卷积+BN+激活+池化

2.若干块,每块:卷积+激活+Dropout

3.若干块,每块:fc+激活+Dropout

二、技巧

  1. 损失曲线
  • 常见曲线是先快速下降后趋于平缓,如果线性下降,说明学习率可能过低
  • 曲线震荡剧烈不平滑,可能是由于batchsize过小导致
  • 训练损失正常下降,验证损失先下降后上升,说明过拟合,可以调整dropout等解决
  • 损失最低点不代表模型性能最佳点

2.调参

  • 优先使用大的网络结构训练出过拟合效果
  • 第一层卷积核通道数应当较大,因为浅层特征较为重要
  • 主要还是根据损失函数进行调整
  • batchsize大容易过拟合,先用大batchsize,再用dropout解决过拟合

3.其他

  • 使用same卷积,更方便,不用每次计算卷积后的输出尺寸
相关推荐
深小乐3 分钟前
AI 周刊【2026.03.09-03.15】:Agent 入口争夺战,从桌面到云端
人工智能
汀沿河5 分钟前
5 微调实验-lora-打造知乎风格问答机器人
人工智能
小超同学你好8 分钟前
LangGraph 9. Agent 背后:ReAct
人工智能·语言模型·langchain
人工智能AI技术9 分钟前
百度文心搜索4.0+C# RAG实战:打造支持实时问答与长文档总结的智能客服
人工智能
一个处女座的程序猿12 分钟前
LLMs之Pretrained:《Training Language Models via Neural Cellular Automata》翻译与解读
人工智能·深度学习·llms·pretrained
是烨笙啊13 分钟前
五分钟上线:基于DeepSeek-OCR的多功能web应用
人工智能·aigc·ocr
rainy雨13 分钟前
六西格玛改进系统的全流程功能:传统企业转型中如何用六西格玛解决成本失控与交付延期的双重难题
大数据·人工智能·精益工程
人工干智能17 分钟前
科普:OpenClaw、大模型、通道及云端养虾
网络·人工智能·llm
2501_9269783317 分钟前
“AI构建APP”--到--“AI的动力性底层存在”--到--“AGI合法性验证”--AI治理的核心痛点解决方案
人工智能·经验分享·ai写作·agi
猿小猴子17 分钟前
主流 AI IDE 之一的 JoyCode 介绍
ide·人工智能