简单CNN——作业(补充)

调度器种类

总共训练了15个epoch,结构为三层卷积层 + 两层全连接层。

ReduceLROnPlateau

复制代码
scheduler = optim.lr_scheduler.ReduceLROnPlateau(
    optimizer=optimizer,        # 指定要控制的优化器(这里是Adam)
    mode='min',       # 监测的指标是"最小化"(如损失函数)
    patience=3,       # 如果连续3个epoch指标没有改善,才降低LR
    factor=0.5        # 降低LR的比例(新LR = 旧LR × 0.5)
)

最终测试集准确率为78.50 %,累计平均损失为0.7247

StepLR

复制代码
scheduler = optim.lr_scheduler.StepLR(optimizer, step_size=5, gamma=0.1)  

最终测试集准确率为78.63 %,累计平均损失为0.7534

MultiStepLR

复制代码
scheduler = optim.lr_scheduler.MultiStepLR(optimizer, milestones=[10, 20, 30], gamma=0.5)  

最终测试集准确率为79.17 %,累计平均损失为0.7035

CosineAnnealingLR

复制代码
scheduler = optim.lr_scheduler.CosineAnnealingLR(optimizer, T_max=10, eta_min=0.0001)  

最终测试集准确率为78.05 %,累计平均损失为0.6986,整个训练内波动有点大。

在当前情况下(存在误差,每一个调度器只训练了一次),综合准确率和累计平均损失来看,使用MultiStepLR作为调度器的结果最好

|-------------------|--------|--------|--------|
| 调度器 | 测试集准确率 | 训练集准确率 | 累计平均损失 |
| ReduceLROnPlateau | 78.50% | 74.58% | 0.7247 |
| StepLR | 78.63% | 73.80% | 0.7534 |
| MultiStepLR | 79.17% | 75.36% | 0.7035 |
| CosineAnnealingLR | 78.05% | 75.60% | 0.6986 |

CNN结构

增加一层全连接层,测试集准确率为79.06%,累计平均损失为0.7293

复制代码
def forward(self, x):
        # 第一个卷积层后接ReLU激活函数和最大池化操作,经过池化后图像尺寸变为原来的一半,这里输出尺寸变为16x16
        x = self.pool(F.relu(self.conv1(x)))  # F.relu()不支持hook,无法监控中间结果
        # 第二个卷积层后接ReLU激活函数和最大池化操作,输出尺寸变为8x8
        x = self.pool(F.relu(self.conv2(x)))  
        # 第三个卷积层后接ReLU激活函数和最大池化操作,输出尺寸变为4x4
        x = self.pool(F.relu(self.conv3(x)))  
        # 将特征图展平为一维向量,以便输入到全连接层
        x = x.view(-1, 128 * 4 * 4)
        # 第一个全连接层后接ReLU激活函数
        x = F.relu(self.fc1(x))
        # 第二个全连接层后接ReLU激活函数
        x = F.relu(self.fc2(x))
        x = self.dropout(x) # p=0.5
        # 第三个全连接层输出分类结果
        x = self.fc3(x)
        return x
相关推荐
newrank_kk1 分钟前
营销新前沿:智汇GEO如何重构品牌AI形象管理?
人工智能·重构
汤姆yu10 分钟前
基于深度学习yolov8的课堂行为监测系统
人工智能·深度学习·yolo
J2虾虾15 分钟前
地理空间概述
人工智能
小妖同学学AI16 分钟前
开源AI语音机器人小智Xiaozhi-ESP32:低成本构建个人智能助理
人工智能·机器人·开源
xjxijd17 分钟前
数据中心能效 AI 引擎:全链数字孪生 + 传热学算法,PUE 稳定 1.05 以下
大数据·服务器·人工智能
天一生水water21 分钟前
语义分割入门
人工智能
小鸡吃米…30 分钟前
AI 与 Python 自然语言处理
人工智能·自然语言处理
无心水37 分钟前
【Stable Diffusion 3.5 FP8】8、生产级保障:Stable Diffusion 3.5 FP8 伦理安全与问题排查
人工智能·python·安全·docker·stable diffusion·ai镜像开发·镜像实战开发
小程故事多_8041 分钟前
开源封神!Minion Skills 重构 Claude Skills,解锁 AI Agent 无限能力
人工智能·重构·开源·aigc
minhuan44 分钟前
大模型应用:不减性能只减负担:大模型稀疏化技术全景与实践.36
大数据·人工智能·算法