PyTorch踩坑记录1

1 model.eval()无法关闭dropout

因为model.eval()控制self.training参数,只有用nn.Dropout(0.5)声明才能在调用model.eval()后关闭,用F.dropout(x, p=0.5)是没办法自动关闭的,需要手动把self.training的参数传入到F.dropout()里才行。

网上查到是因为model.eval()会影响继承nn.module类的self.方法的训练和测试,但是F.dropout更像是一个函数没继承nn,module。

另外,回归模型在后面几层应该避免使用dropout,最多在浅层使用。

2 BCEloss归一化

在tf2中BCEloss没有归一化,但是在torch中的损失函数是归一化了的。

相关推荐
小蜗 strong5 分钟前
和电脑猜拳(随机程序应用)
服务器·前端·python
百数平台12 分钟前
百数 AI 智能体怎么使用?基础操作与常见问题解答
人工智能
xingyuzhisuan14 分钟前
无限画布实操分享:基于 StarVerse-AI 制作连续国风漫剧分镜
人工智能
FII工业富联科技服务17 分钟前
从 AI for AI 到 AI Factory:大模型重构智能制造技术底座的四层逻辑
人工智能
AI天行健1 小时前
内容工作室 AI 视频量产选型:星宇智算无限画布能解决哪些生产卡点
人工智能·音视频
工匠解码1 小时前
Agent 实现方式理论篇:从单轮调用到多 Agent 协作
人工智能
硅谷秋水1 小时前
WLA³:面向语义、动力学与运动学的世界潜动作建模
人工智能·机器学习·计算机视觉·语言模型·机器人
华研前沿标杆游学1 小时前
企业标杆游学|走进东莞OPPO总部✨探秘智造与品牌出海
python
@陈小鱼1 小时前
基于CNN-Transformer的无袖带血压估计
人工智能·深度学习·神经网络·算法·cnn·transformer·血压
大侠归来1 小时前
C语言内存管理:从栈到堆的完整指南
c语言·开发语言·python