PyTorch踩坑记录1

1 model.eval()无法关闭dropout

因为model.eval()控制self.training参数,只有用nn.Dropout(0.5)声明才能在调用model.eval()后关闭,用F.dropout(x, p=0.5)是没办法自动关闭的,需要手动把self.training的参数传入到F.dropout()里才行。

网上查到是因为model.eval()会影响继承nn.module类的self.方法的训练和测试,但是F.dropout更像是一个函数没继承nn,module。

另外,回归模型在后面几层应该避免使用dropout,最多在浅层使用。

2 BCEloss归一化

在tf2中BCEloss没有归一化,但是在torch中的损失函数是归一化了的。

相关推荐
Z-D-K7 分钟前
一个AI的真实日记(3)
人工智能·ai·aigc·人机交互·agent·agi
二进制杯莫停10 分钟前
A和B环境的python版本相同,B环境无法安装pip依赖,离线安装
开发语言·python·pip
ivywriter11 分钟前
【数字孪生】到底能解决什么实际问题?
大数据·人工智能·机器人
(轻舟已过万重山)15 分钟前
第39章 评估迭代:上线只是开始,迭代才是关键
大数据·数据库·人工智能
听你说3215 分钟前
鹏辉LIC+EDLC高功率电容解决方案,为工业自动化、智能IoT、UPS备电等高负载设备而生
人工智能·物联网·自动化·创业创新
墨染天姬19 分钟前
【AI】从MOE混合专家到 MOA混合智能体
人工智能
甲维斯21 分钟前
国产版“Claude Code”也支持电脑控制了,kimi也是越用越爽了!
人工智能
KKKlucifer25 分钟前
AI 驱动告警研判:运营商智能化安全运维支撑服务实践案例
人工智能·安全
仙女修炼史28 分钟前
word2Vec理解(下):本质理解
人工智能·自然语言处理·word2vec
惊鸿一博30 分钟前
# 生成模型(Generative Models)基础介绍_四大分类_扩散模型介绍
人工智能