pytorch的卷积层池化层和非线性变化 和机器学习线性回归

卷积层:

两个输出的情况 就会有两个通道 可以改变通道数的

最简单的神经网络结构:

nn.Mudule就是继承父类

super执行的是 先执行父类函数里面的

forward执行的就是前向网络,就是往前推进的,当然也有反向转播,那就是用来就gradient dicent了,求导计算了。

卷积后的结果展示:

这里有个小细节

224 *244输出 224 *224 肯定是加了padding的,如何算出这个padding 官网给了公式

这个一般用不到,写论文科研可以再去官网查看

下面介绍池化层

mxpool是下采样,mxunpool是上采样,dilation是空洞卷积,ceil------mode来保留,用来对应下面情况

最大池化操作,这里有一点要注意,stride(每次核移动的步进)默认为卷积核一样大小

池化的直观感受就是变模糊了,保留了数据的主要特征,减小了数据量。

下面介绍非线性:

inplace如果是1的话就是替换input,如果是flase的话,就是把输出用另一个变量来承接

一般来说是要false的,保留以前的数据嘛

下面是使用sigmoid函数进行的非线性处理

插播stm32学习的:

陀螺仪原理:

下面介绍机器学习线性回归的问题:

x就是各种已知道的特征,这就是回归任务的第一步,线性回归

,这是实际值

第二步 就是我有label 和feartures 用函数预测出预测label,比较好坏。选出比较规则。

利用梯度下降,第三步找到最好loss

这种情况看人品?no 线性回归不需要担心,永远是第一种情况

梯度下降的算法:

用二次拟合更好的model:

或者更高的次来拟合更好的model 和更低的loss:

直到你用更高次的model来拟合,train 的结果更高了,但是test的结果更差了,这个就是过拟合了overfitting了

这个时候我们还要考虑:有时候只考虑一种feature肯定是不够的

用冲激函数来乘 来做选择,考虑多种feature

把全部能想象到的参数都加进去,因为我们不知道有哪些参数是影响的,这样做,我们在train上可以得到很低,但是又可能会过拟合!做到这里,还可以回到第二步,定义model的好坏。第二部只考虑的了预测值的error,regularization是加上额外的wi

要求参数越小越好,降低敏感度,提高函数的平滑性!

也不可以太平滑了,就相当于一个水平线,啥也干不成。调整朗木达来调整,为什么朗木达里面没有加上b?因为调整b的大小根本没用

总结:一个输出和多个feature有关,不过我们不确定那些有影响,就会overfiting,可以用正则化来平滑函数

相关推荐
吃旺旺雪饼的小男孩12 小时前
U-Net 语义分割详解:原论文、PyTorch 实现与真实消融实
人工智能·pytorch·python·算法
空堂与归13 小时前
如何用Python实现深度学习?PyTorch框架核心与实践
pytorch·python·深度学习
浪兎兎14 小时前
【深度学习】(四)案例:基于PyTorch的全连接神经网络实现手机价格区间预测
pytorch·深度学习·神经网络
sel_914 小时前
【Pytorch】PyTorch 深度学习框架详解:从安装到实战
人工智能·pytorch·深度学习·算法·语言模型
SomeB1oody14 小时前
【RustyML入门】7.3. 性能调优与并行
开发语言·后端·机器学习·rust·教程
遥感知识服务1 天前
从局部阈值、双极化到暗地表剔除:NASA OPERA DSWx-S1全球动态水体算法拆解
大数据·人工智能·深度学习·神经网络·算法·机器学习
chunmiao30321 天前
皮尤研究:ChatGPT 发布后,超三成新网页带 AI 创作痕迹
人工智能·机器学习·chatgpt
lancyu1 天前
关于多轮对话机器人的上下文Token优化和解决方案
人工智能·python·深度学习·机器学习·chatgpt·机器人·prompt
单词记忆方法研究1 天前
大学英语单词:我踩过的坑,和你该走的路
机器学习·小程序·学习方法
cxr8281 天前
数学的本质:关系、模式与不变量的结构世界
人工智能·算法·机器学习