深度学习与数学归纳法

最近发现,深度学习可以分为两个主要的阶段,分别是前向推理以及反向传播,分别对应着网络的推理和参数训练两个步骤。其中推理有时候也称为归纳推理。

在做参数训练的时候,本质上是在利用历史数据求网络参数的先验分布; p ( θ ∣ x , y ) p(\theta | x,y) p(θ∣x,y)

在推理的时候,本质是在基于训练好的参数进行极大似然估计。 p ( y ∣ x , θ ) p(y |x, \theta) p(y∣x,θ)

此外,深度学习解决问题时,往往先假设所有的参数都能够训练到最优 θ ∗ \theta^* θ∗,然后在这个最优训练参数假设下构建前向网络进行建模。等建模表征完之后,再去基于数据和优化器把参数训练到最优。这个思想其实和数学归纳法里面的先假设某个条件成立,再去做其他事情,然后再反过来优化这个条件很像,也和EM估计的思想很像。

这也可以解释为什么很多网络结构的改进的论文,本质上是提供了参数交互的接口,让网络有机会对某种类型的数据进行建模和表征,然后再去对其进行训练。

相关推荐
qq_15321452641 小时前
【2023工业3D异常检测文献】PointCore: 基于局部-全局特征的高效无监督点云异常检测器
深度学习·神经网络·目标检测·机器学习·计算机视觉·3d·视觉检测
大模型实战1 小时前
深入探索《AI大模型开发之路》:我的读书心得
人工智能
sp_fyf_20241 小时前
计算机前沿技术-人工智能算法-大语言模型-最新研究进展-2024-09-25
人工智能·深度学习·算法·语言模型·自然语言处理
红米煮粥1 小时前
卷积神经网络-最优模型
人工智能·深度学习·cnn
赫连达1 小时前
大模型输入参数学习
人工智能·学习·ai·大模型
DA树聚1 小时前
人工智能-机器学习-深度学习-分类与算法梳理
人工智能·深度学习·算法·机器学习·语言模型·分类·transformer
杭州刘同学1 小时前
数据分析工具julius ai如何使用
人工智能·数据挖掘·数据分析
luthane2 小时前
ppython 实现k nearest neighbours k最近邻分类算法
人工智能·分类·数据挖掘
电气_空空2 小时前
自动驾驶电车难题的康德式道德决策
人工智能·机器学习·自动驾驶
宇来风满楼2 小时前
SNIDA
人工智能·深度学习·算法·机器学习·dnn