深度学习与数学归纳法

最近发现,深度学习可以分为两个主要的阶段,分别是前向推理以及反向传播,分别对应着网络的推理和参数训练两个步骤。其中推理有时候也称为归纳推理。

在做参数训练的时候,本质上是在利用历史数据求网络参数的先验分布; p ( θ ∣ x , y ) p(\theta | x,y) p(θ∣x,y)

在推理的时候,本质是在基于训练好的参数进行极大似然估计。 p ( y ∣ x , θ ) p(y |x, \theta) p(y∣x,θ)

此外,深度学习解决问题时,往往先假设所有的参数都能够训练到最优 θ ∗ \theta^* θ∗,然后在这个最优训练参数假设下构建前向网络进行建模。等建模表征完之后,再去基于数据和优化器把参数训练到最优。这个思想其实和数学归纳法里面的先假设某个条件成立,再去做其他事情,然后再反过来优化这个条件很像,也和EM估计的思想很像。

这也可以解释为什么很多网络结构的改进的论文,本质上是提供了参数交互的接口,让网络有机会对某种类型的数据进行建模和表征,然后再去对其进行训练。

相关推荐
newxtc9 分钟前
【 广州产权交易所-注册安全分析报告-无验证方式导致安全隐患】
开发语言·人工智能·selenium·安全·yolo
AIzealot无25 分钟前
Qwen3 Embedding报告随笔
人工智能·深度学习·算法·论文·embedding·论文笔记·搜广推
渡我白衣27 分钟前
《深度学习进阶(四)——多模态智能:语言、视觉与语音的融合》
人工智能·深度学习
weixin_4180076028 分钟前
用opencv来识别信用卡的号码 Vs 使用yolo+paddleocr
人工智能·opencv·yolo
爱凤的小光40 分钟前
OpenCV的数据类型二
人工智能·opencv
flay42 分钟前
Claude Code + Git:AI驱动的版本管理最佳实践
人工智能·ai编程
王一点er43 分钟前
为什么LLM中KL散度需要近似计算
人工智能·深度学习
golang学习记1 小时前
Github狂飙8k star,Claude Code 模板:一键搞定项目配置的高级法器
人工智能
悠闲蜗牛�1 小时前
深度学习与大规模系统构建:AI技术在实际项目中的应用
人工智能·深度学习
小虎AI生活1 小时前
我把Claude Code卸载了,只因这款国产免费神器...
人工智能·ai编程