【AI学习】扩散模型的一点思考:生成过程为什么要增加噪声项

前面学习了扩散模型,并做了总结PPT

其中有一个疑问:在生成过程中,就是下图的算法2中的第四步,为什么要在预测了噪声项后,Xt减去预测的噪声后,还有再叠加一个噪声项?就是增加的部分。

李宏毅的讲解中,指出,如果不增加这个噪声项,最后就无法有效生成图片。

这两天忽然想到,其实,在前向过程中,每一步都在叠加一个高斯噪声。而在反向过程,每一步都重新估计这个高斯噪声,然后减去预测的噪声,最终恢复图形。但是,看了公式推导我们知道,其实,每一步估计噪声,其实是估计的噪声的均值。如果每一步只是减去一个预测的噪声的均值,那反向过程的每一步就不是如前向过程一样去处理高斯噪声,毕竟均值是一个确定项。所以还要增加前面所说的噪声项目,让反向过程的每一步真正实现减去高斯噪声的目的。

相关推荐
万里鹏程转瞬至1 小时前
InternVL(1~3.5版本)多模型大模型训练中的数据集构造总结
人工智能
badhope6 小时前
Mobile-Skills:移动端技能可视化的创新实践
开发语言·人工智能·git·智能手机·github
吴佳浩7 小时前
GPU 编号进阶:CUDA\_VISIBLE\_DEVICES、多进程与容器化陷阱
人工智能·pytorch·python
吴佳浩8 小时前
GPU 编号错乱踩坑指南:PyTorch cuda 编号与 nvidia-smi 不一致
人工智能·pytorch·nvidia
小饕8 小时前
苏格拉底式提问对抗315 AI投毒:实操指南
网络·人工智能
卧蚕土豆8 小时前
【有啥问啥】OpenClaw 安装与使用教程
人工智能·深度学习
GoCodingInMyWay8 小时前
开源好物 26/03
人工智能·开源
AI科技星8 小时前
全尺度角速度统一:基于 v ≡ c 的纯推导与验证
c语言·开发语言·人工智能·opencv·算法·机器学习·数据挖掘
zhangfeng11338 小时前
Windows 的 Git Bash 中使用 md5sum 命令非常简单 md5做文件完整性检测 WinRAR 可以计算文件的 MD5 值
人工智能·windows·git·bash
monsion9 小时前
OpenCode 学习指南
人工智能·vscode·架构