Stable diffusion 学习过程

diffusion model

讲解:

【较真系列】讲人话-Diffusion Model全解(原理+代码+公式)_哔哩哔哩_bilibili

stable diffusion【CVPR2022】

原始论文: https://arxiv.org/pdf/2112.10752

讲解:【论文简介】Stable Diffusion的基础论文:2112.High-Resolution Image Synthesis with Latent Diffusion Models_stable diffusion论文-CSDN博客

代码:

GitHub - CompVis/stable-diffusion: A latent text-to-image diffusion model

Dreambooth【CVPR 2023】

论文:https://arxiv.org/pdf/2208.12242v1

代码:

感觉就是sd换了一个损失函数,然后又加上了sr模块。

SnapFusion【NeurIPs 2023

讲解:https://zhuanlan.zhihu.com/p/650739412

论文:https://arxiv.org/pdf/2306.00980

创新点:

  1. 改进unet,将里面的结构去掉,分析效果,然后找到去掉结构后对网络影响最小的那几块使用;

  2. 蒸馏,对DDPM的步数进行蒸馏

  3. VAE Decoder 优化,使用蒸馏

感觉改进不是很多。

DeepCache【CVPR2024】

论文:https://arxiv.org/pdf/2312.00858

讲解:https://zhuanlan.zhihu.com/p/673114336

代码:GitHub - horseee/DeepCache: [CVPR 2024] DeepCache: Accelerating Diffusion Models for Free

创新点:

找的角度很好,改进并不大,效果很好,就是将上一时刻的特征缓存下来,然后后续直接使用。

stable diffusion3

讲解:https://zhuanlan.zhihu.com/p/685457842

论文:https://arxiv.org/pdf/2403.03206

改变了forward和backward的格式,后续还需要再研究一下

相关推荐
一只大袋鼠3 小时前
CNN 图像特征提取完整流程
人工智能·计算机视觉·cnn
码以致用3 小时前
GPT架构详解:从Transformer到大型语言模型
人工智能·深度学习·transformer
Nan_Shu_6143 小时前
学习:Cesium (4)
前端·学习
炽烈小老头3 小时前
【 每天学习一点算法 2026/03/25】在排序数组中查找元素的第一个和最后一个位置
学习·算法
LDG_AGI4 小时前
【人工智能】OpenClaw(一):MacOS极简安装OpenClaw之Docker版
运维·人工智能·深度学习·机器学习·docker·容器·推荐算法
一水鉴天4 小时前
智能代理体系 之2 20260325 (腾讯元宝)
人工智能·重构·架构·自动化
Monster丶6264 小时前
Docker 部署 Ollama 全流程指南:支持 CPU/GPU、生产环境可用的工程化实践
运维·人工智能·docker·容器
科雷软件测试4 小时前
Midscene.js - AI驱动,带来全新UI自动化体验(安装配置篇)
javascript·人工智能·ui
Java后端的Ai之路4 小时前
【AI应用开发】-怎么解决Lost in the Middle(中间迷失)现象?
人工智能·agent·rag·中间迷失·lost
HinsCoder4 小时前
【miclaw】——小米手机龙虾配置教程
人工智能·智能手机·llm·agent·openclaw·miclaw·手机龙虾