Stable diffusion 学习过程

蜡笔新小2024-09-18 11:03

diffusion model

讲解：

【较真系列】讲人话-Diffusion Model全解(原理+代码+公式)_哔哩哔哩_bilibili

stable diffusion【CVPR2022】

原始论文： https://arxiv.org/pdf/2112.10752

讲解：【论文简介】Stable Diffusion的基础论文:2112.High-Resolution Image Synthesis with Latent Diffusion Models_stable diffusion论文-CSDN博客

代码：

GitHub - CompVis/stable-diffusion: A latent text-to-image diffusion model

Dreambooth【CVPR 2023】

论文：https://arxiv.org/pdf/2208.12242v1

代码：

感觉就是sd换了一个损失函数，然后又加上了sr模块。

SnapFusion【NeurIPs 2023】

讲解：https://zhuanlan.zhihu.com/p/650739412

论文：https://arxiv.org/pdf/2306.00980

创新点：

改进unet，将里面的结构去掉，分析效果，然后找到去掉结构后对网络影响最小的那几块使用；
蒸馏，对DDPM的步数进行蒸馏
VAE Decoder 优化，使用蒸馏

感觉改进不是很多。

DeepCache【CVPR2024】

论文：https://arxiv.org/pdf/2312.00858

讲解：https://zhuanlan.zhihu.com/p/673114336

代码：GitHub - horseee/DeepCache: $CVPR 2024$ DeepCache: Accelerating Diffusion Models for Free

创新点：

找的角度很好，改进并不大，效果很好，就是将上一时刻的特征缓存下来，然后后续直接使用。

stable diffusion3

讲解：https://zhuanlan.zhihu.com/p/685457842

论文：https://arxiv.org/pdf/2403.03206

改变了forward和backward的格式，后续还需要再研究一下

上一篇：828华为云征文 | 解锁企业级邮件服务，在华为云fFlexus x实例上部署Mailcow开源方案

下一篇：vue3+ts+supermap iclient3d for cesium功能集合

热门推荐

01如何新建文件夹？电脑新建文件夹的4种方法 02GitHub 镜像站点 032026年7月AI圈大地震：GPT-5.6被政府限制、Claude入驻Slack、Anthropic自研芯片 04国内可直接用、免费额度/永久免费的大模型API清单（含 SiliconFlow、火山、阿里、智谱、百度、Kimi、DeepSeek、DMXAPI 等）05AI科技热点日报 | 2026年07月01日 06微信历史版本含下载地址（ Windows PC | 安卓 | MAC ）及设置微信不更新 07AI 编程 IDE 全景解析 2026：Agent 全面接管开发链路 082026 国产 AI 大模型横评：DeepSeek、通义千问、Kimi、文心一言、星火、豆包谁更能打？09Agnes AI 免费 API 接入指南：文本、生图、生视频，一套接口全免费 10几个好用的ip纯净度检测网站