Stable diffusion 学习过程

diffusion model

讲解:

【较真系列】讲人话-Diffusion Model全解(原理+代码+公式)_哔哩哔哩_bilibili

stable diffusion【CVPR2022】

原始论文: https://arxiv.org/pdf/2112.10752

讲解:【论文简介】Stable Diffusion的基础论文:2112.High-Resolution Image Synthesis with Latent Diffusion Models_stable diffusion论文-CSDN博客

代码:

GitHub - CompVis/stable-diffusion: A latent text-to-image diffusion model

Dreambooth【CVPR 2023】

论文:https://arxiv.org/pdf/2208.12242v1

代码:

感觉就是sd换了一个损失函数,然后又加上了sr模块。

SnapFusion【NeurIPs 2023

讲解:https://zhuanlan.zhihu.com/p/650739412

论文:https://arxiv.org/pdf/2306.00980

创新点:

  1. 改进unet,将里面的结构去掉,分析效果,然后找到去掉结构后对网络影响最小的那几块使用;

  2. 蒸馏,对DDPM的步数进行蒸馏

  3. VAE Decoder 优化,使用蒸馏

感觉改进不是很多。

DeepCache【CVPR2024】

论文:https://arxiv.org/pdf/2312.00858

讲解:https://zhuanlan.zhihu.com/p/673114336

代码:GitHub - horseee/DeepCache: [CVPR 2024] DeepCache: Accelerating Diffusion Models for Free

创新点:

找的角度很好,改进并不大,效果很好,就是将上一时刻的特征缓存下来,然后后续直接使用。

stable diffusion3

讲解:https://zhuanlan.zhihu.com/p/685457842

论文:https://arxiv.org/pdf/2403.03206

改变了forward和backward的格式,后续还需要再研究一下

相关推荐
丶Darling.23 分钟前
深度学习与神经网络 | 邱锡鹏 | 第二章学习笔记
深度学习·神经网络·学习
shelly聊AI41 分钟前
Meta上新Llama 4,到底行不行?
人工智能·llama
孔令飞1 小时前
22 | 如何继续提升 Go 开发技术?
人工智能·ai·云原生·golang·kubernetes
点我头像干啥1 小时前
机器学习中的聚类分析算法:原理与应用
人工智能·算法·机器学习
Shockang1 小时前
机器学习的一百个概念(9)学习曲线
人工智能·机器学习
WoShop商城源码1 小时前
武汉迅狐科技:AI赋能企业营销,打造智能获客新范式
大数据·人工智能·科技
无涯学徒19981 小时前
G1学习打卡
学习
Chaos_Wang_1 小时前
LLM Agents项目推荐:MetaGPT、AutoGen、AgentVerse详解
人工智能·语言模型·自然语言处理
OpenCSG1 小时前
引领东方语言识别新风潮!Dolphin语音模型开创自动语音识别(ASR)新时代
人工智能·语音识别
DIKKOO1 小时前
用端侧大模型快速实现翻译业务?Transformers.js Demo 解读
前端·人工智能