对抗生成网络总结

对一些基本的对抗生成网络的总结。部分内容整理自Teeyohuang's blog

文章目录

GAN (NeurIPS, 2014)

Generative adversarial nets

m i n G m a x D V ( D , G ) = E x ∼ P d a t a ( x ) l o g D ( x ) + E z ∼ P z ( x ) l o g ( 1 − D ( G ( x ) ) ) min_Gmax_DV(D,G) = E_{x\sim~P_{data}(x)}logD(x) + E_{z\sim~P_{z}(x)}log(1-D(G(x))) minGmaxDV(D,G)=Ex∼ Pdata(x)logD(x)+Ez∼ Pz(x)log(1−D(G(x))).

在实际训练的过程中,可以通过maximize logD(G(x))来训练G。

CGAN

Conditional generative adversarial nets

Pytorch版本代码

原始GAN的生成器G学到了数据的分布,生成出来的图片其实是随机的,也就是说这个G的生成过程处于一种没有指导的状态,虽然生成的图片,比如mnist数据集来说,生成的的确是数字,但是却没有具体的说是什么数字。 cGAN相当于在原始GAN的基础上加上一个条件:condition,以此来指导G的生成过程。
m i n G m a x D V ( D , G ) = E x ∼ P d a t a ( x ) l o g D ( x ∣ y ) + E z ∼ P z ( z ) l o g ( 1 − D ( G ( z ∣ y ) ) ) min_Gmax_DV(D,G) = E_{x\sim~P_{data}(x)}logD(x\|y) + E_{z\sim~P_{z}(z)}log(1-D(G(z\|y))) minGmaxDV(D,G)=Ex∼ Pdata(x)logD(x∣y)+Ez∼ Pz(z)log(1−D(G(z∣y)))

y作为条件,和数据x以及噪声z同时分别进入D和G中。

DCGAN

unsupervised representation learning with deep convolutional generative adversarial networks

Pytorch版本代码

该网络主要使用卷积层,之前的网络用的是全连接层。

StackGAN

**StackGAN: Text to Photo-realistic Image Synthesis with Stacked Generative Adversarial Networks**

基于对CGAN的改进,CGAN无法生成清晰大图,StackGAN希望通过一个描述C,产生一张256x256的图像。通过两个generator实现,第一个generator产生64x64的小图,然后把结果放入第二个generator中生成256x256的大图。

详细内容

Pix2Pix (CVPR, 2017)

Image-to-image translation with conditional adversarial networks

本篇论文的核心思想并不复杂,是借鉴了conditional-GAN的思想。但pix2pix的generator的输入端只有条件y作为输入而没有噪声z。最终训练完成后可以从一张图A变换到另一张图B。

We demonstrate that this approach is effective at synthesizing photos from label maps, reconstructing objects from edge maps, and colorizing images, among other tasks.

CycleGAN (ICCV, 2017)

Unpaired image-to-image translation using cycle-consistent adversarial networks

CycleGAN详细解读

创新点:源于和目标域之间,无需建立训练数据一对一映射(对比pix2pix),就可实现风格迁移。

在CycleGAN中,不仅需要生成器产生的图片y'和数据集Y中的图片画风一样,还需要y'和输入图片x的内容一样。

  • Loss function: Loss GAN + Loss cycle
    • Loss cycle: 将y'放入生成器F中,产生的新图片x'与原始x尽可能相似。即F(G(x))=x。
    • Loss GAN

SRGAN (CVPR, 2017)

**Photo-Realistic Single Image Super-Resolution Using a Generative Adversarial Network**

首次使用生成对抗网络(GAN)应用于图像超分辨率(SR)

SRGAN论文阅读笔记

StyleGAN (CVPR, 2019)

A style-based generator architecture for generative adversarial networks

StyleGAN 用风格(style)来影响人脸的姿态、身份特征等,用噪声 ( noise ) 来影响头发丝、皱纹、肤色等细节部分。

StyleGAN论文超详细解读

相关推荐
沙淘金数据服务3 分钟前
电商订单数据整合难题拆解:多源异构数据如何实现自动化治理?
大数据·人工智能·数据治理·数据清洗·电商·外贸
万岳科技系统开发4 分钟前
AI数字人直播系统源码搭建指南:数字人、语音与直播如何实现
人工智能
论文复现现场6 分钟前
本地 PyTorch 训练 OOM,第一次租 RTX 4090 云 GPU 怎么迁移项目?从环境检查到 100 Step 跑通
人工智能·pytorch·python·深度学习·cuda
云雀衔光9 分钟前
MCP 协议全景:为什么它是 AI 连接工具的「USB-C」
java·开发语言·数据库·人工智能·ai编程
kyle~10 分钟前
ISP--- RAW 图像 从传感器噪声模型到快门时序与频闪效应
人工智能·计算机视觉·接口隔离原则
外域速览13 分钟前
AI开始训练AI:黄仁勋喊AGI已到
大数据·人工智能·agi
科技云报道25 分钟前
AI时代重新定义“信任”,瑞数信息发布全新AI安全产品体系
人工智能·安全
用户9701615016830 分钟前
微服务里最危险的 DELETE,不是删不掉,是只删了一半
人工智能·后端
夏洛克信徒32 分钟前
当黄仁勋说出“AGI已来“:2026年9月大模型风暴观察
人工智能·gpt·chatgpt·agi
通问AI35 分钟前
用多模态图像模型批量生产电商主图:Prompt 模板化 + 自动化质检的工程实践
人工智能