生成对抗网络GAN的扩展应用理解

:本文仅个人学习理解,如需详细内容请看原论文!

一、cycleGAN

1.整体架构:

将图片A通过生成器生成图片B,然后通过判别器判别图片B的真假;并且图片B通过另一个生成器生成A',让A和A'近似。

2.4种损失函数:

G网络、D网络、Cycle、Identity,D网络中使用了PatchGAN。

3.PatchGAN的作用:

​ 输出的是一个N × N的矩阵,需要基于感受野来计算损失;基于感受野在特征图上的预测结果,和标签(也需要设置成N x N)计算损失。

​ 每个圆圈代表一个patch。

二、starGAN v1

1.生成器:

通过输入input image、目标域(目标风格)然后输出fake image;

将fake image与原始信号再次输入到生成器G中,生成Reconstructed image,使Reconstructed image与input image 越接近越好;

将fake image再次输入到判别器D中,然后通过类别判断真假。

2.判别器:

输入real image 和 fake image,通过判别器D输出图片的真假,以及分类结果

三、starGAN v2

引入了 Mapping network 与 Style encoder

1.Generator:

加入style编码,通过Mapping network 和 Style encoder编码

2.Mapping network:

输入:随机初始化一个向量,如16维向量Z(原图像);在传入一个reference(提供风格的图像)。

输出:64维向量,经过风格转换的图像。

组成:一些全连接网络构成。

3.Style encoder:

将原始的图像X做一个编码E(X)得到一个64维的向量。

4.Discriminator:

输出多分支结果,假设有3种风格,就会输出6种结果,每种风格都会产生2种结果。

相关推荐
HiDev_4 分钟前
【非标自动化】2、认识元器件(液压泵和液压阀)
大数据·人工智能·自动化
这张生成的图像能检测吗8 分钟前
即插即用模块 + 改进思路汇总目录
图像处理·人工智能·深度学习·目标检测·机器学习
Geek-Chow9 分钟前
12 开源 vs 闭源:同一份权重,两种交付
人工智能·llm·大语言模型
一个处女座的程序猿20 分钟前
Agent之Tool:MoneyPrinterTurbo(一站式 AI 短视频生成工具)的简介、安装和使用方法、案例应用之详细攻略
人工智能·音视频·moneyprinter
港股研究社27 分钟前
物理AI临界点:智驾Tier 1越过规模效应拐点
人工智能
m4Rk_28 分钟前
【论文阅读】Agent 记忆机制(48):Fine-Mem——用细粒度奖励解决长期记忆管理中的奖励稀疏与信用分配
论文阅读·人工智能·学习·开源·github
IanSkunk33 分钟前
眼视光设备全周期台账:从验收入库到使用效果数据化的管理闭环
大数据·网络·人工智能
拓人间精准客36 分钟前
2025–2026 ToB 精准拓客实战手册:用“企业数据画像 + 动态筛选“击穿七大行业获客内卷
大数据·数据库·人工智能
北京GEO服务商余小铁41 分钟前
北京建材行业怎么通过 GEO 推广实现获客
人工智能
txg66641 分钟前
Less Is More:如何用半监督学习提升漏洞检测能力
人工智能·深度学习·学习·安全·开源软件