相对自适应判别器(Relative Adaptive Discriminator, RAD)

文献1提出了一种改进的生成对抗网络(GAN)框架,旨在解决传统GAN和进化GAN(EGAN)中常见的训练不稳定、模式崩溃、梯度消失和高计算成本等问题。其中有一个创新点指出传统判别器基于绝对分数判断真假样本,容易导致训练不平衡。RAD基于相对logit差异来评估真实样本和生成样本。

传统GAN判别器的损失:

这篇文章提出的:

其中:

生成器的损失:

在这里回顾一下GAN的设计思路,这涉及了一个博弈论的思想,简单说就是让生成器尽力去欺骗判别器(xfake→xreal),而判别器要尽力去区分这个数据是否来自生成器(D(xreal)→1、D(xfake)→0)。

再来看这篇论文的改进思路,其核心思想是:比较同一小批中的真实样本和生成样本,并从它们的差异(相对logits)中学习,而不是绝对概率。

他给了伪代码,其中他设计了两个生成样本,但并未见其如何使用。

在这里我用Pytorch实现一下:

python 复制代码
import torch
import torch.nn as nn
import torch.nn.functional as F
python 复制代码
def rad_generator_loss(real_logits, fake_logits, eps=1e-8):
    """
    相对自适应生成器损失
    参数:
        real_logits: 判别器对真实样本的输出, shape (batch_size,)
        fake_logits: 判别器对生成样本的输出, shape (batch_size,)
    返回:
        生成器损失标量
    """
    # 生成器希望 fake_logits - real_logits 尽量大
    diff_fake_real = fake_logits - real_logits
    loss_gen = -torch.log(torch.sigmoid(diff_fake_real) + eps).mean()
    return loss_gen
python 复制代码
def rad_discriminator_loss(real_logits, fake_logits, eps=1e-8):
    """
    相对自适应判别器损失 (RAD)
    参数:
        real_logits: 判别器对真实样本的输出, shape (batch_size,)
        fake_logits: 判别器对生成样本的输出, shape (batch_size,)
        eps: 防止 log 数值不稳定
    返回:
        判别器损失标量
    """
    # 保持广播机制,对每个样本对计算差值
    # 第一项: log σ(real - fake)
    diff_real_fake = real_logits - fake_logits
    loss_real = -torch.log(torch.sigmoid(diff_real_fake) + eps).mean()
    # 第二项: log σ(fake - real)
    diff_fake_real = fake_logits - real_logits
    loss_fake = -torch.log(torch.sigmoid(diff_fake_real) + eps).mean()
    
    return loss_real + loss_fake

参考文献:

1Atifa Rafique, Xue Yu, Kashif Iqbal, Mujahid Tabassum, Amir Hussain, Khursheed Aurangzeb,

MD-EGAN: Evolutionary GAN with dynamic latent sampling and relative adaptive discriminator for improved performance,Neurocomputing,Volume664,2026,131951, https://doi.org/10.1016/j.ne ucom.2025.131951.

***************END**************

相关推荐
xx_xxxxx_20 小时前
AI基本结构12-lstm实现nlp
人工智能·pytorch·rnn·lstm
工业机器视觉设计和实现21 小时前
cifar10训练突破80分(三,摸到pytorch尾灯!)
人工智能·pytorch·cudnn微积分
想会飞的蒲公英21 小时前
PyTorch reshape、view、transpose、广播到底怎么选?
人工智能·pytorch·python
风痕天际2 天前
Pytorch开发教程2——张量核心操作完全指南
人工智能·pytorch·python
m沐沐2 天前
【深度学习】循环神经网络RNN——结构、原理与长期依赖问题解析
人工智能·pytorch·python·rnn·深度学习·算法·机器学习
FriendshipT2 天前
Ultralytics:简要解读YOLOv8 → YOLO11 → YOLO26网络架构
人工智能·pytorch·python·深度学习·yolo·目标检测
工业机器视觉设计和实现3 天前
动量的好处与困扰(二,摸到pytorch尾灯!)
人工智能·pytorch·cudnn微积分
盼小辉丶3 天前
PyTorch强化学习实战(20)——优势演员-评论家(Advantage Actor-Critic, A2C)
pytorch·深度学习·强化学习·优势演员-评论家算法
魔镜er4 天前
03-张量
人工智能·pytorch·python
Black_Rock_br4 天前
打通 PyTorch Monarch 与 ROCm:单 Controller 架构的异构算力实战
人工智能·pytorch·python·开源