GAN初次阅读

研究背景

深度学习在判别式模型 (高维输入映射到类别标签,如图像分类)上取得巨大成功,核心依赖反向传播、Dropout 和分段线性激活函数;但生成式模型发展受限,原因是极大似然估计等方法涉及难以近似的概率计算,且难以在生成场景中利用分段线性激活函数的优势,本文提出的 GAN 框架解决了这一痛点。

特征维度 :回答的是「一个数据样本的属性 / 特征,需要几个数值描述?

想让模型学 "猫的图像分布",传统方法需要先算出「所有可能的猫图像的概率和(配分函数)」,但猫的图像有无数种(姿势、颜色、角度),根本算不出来;只能用 MCMC 反复采样 "近似猫的分布",但采样可能只停留在 "橘猫",学不会 "布偶猫",最终模型只能生成橘猫,丧失多样性。

核心框架

GAN 由**生成器(G) 判别器(D)两个多层感知器(MLP)组成**

G:把无意义的随机噪声z,通过网络神经映射,变成如同真实样本一样

初始状态,辨别器强,因此,总体是0,

后面慢慢的生成器开始发力,然后总体的都是1/2

核心训练方法(讲清「怎么训」,突出「简单高效」)

  • 训练的核心原则:交替训练 D 和 G(D 训 k 步,G 训 1 步),原因是 "一次性把 D 训到最优计算量太大,还会过拟合";
  • 训练的技术亮点仅用反向传播 + Dropout,生成样本仅需正向传播,对比传统模型的 "马尔可夫链 / 近似推理",突出 GAN 的计算简洁性(汇报时可加一句「这是 GAN 最核心的工程优势」)。

如何求期望

因此等价于

最大化,就是不看积分那里,然后求极值点

相关推荐
deepdata_cn3 分钟前
向量数据库是非结构化数据的AI检索底座
数据库·人工智能
zzz_236814 分钟前
长程 Agent 怎么评测:Task、Trial、Grader、Outcome 与 Evaluation Harness
人工智能·agent·agent测评
桃西西呀15 分钟前
跟着跑一遍 Harbor:从 harbor run 到读懂 result.json
人工智能
DogDaoDao20 分钟前
NNVC-17.1 深度解析:神经网络视频编码的最新进展与性能全景
神经网络·音视频·视频编解码·h266·vvc·vtm·nnvc
AI产品测评官21 分钟前
AI 招聘技术选型指南:四类垂直方案的技术路径与落地对比
人工智能·求职招聘
星火102428 分钟前
【LangChain4j系列05】RAG 检索增强生成完整指南
人工智能·后端
xushichang123_30 分钟前
如何观看 2026 亚马逊云科技中国峰会全场主题演讲与技术分论坛内容?
大数据·人工智能
科技新资讯35 分钟前
视频出海精细化升级:帧级对口型技术与商用工具落地能力分析
人工智能·音视频
微硬创新44 分钟前
大点数模拟量采集落地:耐达讯自动化32路0-20mA适配PROFINET总线实践解析
运维·人工智能·网络协议·自动化·信息与通信
招财小梗1 小时前
AI矩阵获客,品牌连锁落地有啥方案?
大数据·人工智能·矩阵