GANs学习笔记

一、完整公式

J(θ)=−1m∑i=1my(i)log⁡hθ(x(i))+(1−y(i))log⁡(1−hθ(x(i))) J(\theta) = -\frac{1}{m} \sum_{i=1}^m \Big y\^{(i)} \\log h_\\theta(x\^{(i)}) + (1-y\^{(i)}) \\log\\big(1-h_\\theta(x\^{(i)})\\big) \\Big J(θ)=−m1i=1∑my(i)loghθ(x(i))+(1−y(i))log(1−hθ(x(i)))

这是二分类逻辑回归的标准损失函数(对数交叉熵损失),用来衡量模型预测结果和真实结果的差距。


二、逐个符号解释

  1. J(θ)J(\theta)J(θ)

    整体损失值/代价函数。数值越大,代表模型预测越不准;训练目标就是最小化 J(θ)J(\theta)J(θ)。

  2. mmm

    训练集里样本总数量 。除以 mmm 是为了取平均损失,消除样本总数的影响。

  3. ∑i=1m\displaystyle\sum_{i=1}^mi=1∑m

    对每一个样本 的损失求和,iii 代表第 iii 个样本。

  4. y(i)y^{(i)}y(i)

    第 iii 个样本的真实标签,二分类只有两个取值:

    • y=1y=1y=1:属于正样本
    • y=0y=0y=0:属于负样本
  5. hθ(x(i))h_\theta(x^{(i)})hθ(x(i))

    模型对第 iii 个样本的预测概率 ,取值范围 (0,1)(0,1)(0,1),表示该样本是正类的概率。

  6. 负号 −-−

    因为对数函数 log⁡(x)\log(x)log(x) 在 x∈(0,1)x\in(0,1)x∈(0,1) 时结果为负数,加负号把损失转为正数,方便优化。


三、分场景理解(核心逻辑)

把公式拆成两部分,对应两种真实标签:

场景1:真实标签 y=1y=1y=1(正样本)

此时 1−y=01-y=01−y=0,后半项直接消失,公式简化为:

单样本损失=−log⁡(hθ(x)) \text{单样本损失} = -\log\big(h_\theta(x)\big) 单样本损失=−log(hθ(x))

  • 模型预测 hhh 越接近 111(预测正确):损失趋近于 0
  • 模型预测 hhh 越接近 000(预测错误):损失急剧变大,严厉惩罚错误

场景2:真实标签 y=0y=0y=0(负样本)

此时 y=0y=0y=0,前半项直接消失,公式简化为:

单样本损失=−log⁡(1−hθ(x)) \text{单样本损失} = -\log\big(1-h_\theta(x)\big) 单样本损失=−log(1−hθ(x))

  • 模型预测 hhh 越接近 000(预测正确):损失趋近于 0
  • 模型预测 hhh 越接近 111(预测错误):损失急剧变大

四、整体作用总结

  1. 对二分类任务量身设计,专门评价逻辑回归模型好坏;
  2. 预测越偏离真实标签,损失值越高,倒逼模型不断修正参数;
  3. 相比平方损失,交叉熵在分类任务中梯度更稳定、收敛更快,是机器学习分类模型最常用的损失函数。
相关推荐
阳光九叶草LXGZXJ5 小时前
达梦数据库-学习-68-dmasm0X_XXXXXX.log日志激增
linux·运维·数据库·sql·学习
火眼金睛记单词5 小时前
专项突破词汇:如何高效提升英语学习效率
学习
zhangrelay5 小时前
机器人或计算机智能与时间相关案例汇总(ROS2-ROS1)
linux·笔记·学习·ubuntu·机器人
老王爱玩车6 小时前
深入理解指针6
c语言·开发语言·学习
传奇开心果编程6 小时前
【SwiftUI入门练中学】第17课 通知与后台任务
学习·ui·ios·swiftui·swift
Neo Wordsworth6 小时前
随便笔记2
笔记
承渊政道6 小时前
Linux系统学习【线程概念与控制核心知识详解】
linux·运维·vscode·学习·ubuntu·线程创建 终止 等待
励志不掉头发的内向程序员6 小时前
【从零写一个CAD 04】中键拖动平移:抓住一个点,让它一直待在鼠标底下
开发语言·c++·qt·学习·系统架构·计算机外设
UIU1146 小时前
同一个变量在两个 .c 文件里类型不一致,程序会怎样?
c++·学习·c#
GEO从入门到精通14 小时前
课程怎么选?2026年GEO学习资源全梳理
学习