【半监督学习常见算法】

半监督学习:如何用10%的已知,学会100%的世界?

灵魂三问

问一:如果老师只教了10道题,我能学会100道吗?

:这就是自训练------先做会的那10道,然后用这个思路去"猜"剩下的90道。猜对了的题,就当成"新例题"加入题库,继续学。

  • 风险:猜错第一道,后面可能全错(错误传播)

问二:一个人看不准,两个人互相看会更准吗?

:这就是协同训练------就像两个专家:一个看颜色,一个看形状。各自判断一批,然后交换"参考答案"互相学习。

  • 要求:数据必须有至少两个不同的观察角度

问三:如果知道"A是苹果",那么和A很像的B,是不是也该是苹果?

:这就是标签传播------标签会像朋友圈消息一样,从已标注数据顺着"相似度网络"传播出去。

  • 关键:相似的数据应该有相似的标签

问四:一件衣服换个角度拍,还是那件衣服吗?

:这就是一致性正则化 ------对同一张图片(轻微旋转/裁剪),要求模型给出相同判断。这逼模型关注本质特征,忽略无关细节。


🎯 四大算法一句话看懂

算法 一句话 像什么
自训练 "我觉得这个也是" → 加入题库 学生变老师
协同训练 "你看颜色,我看形状" → 交换答案 双专家会诊
标签传播 "他已经是了,你也应该是" 朋友圈扩散
一致性正则化 "换个马甲我也认识你" 认人不认衣服

💡 什么时候用哪个?

  • 数据很可靠,怕出错少 → 自训练
  • 数据能从两个角度描述 → 协同训练
  • 数据间相似度很明显 → 标签传播
  • 数据容易做不影响本质的改动 → 一致性正则化

🌟 终极智慧

半监督学习的本质是:

  • 承认"完全标注太贵"(现实)
  • 但拒绝"没标注就放弃"(智慧)
  • 已知未知之间搭桥
  • 让有限的真理,照亮无限的未知

就像现实中:

父母只教了你10种危险(已知)

你却能识别100种危险情况(推理)

------用少量确定,应对大量不确定,这就是成长的智慧。

相关推荐
Java程序员威哥1 分钟前
用Java玩转机器学习:协同过滤算法实战(比Python快3倍的工程实现)
java·开发语言·后端·python·算法·spring·机器学习
Lips6113 分钟前
第六章 支持向量机
算法·机器学习·支持向量机
Howrun7779 分钟前
信号量(Semaphore)
开发语言·c++·算法
cheems952716 分钟前
[Java EE]多线程模式下容器的选择
算法·哈希算法
sjg2001041417 分钟前
GoFrame学习随便记3(待续)
学习
飞Link26 分钟前
指令调整阶段中的通用模型蒸馏、模型自我提升和数据扩充
python·算法·数据挖掘
sunfove33 分钟前
从数据到智能:机器学习核心方法的数学原理与全景解构
人工智能·机器学习
千里马学框架44 分钟前
跟着google官方文档学习车载音频Car audio configuration
学习·configuration·音视频·aaos·安卓framework开发·audio·车机
wen__xvn1 小时前
基础算法集训第01天:线性枚举
数据结构·c++·算法
nju_spy1 小时前
力扣每日一题 2026.1
算法·leetcode·二分查找·动态规划·最小生成树·单调栈·最长公共子序列