多实例学习简介

多实例学习(Multiple Instance Learning, MIL)是一种弱监督学习方法,主要特点是在训练过程中,标签是赋予 "样本包(bag)" 而不是单个实例(instance)。

基本概念:

  • 实例(Instance):单个数据点,如一张图像的一个小块。

  • 包(Bag):由多个实例组成的集合。

  • 标签(Label):只对整个包有标签,包内实例没有单独标签。

典型假设(Standard MIL Assumption):

  • 如果一个包中至少存在一个正实例,则该包为正;

  • 如果包中所有实例都是负的,则该包为负。

应用场景:

  • 病理图像分析:整张切片为正例时,仅意味着某个区域有病变,而非所有区域;

  • 药物发现:某种化合物活性为正,并不意味着其所有构象都有效;

  • 图像分类:仅提供图像级标签,但图像中可能只有局部区域与标签相关。

主要方法:

  1. 基于实例选择的方法(如MI-SVM):尝试在包中找到关键的"正实例"。

  2. 嵌入方法(如Deep MIL):将整个包映射为一个向量,再进行分类。

  3. 注意力机制方法:为每个实例分配权重,自适应学习关键区域。

小结:

多实例学习解决了标签粒度不匹配的问题,适用于实例级难以标注但包级标签易获得的场景。随着深度学习的发展,MIL也被广泛用于弱监督学习、目标定位和医学图像分析等领域。


一句话理解:

找到正实例(或估计其贡献)是为了更好地构造"包"的表示,最终对整个包进行分类(正或负)。

  • 找到正实例 ≈ 找到对包分类结果影响最大的实例。

  • 找到后,通过聚合这些实例的特征,形成包的表征。

  • 然后再对包进行分类(正/负),与常规分类模型一样使用标准损失函数优化。

可类比理解为:

一张正例 Whole Slide Image 中,仅某些 patch 含癌变。通过 MIL,我们找到这些关键 patch,用它们构造整张图的表达向量,再判断这张图是否为阳性。

相关推荐
星马梦缘1 天前
强化学习实战7——用决策树打赢星际争霸II
人工智能·决策树·强化学习·deepmind·星际争霸·sc2
CoderJia程序员甲1 天前
GitHub 热榜项目 - 日榜(2026-04-11)
人工智能·ai·大模型·github·ai教程
ChatInfo1 天前
Etsy 把 1000 个 MySQL 分片迁进 Vitess:425TB 数据背后的真正问题不是性能,而是运维规模
数据库·人工智能·mysql
lifallen1 天前
Flink Agents:Python 执行链路与跨语言 Actor (PyFlink Agent)
java·大数据·人工智能·python·语言模型·flink
小二·1 天前
2026年4月技术热点深度解析:AI智能体攻防、量子安全与云原生新纪元
人工智能·安全·云原生
江瀚视野1 天前
京东健康综合门诊望京开业,京东医疗路在何方?
大数据·人工智能
飞凌嵌入式1 天前
如何用JishuShell在RK3588核心板上快速部署OpenClaw?
arm开发·人工智能·嵌入式硬件·openclaw
IT_陈寒1 天前
Vue的响应式更新把我坑惨了,原来是这个问题
前端·人工智能·后端
Tom·Ge1 天前
告别“猜谜式编程”!详解规范驱动开发(SDD)在企业AI开发中的最佳实践
人工智能·驱动开发
gyx_这个杀手不太冷静1 天前
大人工智能时代下前端界面全新开发模式的思考(一)
前端·人工智能·ai编程