图像分割论文阅读:BCU-Net: Bridging ConvNeXt and U-Net for medical image segmentation

本文提出了一种集合ConvNeXt和U-Net优势的网络模型来分割医学图像。

当然,模型整体结构就是并列双分支,如果只是这些内容,不值得拿出来讲。

主要有意思的部分是其融合两分支的多标签召回模块(multilabel recall loss module,简称MRL)。

1,模型整体结构

按照原文的说法,该论文提出了一个双分支的模型结构,其中一个分支是基于ConvNext,一个是是UNet分支。(其实该模型的ConvNext分支也是个类似UNet的结构,先编码再解码。)基于ConvNext的分支负责提取全局特征,而UNet分支负责提取局部特征。两种特征结合从而提升医学图像分割能力。

2,多标签召回模块(MRL)

2.1 提出MRL模块的两个目的:

1)解决类别不平衡问题

2)解决两个分支的异构性问题。两个分支提取的特征和提取出的特征具有显著差异,直接融合,效果并非最优。

2.2 实现方式

MRL模块引入了召回损失,公式如下:

其中,C是像素的类别数,在一般医学图像分割中都是2,也就是前景和背景。指的是c类的几何平均置信度,指的是输入在所有类上的预测softmax分布。是类别c的召回值。

这个召回损失可以在迭代训练的过程中根据该轮训练中的召回表现动态调整,从而实现动态加权,这样就可以解决类别不平衡的问题。

相关推荐
趣味科技v17 分钟前
2024外滩大会:机器人汽车飞机都来了
人工智能·机器人·汽车
基算仿真20 分钟前
基于sklearn的机器学习 — KNN
人工智能·机器学习·sklearn
芯语新知2 小时前
半导体芯闻--20240913
人工智能·科技·智能手机·电脑·显示器·平板
FutureUniant2 小时前
GitHub每日最火火火项目(9.13)
人工智能·python·计算机视觉·github·音视频
liugddx2 小时前
使用 BentoML快速实现Llama-3推理服务
人工智能·ai
ai_xiaogui2 小时前
【AIStarter:AI绘画、设计、对话】零基础入门:Llama 3.1 + 千问2快速部署
人工智能·深度学习
Qiuner2 小时前
【机器学习】分类与回归——掌握两大核心算法的区别与应用
算法·机器学习·分类
逼子格2 小时前
基于深度学习的线性预测:创新应用与挑战
深度学习·神经网络·线性预测·自适应线性预测
格林威3 小时前
Baumer工业相机堡盟工业相机如何通过NEOAPI SDK使用超短曝光功能(曝光可设置1微秒)(Python)
开发语言·人工智能·python·数码相机·计算机视觉
Doctor老王3 小时前
进击J6:ResNeXt-50实战
pytorch·深度学习