图像分割论文阅读:BCU-Net: Bridging ConvNeXt and U-Net for medical image segmentation

本文提出了一种集合ConvNeXt和U-Net优势的网络模型来分割医学图像。

当然,模型整体结构就是并列双分支,如果只是这些内容,不值得拿出来讲。

主要有意思的部分是其融合两分支的多标签召回模块(multilabel recall loss module,简称MRL)。

1,模型整体结构

按照原文的说法,该论文提出了一个双分支的模型结构,其中一个分支是基于ConvNext,一个是是UNet分支。(其实该模型的ConvNext分支也是个类似UNet的结构,先编码再解码。)基于ConvNext的分支负责提取全局特征,而UNet分支负责提取局部特征。两种特征结合从而提升医学图像分割能力。

2,多标签召回模块(MRL)

2.1 提出MRL模块的两个目的:

1)解决类别不平衡问题

2)解决两个分支的异构性问题。两个分支提取的特征和提取出的特征具有显著差异,直接融合,效果并非最优。

2.2 实现方式

MRL模块引入了召回损失,公式如下:

其中,C是像素的类别数,在一般医学图像分割中都是2,也就是前景和背景。指的是c类的几何平均置信度,指的是输入在所有类上的预测softmax分布。是类别c的召回值。

这个召回损失可以在迭代训练的过程中根据该轮训练中的召回表现动态调整,从而实现动态加权,这样就可以解决类别不平衡的问题。

相关推荐
七月稻草人3 分钟前
飞算JavaAI:人工智能与Java的创新融合与应用前景
开发语言·人工智能·ai编程·java开发·飞算javaai炫技赛
张登杰踩22 分钟前
OpenCV cv2.flip() 函数详解与示例
人工智能·opencv·计算机视觉
是乐谷31 分钟前
饿了么招java开发咯
java·开发语言·人工智能·程序人生·面试·职场和发展
Mory_Herbert37 分钟前
【李宏毅-2024】第六讲 大语言模型的训练过程1——预训练(Pre-training)
人工智能·语言模型·自然语言处理
lindawang43 分钟前
AI大模型提示词工程完全指南:从入门到精通
人工智能·llm
AORO20251 小时前
三防平板+天通卫星电话,打通无人之境的通信经脉
大数据·网络·人工智能·5g·电脑·信息与通信
lindawang1 小时前
在Mac上搭建本地AI工作流:Dify与DeepSeek的完美结合
人工智能·llm
javastart1 小时前
谷歌推出Genie3:世界模型的ChatGPT时刻?
人工智能·chatgpt·aigc
云云3211 小时前
Lazada东南亚矩阵营销破局:指纹手机如何以“批量智控+数据中枢”重构运营生态
大数据·人工智能·线性代数·智能手机·矩阵·重构
fsnine2 小时前
数字图像处理基础——opencv库(Python)
人工智能·python·opencv