图像分割论文阅读:BCU-Net: Bridging ConvNeXt and U-Net for medical image segmentation

本文提出了一种集合ConvNeXt和U-Net优势的网络模型来分割医学图像。

当然,模型整体结构就是并列双分支,如果只是这些内容,不值得拿出来讲。

主要有意思的部分是其融合两分支的多标签召回模块(multilabel recall loss module,简称MRL)。

1,模型整体结构

按照原文的说法,该论文提出了一个双分支的模型结构,其中一个分支是基于ConvNext,一个是是UNet分支。(其实该模型的ConvNext分支也是个类似UNet的结构,先编码再解码。)基于ConvNext的分支负责提取全局特征,而UNet分支负责提取局部特征。两种特征结合从而提升医学图像分割能力。

2,多标签召回模块(MRL)

2.1 提出MRL模块的两个目的:

1)解决类别不平衡问题

2)解决两个分支的异构性问题。两个分支提取的特征和提取出的特征具有显著差异,直接融合,效果并非最优。

2.2 实现方式

MRL模块引入了召回损失,公式如下:

其中,C是像素的类别数,在一般医学图像分割中都是2,也就是前景和背景。指的是c类的几何平均置信度,指的是输入在所有类上的预测softmax分布。是类别c的召回值。

这个召回损失可以在迭代训练的过程中根据该轮训练中的召回表现动态调整,从而实现动态加权,这样就可以解决类别不平衡的问题。

相关推荐
互联网志4 分钟前
“光、储、氢、电与人工智能”深度融合的能源转型图景
人工智能·能源
美狐美颜sdk4 分钟前
美颜SDK是什么?直播/短视频美颜SDK技术详解
人工智能·算法·美颜sdk·直播美颜sdk·美颜api
程序猿追6 分钟前
HarmonyOS 6.0 游戏开发实战:用 ArkUI 从零打造消消乐小游戏
大数据·人工智能·harmonyos
做个文艺程序员7 分钟前
Linux系统上使用海光DCU部署开源大模型全攻略(以Qwen3-8B为例)
人工智能
chushiyunen10 分钟前
langgraph笔记
数据库·人工智能·笔记
xiami_world10 分钟前
AI Agent生成PPT技术解析:从一键生成到意图理解,Agent模式如何重构PPT工作流?
人工智能·经验分享·ai·信息可视化·powerpoint
我是胡杨学长11 分钟前
ChatGPT 连续三月流量下滑,是热度凉了还是 AI 泡沫要来了?
人工智能·ai·chatgpt
章鱼丸-14 分钟前
DAY 42 Grad-CAM 与 Hook 函数
pytorch·深度学习·计算机视觉
剑穗挂着新流苏31214 分钟前
207_深度学习调优:透彻理解权重衰退(L2 正则化)
人工智能·机器学习
一叶萩Charles15 分钟前
GitHub AI Agent 开源生态概览
人工智能·开源·github