图像分割论文阅读:BCU-Net: Bridging ConvNeXt and U-Net for medical image segmentation

本文提出了一种集合ConvNeXt和U-Net优势的网络模型来分割医学图像。

当然,模型整体结构就是并列双分支,如果只是这些内容,不值得拿出来讲。

主要有意思的部分是其融合两分支的多标签召回模块(multilabel recall loss module,简称MRL)。

1,模型整体结构

按照原文的说法,该论文提出了一个双分支的模型结构,其中一个分支是基于ConvNext,一个是是UNet分支。(其实该模型的ConvNext分支也是个类似UNet的结构,先编码再解码。)基于ConvNext的分支负责提取全局特征,而UNet分支负责提取局部特征。两种特征结合从而提升医学图像分割能力。

2,多标签召回模块(MRL)

2.1 提出MRL模块的两个目的:

1)解决类别不平衡问题

2)解决两个分支的异构性问题。两个分支提取的特征和提取出的特征具有显著差异,直接融合,效果并非最优。

2.2 实现方式

MRL模块引入了召回损失,公式如下:

其中,C是像素的类别数,在一般医学图像分割中都是2,也就是前景和背景。指的是c类的几何平均置信度,指的是输入在所有类上的预测softmax分布。是类别c的召回值。

这个召回损失可以在迭代训练的过程中根据该轮训练中的召回表现动态调整,从而实现动态加权,这样就可以解决类别不平衡的问题。

相关推荐
算家计算5 分钟前
蚂蚁开源万亿参数大模型Ling-1T:多项能力全球领先
人工智能·开源·资讯
leijiwen7 分钟前
S11e Network 商业模型:AI × Web3 × RWA 驱动的实体经济新范式
人工智能·web3·区块链
说私域34 分钟前
技术指数变革下的组织适应性研究:基于定制开发开源AI智能名片S2B2C商城小程序的实践观察
人工智能·小程序·开源
realhuizhu37 分钟前
📚 技术人的阅读提效神器:多语言智能中文摘要生成指令
人工智能·ai·chatgpt·prompt·提示词·总结·deepseek·摘要
szxinmai主板定制专家39 分钟前
一种基于 RK3568+AI 的国产化充电桩安全智能交互终端的设计与实现,终端支持各种复杂的交互功能和实时数据处理需求
arm开发·人工智能·嵌入式硬件·安全
apocalypsx1 小时前
深度学习-Kaggle实战1(房价预测)
人工智能·深度学习
春末的南方城市1 小时前
开放指令编辑创新突破!小米开源 Lego-Edit 登顶 SOTA:用强化学习为 MLLM 编辑开辟全新赛道!
人工智能·深度学习·机器学习·计算机视觉·aigc
37手游后端团队1 小时前
Claude Code Review:让AI审核更懂你的代码
人工智能·后端·ai编程
Macre Aegir Thrym1 小时前
MINIST——SVM
算法·机器学习·支持向量机
PKNLP1 小时前
聚类之KMeans
机器学习·kmeans·聚类