Unsupervised Domain Adaptation for Anatomical Landmark Detection论文速读

文章目录

  • [Unsupervised Domain Adaptation for Anatomical Landmark Detection](#Unsupervised Domain Adaptation for Anatomical Landmark Detection)

Unsupervised Domain Adaptation for Anatomical Landmark Detection

摘要

最近,解剖学标志检测在单域数据上取得了进步,单域数据通常假设训练集和测试集来自同一域。然而,这种假设在实践中并不总是正确的,由于域偏移,这可能会导致性能显著下降。为了解决这个问题,我们提出了一种新的框架,用于在无监督域适应(UDA)下进行解剖学标志检测,该框架旨在将知识从标记的源域转移到未标记的靶域。

该框架利用自我训练和领域对抗学习来解决适应过程中的领域差距。具体而言,该文提出一种自训练策略,选择具有动态阈值的目标域数据可靠的地标级伪标签,使适应更加有效。此外,还设计了一个领域对抗性学习模块,通过对抗性训练学习领域不变特征,从而处理两个领域的不对齐数据分布。

本文方法

首先作者给出了源域和目标域的图像差别,分布式也有所不同

总共的模型结构

首先讲源域的和目标域的图像经过特征提取,然后源域在经过 Landmark Detection Model,如下图所示

首先利用transformer解码器得到坐标,landmark queries是利用卷积提取的特征,然后进行局部微调

局部微调模块通过 1 × 1 个卷积层输出分数图 yˆs 和 偏移图 yˆo(输入为landmark queries)。分数图表示每个网格成为目标地标的可能性,而偏移图表示相邻网格与目标的相对偏移量。分数图的标签由高斯核平滑,L2 损失用于损失函数 Lscore。由于偏移量是一个回归问题,因此 L1 用于损失 Loffset,并且仅应用于其 GT 分数大于零的区域。在推理过程中,最佳局部格网不是由yˆs的最大分数选择的,而是由全局定位的坐标投影来选择的。然后将相应的偏移值添加到最佳网格中进行细化。此外,通过投影可以很容易地从分数图中获得每个预测的置信度

Landmark-Aware Self-training策略,提出了 LAST,它在坐标级别选择可靠的伪标签

M为mask操作

然后结合Domain Adversarial Learning,特征 f 进一步通过全局平均池化 (GAP) 和全连接 (FC) 层,然后连接到域分类器 D 以区分输入 x 的来源。分类器可以使用二元交叉熵损失进行训练

d为域标签

总的损失函数如下

实验结果


相关推荐
ZhengEnCi13 分钟前
09abb-SwiGLU激活函数
人工智能
用户5218724556518 分钟前
spring ai alibaba之项目搭建
人工智能
TickDB20 分钟前
智谱GLM-4 接金融数据:工具描述多写三个字,模型少犯一类错
人工智能·python·websocket·行情数据 api·行情 api
她的男孩25 分钟前
从自然语言到数据大屏:Forge Report Studio 的 AI 生成链路
人工智能·后端·架构
测试_AI_一辰28 分钟前
AI模型评测不只看准确率-CV与Agent评测指标体系梳理
人工智能·机器学习·计算机视觉
sugar__salt32 分钟前
Prompt工程实战指南:规范设计、LLM接口封装与避坑技巧
人工智能·python·prompt
QiLinkOS38 分钟前
【用呼吸重构创造价值关系——QiLink生态】
c语言·数据结构·c++·人工智能·单片机·嵌入式硬件·算法
cxr82840 分钟前
高分子复合材料AI逆向设计合成(PCARPS)流程研究
人工智能·智能体
weixin_468466851 小时前
图像处理特征提取新手实战指南
图像处理·人工智能·算法·ai·机器视觉·特征提取
我爱cope1 小时前
【Agent智能体13 | 工具使用-什么是工具?】
人工智能·语言模型·职场和发展