Unsupervised Domain Adaptation for Anatomical Landmark Detection论文速读

文章目录

  • [Unsupervised Domain Adaptation for Anatomical Landmark Detection](#Unsupervised Domain Adaptation for Anatomical Landmark Detection)

Unsupervised Domain Adaptation for Anatomical Landmark Detection

摘要

最近,解剖学标志检测在单域数据上取得了进步,单域数据通常假设训练集和测试集来自同一域。然而,这种假设在实践中并不总是正确的,由于域偏移,这可能会导致性能显著下降。为了解决这个问题,我们提出了一种新的框架,用于在无监督域适应(UDA)下进行解剖学标志检测,该框架旨在将知识从标记的源域转移到未标记的靶域。

该框架利用自我训练和领域对抗学习来解决适应过程中的领域差距。具体而言,该文提出一种自训练策略,选择具有动态阈值的目标域数据可靠的地标级伪标签,使适应更加有效。此外,还设计了一个领域对抗性学习模块,通过对抗性训练学习领域不变特征,从而处理两个领域的不对齐数据分布。

本文方法

首先作者给出了源域和目标域的图像差别,分布式也有所不同

总共的模型结构

首先讲源域的和目标域的图像经过特征提取,然后源域在经过 Landmark Detection Model,如下图所示

首先利用transformer解码器得到坐标,landmark queries是利用卷积提取的特征,然后进行局部微调

局部微调模块通过 1 × 1 个卷积层输出分数图 yˆs 和 偏移图 yˆo(输入为landmark queries)。分数图表示每个网格成为目标地标的可能性,而偏移图表示相邻网格与目标的相对偏移量。分数图的标签由高斯核平滑,L2 损失用于损失函数 Lscore。由于偏移量是一个回归问题,因此 L1 用于损失 Loffset,并且仅应用于其 GT 分数大于零的区域。在推理过程中,最佳局部格网不是由yˆs的最大分数选择的,而是由全局定位的坐标投影来选择的。然后将相应的偏移值添加到最佳网格中进行细化。此外,通过投影可以很容易地从分数图中获得每个预测的置信度

Landmark-Aware Self-training策略,提出了 LAST,它在坐标级别选择可靠的伪标签

M为mask操作

然后结合Domain Adversarial Learning,特征 f 进一步通过全局平均池化 (GAP) 和全连接 (FC) 层,然后连接到域分类器 D 以区分输入 x 的来源。分类器可以使用二元交叉熵损失进行训练

d为域标签

总的损失函数如下

实验结果


相关推荐
Raink老师1 分钟前
【AI面试临阵磨枪】什么是上下文窗口(Context Window)限制?主流解决方法有哪些?
人工智能·ai 面试
ZC跨境爬虫7 分钟前
3D 地球卫星轨道可视化平台开发 Day9(AI阈值调控+小众卫星识别+低Token测试模式实战)
人工智能·python·3d·信息可视化·json
GJGCY7 分钟前
2026企业RPA+AI智能体落地技术全景:四阶段演进与关键架构决策
人工智能·安全·ai·rpa·智能体
陈健平11 分钟前
AI漫剧工具复刻实战:用 React Flow 搭一个前端的无限画布,复刻 TapNow / LiblibTV 的核心交互
前端·人工智能·react.js
yuan1999731 分钟前
MATLAB 多窗谱谱减法语音去噪
人工智能·matlab·语音识别
不才小强36 分钟前
目标跟踪算法DeepSort实战
人工智能·算法·目标跟踪
今日说"法"39 分钟前
线性代数与矩阵运算:AI世界的数学基石——从SVD到特征值分解的实战解析
人工智能·线性代数·矩阵
Mr数据杨40 分钟前
结构化表格分类建模与业务预测落地路径
人工智能·机器学习·分类·数据挖掘·数据分析·kaggle
敢敢のwings41 分钟前
智元 D1 强化学习sim-to-real系列 | 从控制接入到真机落地上篇(七)
人工智能
缘友一世42 分钟前
Harness Engineering:让 AI Agent 从“玩具“到“生产力“的工程革命
人工智能·chatgpt·llm·agent