论文阅读—2023.7.13:遥感图像语义分割空间全局上下文信息网络(主要为unet网络以及改unet)附加个人理解与代码解析

前期看的文章大部分都是深度学习原理含量多一点,一直在纠结怎么改模型,论文看的很吃力,看一篇忘一篇,总感觉摸不到方向。想到自己是遥感专业,所以还是回归遥感影像去谈深度学习,回归问题,再想着用什么方法解决问题。

一、问题与解决方法

1、易丢失空间信息

在 Decoder 阶段输出多尺度特征,与 ReEncoder 阶段结合获取全局上下文信息

2、边界信息不明确

保留边界损失函数,设计多尺度损失函数级联方法

Attention U-Net,在 U-Net 网络高低级语义信息融 合的过程中,加入注意力控制模块( Attention gates),强化了有效信息的传递,对无效信息的传输进行抑制。

二、原理

1、问题一的原理

Unet网络

参考这三篇,写的特别详细

Pytorch深度学习实战教程(二):UNet语义分割网络 - 知乎 (zhihu.com)

Pytorch深度学习实战教程(三):UNet模型训练,深度解析! - 知乎 (zhihu.com)

(个人记录:损失函数优化器选择)

U-Net原理分析与代码解读 - 知乎 (zhihu.com)

作者的网络

网络可以看懂,但是不懂这样做可以解决第一个问题的原理。

2、问题2的原理

结果

相关推荐
Rocky Ding*10 小时前
深入浅出完整解析FLUX.2、Seedream(即梦)、Z-image、Qwen-Image、GLM-Image核心基础知识
论文阅读·人工智能·深度学习·机器学习·aigc·扩散模型·ai-native
m4Rk_12 小时前
【论文阅读】Agent 记忆机制(91):THEANINE——不删除过时记忆,让 Agent 记住事情是如何变化的
论文阅读·人工智能·学习·开源·github
Rocky Ding*18 小时前
深度解析LlamaGen核心基础知识
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·llamagen
a puppy slide 葱2 天前
ICLR | 2019 | DARTS:可微架构搜索
论文阅读·darts·神经网络架构搜索
m4Rk_2 天前
【论文阅读】Agent 记忆机制(90):HyperMem——用超图建模长期记忆中的高阶关联
论文阅读·人工智能·学习·开源·github
m4Rk_3 天前
【论文阅读】Agent 记忆机制(89):PersonaAgent——构建 Memory、Persona 与 Action 的持续反馈闭环
论文阅读·人工智能·学习·开源·github
Rocky Ding*3 天前
MaskGIT技术深度解析:图像生成如何从逐Token排队走向掩码并行预测
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·maskgit
Rocky Ding*3 天前
Muse技术深度解析:用掩码并行生成图像,速度、语义与编辑能力如何同时成立
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·muse
xx_xxxxx_3 天前
论文阅读-RoTTA
论文阅读·人工智能·深度学习·机器学习
Rocky Ding*4 天前
GPT-6.1 Sol大模型深度解析
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·gpt-6.1 sol