论文阅读—2023.7.13:遥感图像语义分割空间全局上下文信息网络(主要为unet网络以及改unet)附加个人理解与代码解析

前期看的文章大部分都是深度学习原理含量多一点,一直在纠结怎么改模型,论文看的很吃力,看一篇忘一篇,总感觉摸不到方向。想到自己是遥感专业,所以还是回归遥感影像去谈深度学习,回归问题,再想着用什么方法解决问题。

一、问题与解决方法

1、易丢失空间信息

在 Decoder 阶段输出多尺度特征,与 ReEncoder 阶段结合获取全局上下文信息

2、边界信息不明确

保留边界损失函数,设计多尺度损失函数级联方法

Attention U-Net,在 U-Net 网络高低级语义信息融 合的过程中,加入注意力控制模块( Attention gates),强化了有效信息的传递,对无效信息的传输进行抑制。

二、原理

1、问题一的原理

Unet网络

参考这三篇,写的特别详细

Pytorch深度学习实战教程(二):UNet语义分割网络 - 知乎 (zhihu.com)

Pytorch深度学习实战教程(三):UNet模型训练,深度解析! - 知乎 (zhihu.com)

(个人记录:损失函数优化器选择)

U-Net原理分析与代码解读 - 知乎 (zhihu.com)

作者的网络

网络可以看懂,但是不懂这样做可以解决第一个问题的原理。

2、问题2的原理

结果

相关推荐
传说故事2 小时前
【论文阅读】Whole-Body Conditioned Egocentric Video Prediction
论文阅读·人工智能·生成模型
chnyi6_ya2 小时前
论文阅读笔记 | From Priors to Perception: Grounding Video-LLMs in Physical Reality
论文阅读·笔记
m4Rk_3 小时前
【论文阅读】Agent 记忆机制(49):MemCoE——先学习如何组织记忆,再学习具体记住什么
论文阅读·人工智能·学习·开源·github
m4Rk_1 天前
【论文阅读】Agent 记忆机制(48):Fine-Mem——用细粒度奖励解决长期记忆管理中的奖励稀疏与信用分配
论文阅读·人工智能·学习·开源·github
m4Rk_2 天前
【论文阅读】Agent 记忆机制(47):Nemori——用“预测误差”判断什么经验值得被记住
论文阅读·人工智能·学习·开源·github
tangjiawen101792 天前
AI安全,CEO不该只做甩手掌柜
论文阅读
Rocky Ding*2 天前
【三年面试五年模拟】2026-08-18_哔哩哔哩AI应用岗Agent开发一面面经全解析(含完整答案)
论文阅读·人工智能·深度学习·机器学习·aigc·ai-native·ai agent
chnyi6_ya2 天前
VideoHallu 论文阅读笔记
论文阅读·笔记
心心喵2 天前
[论文笔记] paper review PPT
论文阅读
tangjiawen101792 天前
AI没有规模化路径的创新,只是昂贵的演示
论文阅读