技术栈
学术研究与理论基础
陈嘿萌
20 天前
计算机视觉
·
图像融合
·
学术研究与理论基础
BeyondFusion:无需显式配准,统一完成「红外超分」与红外-可见光融合
1. 用一句话来概括对于移动双传感器中分辨率不同以及跨模态错位共存的问题,本文提出了BeyondFusion****自对齐潜扩散框架,在不需要估计变形场、不需要做几何配准的情况下,实现了可见光引导下的红外超分辨率以及红外-可见光融合。该方法在公开基准、合成错位和真实的手机拍摄场景下都具有较好的鲁棒性,并且提高了下游的人脸检测准确率。
陈嘿萌
20 天前
人工智能
·
计算机视觉
·
图像融合
·
佛山大学
·
学术研究与理论基础
·
eccv2026
ECCV 2026|MAVFusion:运动感知稀疏交互驱动的高效红外-可见光视频融合
1. 用一句话来概括就是MAVFusion 为了解决运动错位、时间闪烁以及高计算开销等问题而提出的解决方案是:用光流来区分子帧中运动和静止的部分,并且对于运动部分使用稀疏强交互的方式,而对于静止部分则采用轻量弱交互的方法,在保证了融合效果和时序一致性的前提下降低了计算成本。
陈嘿萌
20 天前
人工智能
·
计算机视觉
·
图像融合
·
学术研究与理论基础
ACM MM 2026 华北电力|连续融合空间实现实例级细粒度的可控红外与可见光图像融合
ACM MM 2026|ConFusion:连续融合空间实现实例级细粒度可控融合1. 一句话总结针对可控红外-可见光图像融合(Infrared and Visible Image Fusion,IVIF)中离散条件难以表达细微意图的问题,ConFusion 通过高斯条件空间调制学习连续融合空间,兼顾融合质量、实例级控制与目标检测。
陈嘿萌
21 天前
人工智能
·
计算机视觉
·
学术研究与理论基础
ECCV 2026|AerialMetric:一个全新的无人机单目深度估计数据集,面向真实世界航拍场景
用一句话来概括就是由于地面数据训练出的模型不能很好地适用于无人机从下往上拍摄的情况,因此本文提出了 AerialMetric 数据集和评价标准,并用低秩适配的方法对 MoGe2 进行微调得到 MoGe2-Aerial,在没有真实的相机内部参数的城市场景里,MoGe2-Aerial 可以将 由原来的 5.1% 提高到现在的 89.3%。
我是有底线的