CVPR2023新作:基于组合空时位移的视频修复

  1. Title: A Simple Baseline for Video Restoration With Grouped Spatial-Temporal Shift (视频修复的简单基准:组合空时位移)

  2. Affiliation: CUHK MMLab (香港中文大学多媒体实验室)

  3. Authors: Dasong Li, Xiaoyu Shi, Yi Zhang, Ka Chun Cheung, Simon See, Xiaogang Wang, Hongwei Qin, Hongsheng Li

  4. Keywords: video restoration, inter-frame information, deep learning, spatial-temporal shift, effective receptive field

  5. Summary:

  • (1): 该文章研究视频修复,
  • (2): 过去的方法通常依赖于复杂的网络架构,例如:光流估计,可变形卷积和跨帧自注意力,这些方法会带来高额的计算成本。而本文提出的轻量级框架------基于组合空时位移的方法,能够隐含地捕捉多帧间的对应关系,并且可以扩展有效的感受野,同时使用基本的二维卷积聚合不同帧间的信息,相对于之前的方法可节约75%的计算成本。
  • (3): 该算法的核心是组合空时位移块,可以有效地实现大尺度的有效感受野。
  • (4): 在视频去模糊和视频降噪两个任务上,该方法均表现优于之前的最先进方法,证明了该方法可以在保持高质量结果的同时大大减少计算开销。
  1. Methods:
  • (1): 本文提出了一种轻量级的视频修复框架,利用组合空时位移块来捕捉多帧间的对应关系,并扩展有效感受野。其中,组合空时位移块通过局部位移和空间注意机制对输入进行建模,并通过平均池化和最大池化来聚合特征,并利用反卷积恢复图像细节。

  • (2): 该算法分为两个关键步骤:(i) 异质帧间信息聚合;(ii) 异质帧间信息修改。其中,第一步采用组合空时位移块实现,可以有效地扩展有效感受野;第二步则通过反卷积层实现。

  • (3): 文中提到,该方法可以节省75%的计算成本。实验结果表明,该算法在视频去模糊和视频降噪两个任务上均优于之前的最先进方法,证明了该方法的有效性和实用性。

  1. Conclusion:
  • (1): 本文提出了一种简单而有效的视频修复框架。通过引入轻量级的组合空时位移块,该方法可以隐含地捕捉多帧间的对应关系,同时扩展有效的感受野,大大减少计算成本。该方法在视频去模糊和降噪任务上具有更好的表现。
  • (2): 创新点:通过组合空时位移块实现了多帧间对应关系的建模,扩展了有效感受野,优化了计算成本。性能:在视频去模糊和降噪任务上表现优于之前最先进的方法。工作负荷:可以节省75%的计算成本。
相关推荐
ocr_sinosecu1几秒前
OCR进化史:从传统到深度学习,解锁文字识别新境界
人工智能·深度学习·ocr
Stara051115 分钟前
YOLO11改进——融合BAM注意力机制增强图像分类与目标检测能力
人工智能·python·深度学习·目标检测·计算机视觉·yolov11
movigo7_dou20 分钟前
关于深度学习局部视野与全局视野的一些思考
人工智能·深度学习
itwangyang52032 分钟前
AIDD-人工智能药物设计-大语言模型在医学领域的革命性应用
人工智能·语言模型·自然语言处理
热心网友俣先生1 小时前
2025年泰迪杯数据挖掘竞赛B题论文首发+问题一二三四代码分享
人工智能·数据挖掘
LitchiCheng1 小时前
MuJoCo 机械臂关节路径规划+轨迹优化+末端轨迹可视化(附代码)
人工智能·深度学习·机器人
前端小菜鸡zhc1 小时前
大模型之提示词工程
人工智能
zy_destiny1 小时前
【非机动车检测】用YOLOv8实现非机动车及驾驶人佩戴安全帽检测
人工智能·python·算法·yolo·机器学习·安全帽·非机动车
姚家湾1 小时前
MAC Mini M4 上测试Detectron2 图像识别库
目标检测·计算机视觉·detectron2