图像缩放因子的计算

文章目录

1.图像缩放

  视频缩放Scaler功能是图像处理中的一种常用功能,目的是将输入图像从一种分辨率转换到另一种分辨率输出,同时满足视频实时输入实时输出的要求。

  图像缩放存在方向性:分为水平方向缩放和垂直方向缩放。

在某个方向上,目标图的分辨率比原图的分辨率大,在这个方向上为图像放大。

在某个方向上,目标图的分辨率比原图的分辨率小,在这个方向上为图像缩小。

2.目标图与原图像素对应关系

  目标图的任意一个像素点都可以映射到原图某个特定的位置。缩放的过程就是利用原图相邻像素点计算出这个特定位置的像素点。

  举一个一维简单的例子:从4个像素放大到7个像素,位置映射关系如下。先讲过概念叫缩放因子,也叫缩放步进。缩放因子sf = 原图/目标图 = 4/7 = 0.5714,利用缩放因子对目标图像素位置累加就可以得到在原图中对应位置。


  两个概念区别:

缩放倍数sr = 目标图/原图 = 7/4 = 1.75(倍)

缩放因子sf = 1/sr = 原图/目标图 = 4/7 = 0.5714

  二维图像缩放就是在水平和垂直两个方向分别做映射。假设(x,y)为目标图像的像素坐标,(x',y')为原图像的像素坐标,ver_skfactor,hor_skfactor分别为垂直和水平方向缩放因子,那么由目标图像像素点在原图像中映射的位置计算公式如下。

x' = x * hor_skfactor

y' = y * ver_skfactor

  找到了在原图中对应像素位置,那接下来就是用插值算法进行计算。插值算法有很多,最近邻,双线性,双立方等等,本文不做讲述。

3.缩放因子计算公式

  上面提到了缩放因子,那么上面的计算方法是否正确呢?

  以上图4像素放大到像素为例,缩放因子sf = 原图/目标图 = 4/7 = 0.5714,结果目标图算到最后一个点对应原图位置是3.4285,超过了边界,感觉有问题。

  所以这里涉及到一个问题,就是缩放因子计算是应该是sf=vin/vout,还是sf=(vin-1)/(vout-1)?

  答案是要用sf=(vin-1)/(vout-1)这个公式。​

  原理:像素总数对应的是离散格点数,不是格子宽度。

W个图像像素可以理解为像素坐标:0 ~ W-1

首尾两个像素中心点,跨度是 W-1。

缩放是对像素跨度做映射,不是对像素个数。

  举个例子:

输入 1920 点:坐标 0,1,2,...,1919

总有效跨度:1920−1=1919

输出 960 点:

总跨度 960−1=959

  所以只有采用sf=(vin-1)/(vout-1)这个公式,才能保证以下效果。

· 输出第 0 点 → 映射输入第 0 点

· 输出最后一点 Wout​−1 → 严格映射输入最后一点 Win​−1

· 首尾严格对齐,整图线性无偏移、无拉伸、无越界

  我们再回过头对4像素放大到7像素例子做验证,sf = (4-1)/(7-1)=0.5,这样目标图最后一个点刚好也对应原图最后一个点。

相关推荐
鬼手点金3 小时前
FPGA常用型号参考
fpga开发·verilog·vivado·xilinx·vhdl·altera·lattice
在世修行7 小时前
深度图像数据格式与RAW文件解析:从字节到三维世界的桥梁
人工智能·数码相机·计算机视觉
AndrewHZ9 小时前
图像处理入门006:图像质量评价三剑客:PSNR / SSIM / MSE 原理与代码实战
图像处理·计算机视觉·cv·psnr·rse·ssim
HyperAI超神经10 小时前
128K长上下文+智能体强化训练!LFM2.5-2.6B解锁端侧大模型高效部署;DETR用Transformer斩断NMS与Anchor,重塑目标检测
人工智能·深度学习·目标检测·计算机视觉·数据集·transformer
jay神10 小时前
深度学习的正确调参顺序
人工智能·深度学习·yolo·计算机视觉·课程设计
浪里镖客11 小时前
zed 2i相机坐标系与内参、外参
数码相机·opencv·计算机视觉
头发够用的程序员13 小时前
Nsight Systems 零基础入门:Trace采集与基础操作
人工智能·深度学习·神经网络·计算机视觉·边缘计算·分析工具
leoZ23113 小时前
Vue3 还原一个企业级后台-11-Mock数据策略
opencv·计算机视觉·数据挖掘·语音识别·caffe
Kong_19941 天前
芯片开发学习笔记·二十九——大模型基础知识与 KV Cache 详解
fpga开发·芯片开发
m0_46644103詹湛1 天前
FPGA 定点数、小数与负数的加减乘除原理
fpga开发