不同框架表示图像时维度顺序的区别:pytorch、keras&tf、opencv、numpy、PIL

在PyTorch、Keras、OpenCV、NumPy和PIL这几个框架中,它们在表示图像时的维度存储顺序有所不同。下面我将逐一解释每个框架中图像维度的存储顺序:

1,PyTorch:

PyTorch中图像的维度顺序通常遵循 [N, C, H, W] 的格式,也就是channel first格式,其中:

C 代表通道数(channels),例如RGB图像有3个通道。

N 代表批量大小(batch size),即一次处理的图像数量。

pytorch如果遇到channel last格式的输入,可以通过permute来调整维度顺序:

python 复制代码
import torch  

# 假设x是一个形状为(N, H, W, C)的tensor  
x = torch.randn(N, H, W, C)

# 使用permute方法将channel维度移动到第二个位置  
x_channel_first = x.permute(0, 3, 1, 2)  # 形状变为(N, C, H, W)

2,Keras&tf:

Keras通常与TensorFlow一起使用。在TensorFlow中,对于图像数据,默认的维度顺序是 [H, W, C]。但在构建模型时,Keras允许通过data_format参数来指定维度顺序,可以是'channels_last'(即[H, W, C])或'channels_first'(即[C, H, W])。

通过如下代码可以设置:

python 复制代码
from keras import backend as K  
  
K.set_image_data_format('channels_first')

3,OpenCV:

OpenCV读取图像时默认的维度顺序是 [H, W, C]。因此,在OpenCV中,图像的宽度和高度位于通道数之前。

4,NumPy:

NumPy本身并不直接处理图像数据,但它可以用于存储和操作多维数组。在NumPy数组中,维度的顺序完全取决于用户如何定义和填充数组。

5,PIL (Python Imaging Library, 也就是现在的Pillow):

PIL/Pillow在打开图像时,默认的维度顺序是 [W, H, C],即宽度、高度和通道数。这与其他一些框架的顺序有所不同。

在编程过程中如果多个库混合使用,例如用OpenCV/PIL打开图像,然后输入pytorch编写的模型,需要注意这方面。

相关推荐
xlecho3 分钟前
从单一语言到全域全栈,AI凭全能实力,淘汰旧时代语言工程师
人工智能·后端·开源
用户990193052456 分钟前
Nano-vLLM-MS:基于 nano-vLLM ,支持 MoE 模型和 Speculative Decoding
pytorch·llm
lcj092466615 分钟前
数据中心运维升级|磁控U位硬件联动DCIM,破解U位管控难题
运维·人工智能·经验分享·信息可视化
weixin_4249993628 分钟前
PHP源码在双硬盘系统如何优化_硬件存储分配建议【指南】
jvm·数据库·python
ECT-OS-JiuHuaShan33 分钟前
渡劫代谢,好事多磨
数据库·人工智能·科技·学习·算法·生活
qq_1898070337 分钟前
json ignore反序列化?_?JSON反序列化时忽略字段的json----标签使用方法.txt
jvm·数据库·python
zhangchaoxies37 分钟前
让水平滚动条始终固定在页面底部,实现跨视口的横向滚动控制
jvm·数据库·python
阿瑞说项目管理38 分钟前
有监督 vs 全自主:两种 Agent 范式,你选对了吗?
人工智能·agent·智能体·企业级ai
乔江seven41 分钟前
【李沐 | 动手学深度学习】18 深度学习硬件:TPU和其他
人工智能·深度学习·深度学习硬件
爱写代码的小朋友42 分钟前
生成式 AI 对中小学学生学习行为的影响及教育引导策略研究
人工智能