OpenCV/CV2,PIL,Tensor之间如何互相转化

参考资料:

torchvision文档

众所周知OpenCV/CV2和PIL是Python领域最常使用的图像处理库,而Pytorch Tensor则是我们在深度学习领域接触最多的张量数据结构,知道这几种格式之间的相互转化方式是非常有必要的。三类,一共6种相互转化的链路,下面一一道来:

1. OpenCV/CV2(ndarray)

cv2不像PIL Image那样有特定的图像存储类,因此cv2格式其实是一个伪命题。使用cv2读取图片,实际上获得的是一个ndarray。ndarray更是我们的老熟人,它是numpy包中的张量数据类型。

ndarray to tensor:

复制代码
image_nd = cv2.imread("XX.jpg")
A = ( torch.tensor(image_nd) / 255. ).flip(-1)

上面是一个典型的代码片,需要注意cv2读到的ndarray是uint8类型,并且默认通道顺序是BGR,因此需要先除以255然后反转最后一个维度(Pytorch不支持[::-1]这种切片逆转语法)。

ndarray to pil

复制代码
image_nd = cv2.imread("/data1/chaishang.cs/Tryon/31_human.jpg")
image_pil = Image.fromarray(image_nd[..., ::-1])

只需使用Image.fromarray方法,需要注意pil图片的通道顺序是RGB,因此也需要先对通道进行反转。

**  2. PIL image**

**  pil to tensor**

复制代码
import torchvision.transforms.functional as F
F.pil_to_tensor(image_pil) / 255.

pil to ndarray

复制代码
image_nd = np.array(image_pil)

3. Tensor

**  tensor to ndarray**

直接对tensor调用.numpy()函数即可,如果tensor位于cuda上,需要先运行.cpu()

tensor to pil

复制代码
import torchvision.transforms.functional as F
F.to_pil_image(tensor)

需要注意tensor需要是[C, H, W]的格式,并且归一化到[0, 1]区间。

相关推荐
老百姓懂点AI1 小时前
[WASM实战] 插件系统的安全性:智能体来了(西南总部)AI调度官的WebAssembly沙箱与AI agent指挥官的动态加载
人工智能·wasm
人工智能训练7 小时前
【极速部署】Ubuntu24.04+CUDA13.0 玩转 VLLM 0.15.0:预编译 Wheel 包 GPU 版安装全攻略
运维·前端·人工智能·python·ai编程·cuda·vllm
源于花海8 小时前
迁移学习相关的期刊和会议
人工智能·机器学习·迁移学习·期刊会议
DisonTangor9 小时前
DeepSeek-OCR 2: 视觉因果流
人工智能·开源·aigc·ocr·deepseek
薛定谔的猫19829 小时前
二十一、基于 Hugging Face Transformers 实现中文情感分析情感分析
人工智能·自然语言处理·大模型 训练 调优
发哥来了10 小时前
《AI视频生成技术原理剖析及金管道·图生视频的应用实践》
人工智能
数智联AI团队10 小时前
AI搜索引领开源大模型新浪潮,技术创新重塑信息检索未来格局
人工智能·开源
不懒不懒10 小时前
【线性 VS 逻辑回归:一篇讲透两种核心回归模型】
人工智能·机器学习
冰西瓜60010 小时前
从项目入手机器学习——(四)特征工程(简单特征探索)
人工智能·机器学习
Ryan老房10 小时前
未来已来-AI标注工具的下一个10年
人工智能·yolo·目标检测·ai