OpenCV/CV2,PIL,Tensor之间如何互相转化

  参考资料:

  torchvision文档

  众所周知OpenCV/CV2和PIL是Python领域最常使用的图像处理库,而Pytorch Tensor则是我们在深度学习领域接触最多的张量数据结构,知道这几种格式之间的相互转化方式是非常有必要的。三类,一共6种相互转化的链路,下面一一道来:

  1. OpenCV/CV2(ndarray)

  cv2不像PIL Image那样有特定的图像存储类,因此cv2格式其实是一个伪命题。使用cv2读取图片,实际上获得的是一个ndarray。ndarray更是我们的老熟人,它是numpy包中的张量数据类型。

  ndarray to tensor:

复制代码
image_nd = cv2.imread("XX.jpg")
A = ( torch.tensor(image_nd) / 255. ).flip(-1)

  上面是一个典型的代码片,需要注意cv2读到的ndarray是uint8类型,并且默认通道顺序是BGR,因此需要先除以255然后反转最后一个维度(Pytorch不支持::-1这种切片逆转语法)。

  ndarray to pil

复制代码
image_nd = cv2.imread("/data1/chaishang.cs/Tryon/31_human.jpg")
image_pil = Image.fromarray(image_nd[..., ::-1])

  只需使用Image.fromarray方法,需要注意pil图片的通道顺序是RGB,因此也需要先对通道进行反转。

**  2. PIL image**

**  pil to tensor**

复制代码
import torchvision.transforms.functional as F
F.pil_to_tensor(image_pil) / 255.

  pil to ndarray

复制代码
image_nd = np.array(image_pil)

  3. Tensor

**  tensor to ndarray**

直接对tensor调用.numpy()函数即可,如果tensor位于cuda上,需要先运行.cpu()

  tensor to pil

复制代码
import torchvision.transforms.functional as F
F.to_pil_image(tensor)

  需要注意tensor需要是C, H, W的格式,并且归一化到0, 1区间。

相关推荐
半个落月6 分钟前
LLM如何预测下一个Token?一文拆解Transformer核心流程
人工智能
触底反弹6 分钟前
🔥 2026 年爆火的 Harness Engineering 到底是什么?从原理到实战一文讲透
javascript·人工智能·程序员
user4465117917916 分钟前
源码深读 XAgent:6 个 Agent 怎么分工?工具失败不崩、死循环怎么防?
人工智能
魏祖潇7 分钟前
SDD 完整指南——Spec 端打底、Story 端交付、留白区
人工智能·后端
常丛丛7 分钟前
5.9 式输出:实时查看 LangGraph Agent 思考过程
人工智能
Token炼金师11 分钟前
从节点图到低秩矩阵:ComfyUI 推理引擎与 LoRA 适配机制拆解
人工智能·aigc
武子康16 分钟前
调查研究-210 Netflix 用 AI 复刻 Gene Wilder 的声音:语音克隆的下半场,不是模型,而是权利
人工智能·aigc·openai
Quz25 分钟前
在 Obsidian 中嵌入 Claude Code 的实践记录
人工智能·claude
雪隐32 分钟前
个人电脑玩AI-10让5060 Ti给你打工——部署 Odysseus:终于有个能打的"AI管家"了
人工智能·后端
武子康32 分钟前
调查研究-209 Apptronik Robot Park 深度解析:人形机器人竞争,开始拼“真实世界数据工厂“
人工智能·google·llm