PyTorch|transforms

在将图片输入到神经网络进行训练时,一般都需要对输入的图像进行预处理。对图片进行操作有很多种方法,这里我们使用torchvision库的transforms模块

tansforms有很多种方法(一些可以用在张量和PIL图像,一些仅能用于张量,而另一些仅能用于PIL图像),这些方法极大的为我们的图片处理工作提供了便利。

我们使用PIL库读取一个图片,在调用transform的Resize方法,改变图片的大小:

复制代码
>>> from PIL import Image>>> from torchvision import transforms>>> path="E:\\3-10\\dogandcats\\train\\cat13.0.jpg">>> img=Image.open(path)>>> img.size(700, 467)>>> process=transforms.Resize((28,28))>>> img2=process(img)>>> img2.size(28, 28)

同样,我们还可以把原始的图片数据转换为张量:​​​​​​​

复制代码
>>> process=transforms.ToTensor()>>> imgdata=process(img)>>> imgdata.size()torch.Size([3, 467, 700])

同样,归一化也变得非常的容易​​​​​​​

复制代码
>>> process=transforms.Normalize((0.5,0.5,0.5),(0.5,0.5,0.5))>>> process(img)

当然,我们对图片预处理时可能不仅仅使用一种方法,那么有没有一种方法将这些操作整合到一起呢?显然,库的作者早已考虑到,并且已经实现了此功能。

借助Compose方法,我们可以集成上述操作。​​​​​​​

复制代码
>>> process=transforms.Compose([transforms.Resize((28,28)),              transforms.ToTensor(),              transforms.Normalize((0.5,0.5,0.5),(0.5,0.5,0.5))])>>> process(img)

当然,transforms提供了多种对图片数据操作的方法,详细的可以看这里:

https://pytorch.org/vision/stable/transforms.html

到了这里,你已经对图像处理有了一定的了解,好吧,那么让我们回到上一篇文章:卷积神经网络|制作自己的Dataset

在这里,我们实现了自己的数据集,在__init__方法,有两个参数分别叫做transform,和label_transform,分别对图片和图片标签进行处理,默认为none,也就是无操作。

这时,很明显,我们可以传入对图片的一系列操作,就像这样:​​​​​​​

复制代码
path="E:\\3-10\\dogandcats\\train"training_data=MyDataset(path,transform=transforms.Compose([    transforms.Resize((16,16)),    transforms.Normalize((0.5,0.5,0.5),(0.5,0.5,0.5))    ]))

到这里,对于自己数据集的准备工作基本已经完成!

相关推荐
工程师老罗3 分钟前
什么是目标检测?
人工智能·目标检测·计算机视觉
jarreyer4 分钟前
【AI 编程工具】
人工智能·编程工具
阿杰学AI5 分钟前
AI核心知识75——大语言模型之MAS (简洁且通俗易懂版)
人工智能·ai·语言模型·自然语言处理·agent·多智能体协作·mas
小程故事多_807 分钟前
深度搜索Agent架构全解析:从入门到进阶,解锁复杂问题求解密码
人工智能·架构·aigc
朴实赋能10 分钟前
AI赋能文旅出海:智矩引擎(MatriPower)社媒矩阵破局与流量长效增长实操指南
人工智能·社媒矩阵·matripower·文旅出海·海外社媒引流·文旅ip出海·智矩引擎
许泽宇的技术分享10 分钟前
第 1 章:认识 Claude Code
开发语言·人工智能·python
AIFQuant24 分钟前
如何利用免费股票 API 构建量化交易策略:实战分享
开发语言·python·websocket·金融·restful
沃达德软件29 分钟前
图像处理与复原技术
图像处理·人工智能·深度学习·神经网络·目标检测·计算机视觉·目标跟踪
坐在地上想成仙30 分钟前
人工智能商业落地思考:从人类行为图谱到技术栈映射
人工智能
zhangfeng113330 分钟前
ModelScope(魔搭社区)介绍与模型微调全指南 中国版Hugging Face GPU租借平台 一站式开源模型社区与服务平台
人工智能·开源