卷积学习录

nn.Conv2d(num_in_ch, embed_dim, 3, 1, 1)

这是一个2d卷积,也就是他是二维的,而不是一个序列一排一排的卷积。

这里几个参数分别表示 (输入通道数,输出通道数,卷积核大小,步幅,填充大小)

nn.Conv2d(num_in_ch, embed_dim, 3, 1, 1) 则表示:输入通道是num_in_ch,输出通道数为embed_dim,卷积核大小是3,每次移动的步长是1, 在输入特征图的四周各填充一圈0像素

Q:怎么实现通道数目的变化的?

一个卷积核,卷积出来就是一个通道,值得注意的是,每个卷积核的通道数一定是和输入数据的输入通道数是一样的。

Q:如果最后一个参数影响的是什么?

A:影响的是高和宽的大小,当卷积核大小为3X3,padding=1的时候,卷积后,高和宽不变。

相关推荐
Narrastory3 小时前
明日香 - Pytorch 快速入门保姆级教程(一)
人工智能·pytorch·深度学习
Narrastory4 小时前
明日香 - Pytorch 快速入门保姆级教程(二)
人工智能·pytorch·深度学习
程序员打怪兽1 天前
详解Visual Transformer (ViT)网络模型
深度学习
CoovallyAIHub3 天前
仿生学突破:SILD模型如何让无人机在电力线迷宫中发现“隐形威胁”
深度学习·算法·计算机视觉
CoovallyAIHub3 天前
从春晚机器人到零样本革命:YOLO26-Pose姿态估计实战指南
深度学习·算法·计算机视觉
CoovallyAIHub3 天前
Le-DETR:省80%预训练数据,这个实时检测Transformer刷新SOTA|Georgia Tech & 北交大
深度学习·算法·计算机视觉
CoovallyAIHub3 天前
强化学习凭什么比监督学习更聪明?RL的“聪明”并非来自算法,而是因为它学会了“挑食”
深度学习·算法·计算机视觉
CoovallyAIHub3 天前
YOLO-IOD深度解析:打破实时增量目标检测的三重知识冲突
深度学习·算法·计算机视觉
用户1474853079744 天前
AI-动手深度学习环境搭建-d2l
深度学习
OpenBayes贝式计算4 天前
解决视频模型痛点,TurboDiffusion 高效视频扩散生成系统;Google Streetview 涵盖多个国家的街景图像数据集
人工智能·深度学习·机器学习