CUDA补充笔记

文章目录

一、不同核函数前缀

二、指定kernel要执行的线程数量

总共需要线程数是:

复制代码
1 * N = N个线程

三、线程需要两个内置坐标变量来唯一标识线程

①都是dim3类型变量

blockIdx指明线程在grid中的位置,threadIdx指明线程所在block中的位置

  • 若使用的向量大小为1<<20,假设block大小为256,而grid的大小就是4096

③而线程的ID值为:

二维:对于2-dim的block(Dx,Dy),线程(x,y)的ID值为(x+ yDx)
三维:如果是3-dim的block(Dx,Dy,Dz),线程(x,y,z)的ID值为(x+ y
Dx +zDxDy)

④矩阵加法

四、不是blocksize越大越好,上限一般是1024个blocksize

相关推荐
汇能感知5 小时前
光谱相机的探测器阵列
经验分享·笔记·科技
CHHC18805 小时前
vSIM / SoftSIM笔记
笔记
逆小舟7 小时前
【C/C++】指针
c语言·c++·笔记·学习
Cathy Bryant12 小时前
球极平面投影
经验分享·笔记·数学建模
Larry_Yanan12 小时前
QML学习笔记(三十一)QML的Flow定位器
java·前端·javascript·笔记·qt·学习·ui
The_Killer.12 小时前
近世代数(抽象代数)详细笔记--环(也有域的相关内容)
笔记·学习·抽象代数·
Larry_Yanan13 小时前
QML学习笔记(三十)QML的布局器(Layouts)
c++·笔记·qt·学习·ui
不会kao代码的小王13 小时前
突破机房围墙:openEuler设备的公网管理实战指南
开发语言·数据库·笔记
He BianGu13 小时前
【笔记】WPF中如何的动态设置DataGridTextColumn是否显示
笔记·wpf
_李小白15 小时前
【OPENGL ES 3.0 学习笔记】第一天:认识渲染管道
笔记·学习