cudnn版本gpu架构

nvcc --help 可以看 --gpu-architecture 写到的支持的架构

NVIDIA 的 GPU 架构是按代次发布的,以下是这些架构的对应说明:

  1. NVIDIA Hopper: 这是 NVIDIA 于 2022 年推出的架构之一,面向高性能计算(HPC)和人工智能(AI)的任务。
  2. NVIDIA Ada Lovelace: 这是 NVIDIA 最新发布的架构之一,大约在 2022 年推出,主要针对消费级市场和游戏,代表性的 GPU 如 GeForce RTX 40 系列。
  3. NVIDIA Ampere: 于 2020 年推出,是广泛应用于数据中心、AI 推理、训练以及高端消费者级 GPU 市场的架构,如 GeForce RTX 30 系列、A100 等。
  4. NVIDIA Turing: 于 2018 年推出,首个支持实时光线追踪(Ray Tracing)的消费级架构,如 GeForce RTX 20 系列。
  5. NVIDIA Volta: 于 2017 年推出,主要用于数据中心和深度学习的架构,代表性的产品如 Tesla V100。
  6. NVIDIA Pascal: 于 2016 年推出,广泛用于各种应用场景,包括消费级显卡和数据中心,如 GeForce GTX 10 系列和 Tesla P100。
  7. NVIDIA Maxwell: 于 2014 年推出,这一架构在性能和能效方面有显著提升,代表性的产品如 GeForce GTX 900 系列。

这些架构依次构成了 NVIDIA 在过去几年的技术进步,涵盖了从游戏到专业计算的不同市场。

相关推荐
论文复现现场2 天前
RTX 5090 32GB 适合科研计算吗?单卡训练、推理、论文复现与 OOM 判断方法
pytorch·深度学习·cuda·rtx5090
论文复现现场2 天前
论文复现看到“RTX 3090 or higher”:显存、CUDA、batch size 与 OOM 怎么判断?
开发语言·pytorch·batch·cuda·rtx3090
_nibel2 天前
第二章:Details 重点数据细读 ⭐教你读懂 Nsight Compute 报告 系列合集⭐
cuda·ncu·nsight compute
论文复现现场11 天前
MiniCPM-o 4.5 需要多少显存?RTX 3090 24GB 的 BF16、AWQ、GGUF 部署边界与验收方法
cuda·多模态大模型·显存优化·rtx3090·minicpm-o
qq_1998868712 天前
第8板块·第2节:统一内存的高级特性与性能调优
c++·人工智能·gpu算力·cuda
qq_1998868712 天前
第8板块·第3节:设备间拷贝与点对点(P2P)传输
c++·人工智能·gpu算力·cuda
qq_1998868712 天前
第8板块·第1节:主机与设备内存管理基础与统一内存
c++·人工智能·gpu算力·cuda
qq_1998868713 天前
第7板块·第1节:通用算子分类与设计模式
c++·人工智能·gpu算力·cuda
qq_1998868714 天前
第7板块·第3节:CUTLASS 的 GEMM 实现与优化策略
c++·人工智能·gpu算力·cuda
Luchang-Li15 天前
CUDA stream创建和依赖,多流并行
stream·cuda·并行