CUDA编程:CUDA环境变量 CUDA Environment Variables

CUDA编程:CUDA环境变量 CUDA Environment Variables

变量 描述
设备枚举与属性
CUDA_VISIBLE_DEVICES MIG支持的GPU标识符的逗号分隔序列:MIG-/<GPU实例ID>/<计算实例ID> GPU标识符以整数索引或UUID字符串的形式给出。GPU UUID字符串应遵循nvidia-smi给出的相同格式,例如GPU-8932f937-d72c-4106-c12f-20bd9faed9f6。
CUDA_MANAGED_FORCE_DEVICE_ALLOC 0 或 1(默认值为 0) 强制驱动程序将所有托管分配放置在设备内存中。
CUDA_DEVICE_ORDER FASTEST_FIRST, PCI_BUS_ID,(默认值为 FASTEST_FIRST) FASTEST_FIRST 会使 CUDA 使用简单的启发式方法,按照从快到慢的顺序枚举可用的设备。PCI_BUS_ID 则根据 PCI 总线 ID 对设备进行排序。
编译
CUDA_CACHE_DISABLE 0 或 1(默认值为 0) 禁用(当设置为 1 时)或启用(当设置为 0 时)即时编译的缓存。当禁用时,不会向缓存中添加或从缓存中检索二进制代码。
CUDA_CACHE_PATH 文件路径 指定即时编译器缓存二进制代码的文件夹;默认值如下: 在 Windows 上:%APPDATA%\NVIDIA\ComputeCache 在 Linux 上:~/.nv/ComputeCache
CUDA_CACHE_MAXSIZE 整数(对于桌面/服务器平台,默认值为1 GiB,对于嵌入式平台,默认值为 256 MiB,最大值为 4 GiB) 指定即时编译器使用的缓存大小(以字节为单位)。
CUDA_FORCE_PTX_JIT 0 或 1(默认值为 0) 当设置为 1 时,强制设备驱动程序忽略应用程序中嵌入的任何二进制代码,并仅即时编译嵌入的 PTX 代码。
CUDA_DISABLE_PTX_JIT 0 或 1(默认值为 0) 当设置为 1 时,禁用嵌入的 PTX 代码的即时编译,并使用应用程序中嵌入的兼容二进制代码
CUDA_FORCE_JIT 0 或 1(默认值为 0) 当设置为 1 时,强制设备驱动程序忽略应用程序中嵌入的任何二进制代码,并始终使用即时编译来生成二进制代码。
CUDA_DISABLE_JIT 0 或 1(默认值为 0) 当设置为 1 时,禁用嵌入的 PTX 代码的即时编译,并使用应用程序中嵌入的兼容二进制代码
执行
CUDA_LAUNCH_BLOCKING 0 或 1(默认值为 0) 禁用(设置为 1 时)或启用(设置为 0 时)异步内核启动。
CUDA_DEVICE_MAX_CONNECTIONS 1 到 32(默认值为 8) 设置从主机到每个计算能力为 3.5 及以上的设备的计算和复制引擎并发连接(工作队列)的数量。
CUDA_AUTO_BOOST 0 或 1 覆盖 nvidia-smi 的 --auto-boost-default 选项设置的自动增强行为。
cuda-gdb (on Linux platform)
CUDA_DEVICE_WAITS_ON_EXCEPTION 0 或 1(默认值为 0) 当设置为 1 时,如果发生设备异常,CUDA 应用程序将停止,允许附加调试器进行进一步调试。
MPS service (on Linux platform)
CUDA_DEVICE_DEFAULT_PERSISTING_L2_CACHE_PERCENTAGE_LIMIT 百分比值(介于 0 - 100 之间,默认值为 0) 计算能力为 8.x 的设备允许将 L2 缓存的一部分设置为持久化全局内存数据访问。
模块加载
CUDA_MODULE_LOADING DEFAULT, LAZY, EAGER(默认值为 LAZY) 指定应用程序的模块加载模式。
CUDA_MODULE_DATA_LOADING DEFAULT, LAZY, EAGER(默认值为 LAZY) 指定应用程序的数据加载模式。.
预加载依赖库
CUDA_FORCE_PRELOAD_LIBRARIES 0 或 1(默认值为 0) 当设置为 1 时,强制驱动程序在初始化期间预加载 NVVM 和 PTX 即时编译所需的库。
CUDA Graphs
CUDA_GRAPHS_USE_NODE_PRIORITY 0 或 1 在图形实例化时覆盖 cudaGraphInstantiateFlagUseNodePriority 标志。当设置为 1 时,该标志将为所有图形设置,当设置为 0 时,该标志将为所有图形清除。
相关推荐
INDEMIND1 小时前
INDEMIND:AI视觉赋能服务机器人,“零”碰撞避障技术实现全天候安全
人工智能·视觉导航·服务机器人·商用机器人
慕容木木1 小时前
【全网最全教程】使用最强DeepSeekR1+联网的火山引擎,没有生成长度限制,DeepSeek本体的替代品,可本地部署+知识库,注册即可有750w的token使用
人工智能·火山引擎·deepseek·deepseek r1
南 阳1 小时前
百度搜索全面接入DeepSeek-R1满血版:AI与搜索的全新融合
人工智能·chatgpt
企鹅侠客1 小时前
开源免费文档翻译工具 可支持pdf、word、excel、ppt
人工智能·pdf·word·excel·自动翻译
冰淇淋百宝箱2 小时前
AI 安全时代:SDL与大模型结合的“王炸组合”——技术落地与实战指南
人工智能·安全
Elastic 中国社区官方博客2 小时前
Elasticsearch Open Inference API 增加了对 Jina AI 嵌入和 Rerank 模型的支持
大数据·人工智能·elasticsearch·搜索引擎·ai·全文检索·jina
美狐美颜sdk3 小时前
直播美颜工具架构设计与性能优化实战:美颜SDK集成与实时处理
深度学习·美颜sdk·第三方美颜sdk·视频美颜sdk·美颜api
AWS官方合作商3 小时前
Amazon Lex:AI对话引擎重构企业服务新范式
人工智能·ai·机器人·aws
workflower3 小时前
Prompt Engineering的重要性
大数据·人工智能·设计模式·prompt·软件工程·需求分析·ai编程
curemoon3 小时前
理解都远正态分布中指数项的精度矩阵(协方差逆矩阵)
人工智能·算法·矩阵