【Triton 教程】triton_language.load

Triton 是一种用于并行编程的语言和编译器。它旨在提供一个基于 Python 的编程环境,以高效编写自定义 DNN 计算内核,并能够在现代 GPU 硬件上以最大吞吐量运行。

更多 Triton 中文文档可访问 →triton.hyper.ai/

复制代码
triton.language.load(pointer, mask=None, other=None, boundary_check=(), padding_option='', cache_modifier='', eviction_policy='', volatile=False)

返回 1 个数据张量,其值从由指针所定义的内存位置处加载:

1.如果 pointer 是单元素指针,则加载 1 个标量。在这种情况下:

  • mask 和 other 必须也是标量,
  • other 会隐式地转换为 pointer.dtype.element_ty 类型,
  • boundary_check 和 padding_option 必须为空。

2.如果 pointer 是 1 个 N 维指针张量,则加载 1 个 N 维张量。在这种情况下:

  • mask 和 other 会被隐式地广播到 pointer.shape,
  • other 会隐式地转换为 pointer.dtype.element_ty 类型,
  • boundary_check 和 padding_option 必须为空。

3.如果 pointer 是由 make_block_ptr 定义的块指针,则加载 1 个张量。在这种情况下:

  • mask 和 other 必须为 None,
  • 可以指定 boundary_check 和 padding_option 来控制超出越界访问的行为。

参数**:**

  • pointer (triton.PointerType *,*或 dtype=triton.PointerType 的块)- 指向要加载的数据的指针。
  • mask (triton.int1 的块 *,*可选)- 如果 maskidx 为 false,则不加载 pointeridx 处的数据(对于块指针必须为 None)。
  • other (块 , 可选) - 如果 maskidx 为 false,则返回 otheridx。
  • boundary_check (整数元组 *,*可选)- 表示应进行边界检查维度的元组。
  • padding_option - 应为 {"", "zero", "nan"} 中的一个,越界时进行填充。
  • cache_modifier **(*str ,可选,*应为 {"", "ca", "cg"} 中的一个 )- 其中「ca」表示在所有层级进行缓存,「cg」表示在全局层级缓存(在 L2 及以下缓存,不是 L1),详细信息请参见缓存操作符。)在 NVIDIA PTX 中更改缓存选项。
  • eviction_policy (str , 可选) - 更改 NVIDIA PTX 中的驱逐策略。
  • volatile (bool , 可选) - 更改 NVIDIA PTX 中的易失性选项。
相关推荐
长三角智造观察9 分钟前
中小制造ERP+MES选型避坑:对接集成VS原生一体化,深度对比TCO与落地痛点
大数据·人工智能·制造
一水鉴天6 小时前
映射、哈希表与哈斯图:计算机科学的三种基线 20261003(元宝)
开发语言·人工智能
198******126346 小时前
2026 企业 AI 办公产品选型指南:从场景匹配判断工具价值
人工智能
Eloudy6 小时前
全文 - 第 03 章 - Principles and Practices of Interconnection Networks
gpu
玫瑰互动GEO6 小时前
GEO优化学习九级模型:开发者从认知层切入
人工智能·ai·ai搜索·gem·生成式引擎优化·gem优化
海绵宝宝转agent7 小时前
learn-claude-code第1-5章开源学习笔记分享
人工智能·笔记·python·学习
Eloudy7 小时前
全文 - 第 01 章 - Principles and Practices of Interconnection Networks
gpu·chiplet
每天都要写算法(努力版)7 小时前
【行业前沿报告】DAgger:让智能体在自己走到的状态上学习
人工智能·学习·机器学习
liron717 小时前
智能实体演化系统的统一性概念
人工智能·深度学习·神经网络
呆萌很7 小时前
常用骨干网络预训练输入尺寸
人工智能