Pytorch在二进制层面比较张量中的各行是否相同,并返回不相同的各行

代码实例:

python 复制代码
def unique(arr):
    # Finds unique rows in arr and return their indices
    arr = arr.cpu().numpy()
    arr_ = np.ascontiguousarray(arr).view(np.dtype((np.void, arr.dtype.itemsize * arr.shape[1])))
    _, idxs = np.unique(arr_, return_index=True)
    if torch.cuda.is_available():
        return torch.LongTensor(np.sort(idxs)).cuda()
    return torch.LongTensor(np.sort(idxs))

在 NumPy 中,.view() 方法用于创建数组的新视图,而不实际复制底层数据。在这种情况下,.view(np.dtype((np.void, arr.dtype.itemsize * arr.shape[1]))) 的目的是将数组 arr 转换为一个以字节为单位的视图,以便后续的操作更加灵活。

具体来说,这一行代码的操作步骤如下:

  1. np.ascontiguousarray(arr): 确保数组是按照内存中的顺序(C 风格)连续存储的,这对于后续的视图操作很重要。

  2. .view(np.dtype((np.void, arr.dtype.itemsize * arr.shape[1]))): 创建一个新的视图,该视图将数组的每一行都视为一个字节块np.dtype((np.void, arr.dtype.itemsize * arr.shape[1]))定义了这个字节块的数据类型,其中 arr.dtype.itemsize * arr.shape[1] 表示每一行的总字节数。这样,整个数组被视为一个由字节块组成的虚拟类型数组。

  3. np.void 是 NumPy 中的数据类型,表示**"虚拟"类型**。它通常用于表示内存块,而不考虑具体的数据类型。在这里,np.void 被用于创建一个足够大的数据类型,以便能够容纳整个行数据

    在特定的上下文中,np.void 类型的一个实例可能包含多个数据类型的字段,但在这里它主要用于以字节的形式表示整个行的内容,而不考虑具体的数值类型。这使得在内存中视图上进行操作更加灵活,而不依赖于原始数据类型

这种方式的操作在某些情况下很有用,尤其是在处理复杂的数据结构或需要比较原始二进制数据时。在这里,可能是为了实现对行的快速唯一性检查,因为 .unique() 方法在处理复杂数据类型时可能会遇到一些问题。

相关推荐
Mike_Zhang18 小时前
使用python统计FreeSWITCH呼叫并发
python·freeswitch
VisualComponents18 小时前
SEJFO依托Visual Components仿真工具,实现自动化业务销售全面升级
人工智能·机器人·工业自动化·工厂仿真·机器人离线编程
面包狗AI4S18 小时前
GitHub AI4S 项目观察(2026-08-07—2026-08-13)
人工智能·github
SL-staff18 小时前
技术实践:HR如何用JVS-Logic可视化编排实现考勤数据同步(含节点配置与异常处理)
开发语言·python·低代码·钉钉·可视化编排·jvs-logic·hr技术
AI办公探索者18 小时前
多智能体协作架构:从单Agent到多Agent协同的技术演进
人工智能·ai·架构
V哥AI增长19 小时前
宠物行业GEO机制:AI如何推荐医院与产品
人工智能·搜索引擎·宠物
baidu_2593395719 小时前
智慧消防管理系统平台(基于物联网与大数据的城市消防安全解决方案)
大数据·人工智能·物联网·云计算·智慧消防·力安科技·gdliontech.cn
欧阳天羲19 小时前
【升级版】AI毫米波雷达扫描+视觉双鉴激光灭蚊机器人|360°全域侦测+超低误杀+人体安全防护(ESP32+YOLOv8全套开源)
人工智能·安全·机器人
fthux19 小时前
装闭 RenoPit 源码解析(14):Demo模式、健康检查与Docker部署
人工智能·ai·开源·github·open source·renopit