roce

Eloudy3 天前
gpu·fpga·rdma·roce·doca
开源 gpunetio examples 01 解析 gpunetio_verbs_put_bw针对 https://github.com/NVIDIA-DOCA/gpunetio/tree/main/examples/gpunetio_verbs_put_bw/ 把服务器端和客户端,两端的核心逻辑分别提炼如下。
Eloudy3 天前
gpu·fpga·rdma·roce·doca
GPUNetIO开源实现与FPGA的 RoCEv2 通信延迟实验对象:arXiv:2510.25213《Platform Architecture for Tight Coupling of High-Performance Computing with Quantum Processors》第 2.4 节 “Network proof of concept”。 本文先回答"这个实验在物理上和工程上证明了什么、为什么这样设计", 再把每条原理映射到本项目(nvqlink_echo_poc/)的具体实现。
Eloudy5 天前
rdma·roce·doca
RDMA 乒乓示例:CX5 <-> CX6 DX(QSFP28 直连)两台服务器,一台插 ConnectX-5,一台插 ConnectX-6 DX,两块网卡用一根 QSFP28 线缆直连(不经过交换机)。两端通过 RDMA RC(RoCE v2) 互相收发数据:
Eloudy5 天前
gpu·rdma·roce·doca
cpu rdma 与 gpunetio 的关系gpunetio, 是类似cpu app doca sender,receiver 过程的 gpu化,现在探究两者的联系。
Eloudy2 个月前
gpu·rdma·roce
ubuntu 22.04 -cuda12.8.2- holoscan-sdk-4.5-doca-ofed先安装 build-essential 再安装 gcc-12,因为 cuda12.8.2需要gcc-12 才能安装成功。
haimin03712 个月前
roce·dcqcn
DCQCN 拥塞控制算法原理和参数配置在现代数据中心网络中,RDMA over Converged Ethernet (RoCEv2) 已成为高性能分布式存储和 AI 训练集群的主流通信协议。RDMA 要求网络提供 无损传输能力,这对拥塞控制提出了严苛挑战。
业余程序员plus7 个月前
rdma·qp·infiniband·roce·wqe·cqe·iba
RDMA-InfiniBand总线架构简介(一)IBA(InfiniBand Architecture)定义了一种系统区域网络(System Area Network,SAN),用于连接多个独立的处理器平台(即主机处理器节点)、I/O平台及I/O设备。IBA SAN是一种通信与管理基础设施,可为一个或多个计算机系统同时支持I/O和处理器间通信(IPC)。一个IBA系统的规模可小至仅含单个处理器和少量I/O设备的小型服务器,也可大至包含数百个处理器和数千个I/O设备的大规模并行超级计算机集群。此外,IBA架构对IP协议很友好,使其能够桥接到互联网、内联网
杰克逊的日记1 年前
运维·服务器·网络·roce
什么是RoCE网络技术RoCE(RDMA over Converged Ethernet) 是一种基于以太网的远程直接内存访问(RDMA)技术,旨在通过标准以太网基础设施实现低延迟、高带宽的数据传输。它将 RDMA 的高效数据传输能力与以太网的兼容性结合,主要用于数据中心高性能计算(HPC)、云计算和大规模存储集群等场景。
星融元asterfusion2 年前
网络·交换机·roce·rocev2·easy roce
Easy RoCE:在SONiC交换机上一键启用无损以太网RDMA(远程直接内存访问)技术是一种绕过 CPU 或操作系统,在计算机之间直接传输内存数据的技术。它释放了内存带宽和 CPU,使节点之间的通信具有更低的延迟和更高的吞吐量。目前,RDMA 技术已广泛应用于高性能计算、人工智能工作负载、存储和许多其他场景。
Pretend ^^2 年前
网络·分布式·深度学习·nccl·ib·roce
2. 多机多卡运行nccl-tests对比分析NCCL(NVIDIA Collective Communications Library)是NVIDIA提供的一套用于GPU加速的通信库,主要用于在多个GPU之间进行数据传输和通信。它被设计为在异构计算环境中(包括NVIDIA GPU和CPU)高效地执行数据并行和模型并行。
我是有底线的