NVME-oF IP 设计5 :设计扫盲3

RDMA 与 RoCEv2 技术

远程直接内存访问(Remote Direct Memory Access,RDMA)是一种高性能网络通信技术,其核心思想是在网络通信过程中绕过操作系统内核,使数据能够直接在应用程序内存之间进行传输,从而显著降低CPU参与度和系统调用开销。传统的TCP/IP网络通信需要经过内核协议栈处理、缓冲区复制以及中断机制等多个阶段,这些操作在高并发和高带宽场景下会产生较大的延迟和CPU开销。相比之下,RDMA技术通过硬件网络接口卡(RNIC)直接完成数据搬运,使远程节点能够直接访问本地节点的内存空间,实现低延迟、高带宽和低CPU占用的通信模式。

RDMA技术最初应用于InfiniBand网络,但随着数据中心以太网技术的发展,基于以太网的RDMA方案逐渐成为主流。其中RoCE(RDMA over Converged Ethernet)技术通过在以太网上封装RDMA协议,使RDMA能够运行在标准以太网环境中。RoCEv2进一步采用UDP/IP封装方式,使RDMA数据能够跨三层网络进行路由,从而提高了网络部署的灵活性,如图2.3所示。因此,在现代高性能存储系统和数据中心环境中,RoCEv2已成为NVMe-over-Fabrics等高性能存储协议的重要传输方式。

图1 RoCEv2以太网包层次

B站已给出之前的相关性能演示视频,如想进一步了解,请搜索B站用户:专注与守望

https://www.bilibili.com/video/BV1f6mbBeEiH/?spm_id_from=333.337.search-card.all.click\&vd_source=c355545d27a44fe96188b7caefeda6e7

相关推荐
HHFQ3 小时前
Linux RDMA命令行工具使用手册
rdma
gwf2161 天前
AI RDMA网络的光互联:CPO与硅光子技术前瞻——基于芯片设计验证与系统级协同的深度剖析
rdma·dpu·cpo·ibgda·ai集群网络·硅光子·光互联
gwf2162 天前
RDMA在联邦学习与跨DC训练中的应用:从协议栈到芯片微架构的深度解析
rdma·nccl·硬件加速·rocev2·dcqcn·gpudirect·ai集群网络
gwf2164 天前
AI RDMA流量工程:自适应路由与动态负载均衡 —— 架构篇:从芯片RTL到集群拓扑的算网协同设计
rdma·拥塞控制·dpu·ai集群·gpudirect·rail-optimized·自适应路由
gwf2166 天前
NVMe/RDMA传输层协议深度解析:RDMA原理、Queue Pair映射、内核实现与性能全栈剖析
linux内核·ssd·nvme·性能调优·rdma·存储协议·nvme/rdma
gwf2167 天前
800G RNIC芯片设计挑战:PCIe Gen6与DMA引擎架构 —— 面向AI超大规模集群的硬件实现深度解析
芯片设计·rdma·rnic·gpudirect·pciegen6·dma引擎·mrc协议
gwf2169 天前
AI多租户集群的RDMA隔离:PD/MR/ACL硬件实现 —— 面向大模型训练/推理的硅级安全架构
芯片设计·rdma·nccl·ai集群·gpudirect·多租户隔离·sr-iov
gwf2169 天前
NVLink与RDMA融合:Scale-Up/Scale-Out统一互联架构深度解析
rdma·nvlink·nccl·dpu·rocev2·aiinfra·gpudirect
gwf21612 天前
PFC风暴与RDMA死锁:AI训练典型故障深度分析——从芯片RTL到集群架构的全栈解构
ai训练·rdma·nccl·rocev2·pfc·dcqcn·gpudrirect
gwf21613 天前
Rail-Optimized拓扑:AI训练集群的RDMA拥塞消除与硬件实现深度解析
rdma·infiniband·nccl·ai集群·rnic·gpudirect·railoptimized