技术栈
rnic
gwf216
2 天前
芯片设计
·
rdma
·
rnic
·
gpudirect
·
pciegen6
·
dma引擎
·
mrc协议
800G RNIC芯片设计挑战:PCIe Gen6与DMA引擎架构 —— 面向AI超大规模集群的硬件实现深度解析
📑 目录摘要:本文深度剖析800G RNIC芯片架构,从RTL数据流、PCIe Gen6 DMA引擎到MRC协议硬件卸载,量化解析AI集群中的纳秒级延迟与拥塞控制,为RDMA芯片工程师提供设计验证级参考。
gwf216
8 天前
rdma
·
infiniband
·
nccl
·
ai集群
·
rnic
·
gpudirect
·
railoptimized
Rail-Optimized拓扑:AI训练集群的RDMA拥塞消除与硬件实现深度解析
摘要:本文从芯片RTL与协议栈底层视角,深度剖析Rail-Optimized拓扑在AI集群中消除RDMA拥塞的机制。涵盖RNIC硬件架构、流水线时序、NCCL硬件加速及实战调优。
gwf216
21 天前
rdma
·
nccl
·
scaleout
·
rocev2
·
ai集群
·
rnic
·
gpudirect
AI集群RDMA网络架构总览:从Scale-Out到多平面
摘要:本文深度剖析AI集群RDMA网络架构,从Scale-Out拓扑演进至多平面组网。结合芯片级硬件实现,探讨RNIC寄存器、RTL数据流及GPUDirect RDMA通路,为万卡集群的高吞吐、低尾延迟网络建设提供实战指南。
我是有底线的