AI服务器PCIe拓扑

Balance模式

同一颗CPU下两颗GPU通讯通过PCIE Switch以PCIE P2P进行(红色虚线示意);不同CPU下两颗GPU通讯先经过PCIE Switch到达CPU,然后通过UPI/xGMI CPU间互联到达另一颗CPU,然后通过PCIE Switch到达目标GPU(蓝色虚线示意)。

Common模式

相比Balance模式,原CPU1的PCIE Switch断开连接,并以x16 PCIe链路连接到CPU0;

对于同一颗PCIe Switch直连GPU间通讯与Balance模式一样,在此不再赘述。但是,跨Switch GPU通讯与Balance不同,GPU -> PSW -> CPU0 -> PSW -> GPU,相比Balance模式,跨PCIe Switch GPU间通讯延迟更小。

Cascade模式

与Balance模式相比,原CPU1连接的PCIe Switch断开连接,将PCIe Switch的x16 PCIe连接到另一颗PCIe Switch。

Cascade模式下同一颗PCIe Switch GPU间通讯通过PCIe P2P实现,GPU -> PSW -> GPU,与Balance模式和Common模式一致;跨PCIe Switch GPU间通讯路径:GPU -> PSW -> PSW -> GPU,从通讯路径看,Cacade模式通讯延迟优于Balance模式和Common模式。

性能

相关推荐
模型时代2 个月前
生益电子:AI服务器把PCB层数堆到40层,定增扩产HDI与高多层算力板
ai服务器·生益电子·技术升级
qyr67893 个月前
全球AI服务器DAC线缆市场发展趋势与未来趋势展望
大数据·人工智能·数据分析·汽车·ai服务器·ai服务器dac线缆
深圳市尚想信息技术有限公司1 年前
ISL8121IRZ-T 瑞萨电子Renesas高效双路同步降压控制器 【5G基站、AI服务器】专用
5g·控制器·renesas·瑞萨电子·降压控制器·ai服务器