doca

Eloudy18 天前
gpu·fpga·rdma·roce·doca
开源 gpunetio examples 01 解析 gpunetio_verbs_put_bw针对 https://github.com/NVIDIA-DOCA/gpunetio/tree/main/examples/gpunetio_verbs_put_bw/ 把服务器端和客户端,两端的核心逻辑分别提炼如下。
Eloudy19 天前
gpu·fpga·rdma·roce·doca
GPUNetIO开源实现与FPGA的 RoCEv2 通信延迟实验对象:arXiv:2510.25213《Platform Architecture for Tight Coupling of High-Performance Computing with Quantum Processors》第 2.4 节 “Network proof of concept”。 本文先回答"这个实验在物理上和工程上证明了什么、为什么这样设计", 再把每条原理映射到本项目(nvqlink_echo_poc/)的具体实现。
Eloudy20 天前
rdma·roce·doca
RDMA 乒乓示例:CX5 <-> CX6 DX(QSFP28 直连)两台服务器,一台插 ConnectX-5,一台插 ConnectX-6 DX,两块网卡用一根 QSFP28 线缆直连(不经过交换机)。两端通过 RDMA RC(RoCE v2) 互相收发数据:
Eloudy20 天前
gpu·rdma·roce·doca
cpu rdma 与 gpunetio 的关系gpunetio, 是类似cpu app doca sender,receiver 过程的 gpu化,现在探究两者的联系。
Damon小智2 年前
人工智能·机器学习·金融·边缘计算·nvidia·dpu·doca
全面评测 DOCA 开发环境下的 DPU:性能表现、机器学习与金融高频交易下的计算能力分析本文介绍了我在 DOCA 开发环境下对 DPU 进行测评和计算能力测试的一些真实体验和记录。在测评过程中,我主要关注了 DPU 在高并发数据传输和深度学习场景下的表现,以及基本的系统性能指标,包括 CPU 计算、内存带宽、多线程/多进程能力和 I/O 性能,并测试了在机器学习应用下的潜在性能。此外,我重点结合了金融高频交易的应用场景,DOCA 展现出了其在低延迟、高吞吐量和高可靠性方面的卓越优势,进一步证明了其在高性能计算和实时数据处理中的广泛应用潜力。
北冥有鱼被烹2 年前
rdma·dpu·doca
微知-DOCA SDK中如何编译一个sample?如何运行?(meson /tmp/xxx; meson compile -C /tmp/xxx)DOCA: Data Center-on-a-Chip Architecture,片上数据中心架构。是NVIDIA针对DPU的软件框架。DOCA之于DPU,就相当于CUDA之于GPU。本文介绍的是DOCA SDK中的DOCA ARGP模块的机制原理,他是DOCA程序的一个标准参数处理框架。 本文将介绍DOCA SDK中的一个DOCA_RDMA的例子,介绍如何编译运行。
我是有底线的