国家超算中心免费算力海光深算三号BW1000（即异构加速卡BW）性能上对标NVIDIA H100，在AI训练 A100

zhangfeng11332026-03-15 14:24

海光深算三号BW1000（即异构加速卡BW）在双精度科学计算（FP64）性能上对标NVIDIA H100，在AI训练（FP16）性能上接近NVIDIA A100，整体定位属于国产高端计算卡的中端水平。

详细性能对比

指标海光BW1000 NVIDIA H100 NVIDIA A100

FP64算力 30 TFLOPS 30-34 TFLOPS (SXM版) 9.7 TFLOPS

FP32算力 60 TFLOPS 60-67 TFLOPS 19.5 TFLOPS

FP16算力 480 TFLOPS 1,979 TFLOPS (Tensor Core) 312 TFLOPS (稀疏)

显存容量 64GB HBM2e 80GB HBM3 40/80GB HBM2e

显存带宽 1.6 TB/s 3.0 TB/s (HBM3) 1.6 TB/s

功耗约300W 700W (SXM) 400W

售价约10万元 30-40万元 (含关税) 约5万元

关键对标分析

适用场景差异

• BW1000优势场景：科学计算（CAE仿真、流体力学、气象模拟）、政务协同、国产化替代项目。在CAE仿真中可实现700倍以上加速效果。

• H100优势场景：千亿参数大模型训练、超大规模HPC任务、需要极致带宽的Exascale计算。

• A100优势场景：中等规模AI训练、性价比要求较高的科学计算任务。

生态兼容性

BW1000采用"类CUDA"路线，兼容ROCm生态，支持TensorFlow、PyTorch等主流框架，CUDA代码迁移效率可达85%-95%，显著降低迁移成本。

免费试用价值

您看到的100卡时免费试用资源，按市场价估算价值约1万元（按10万元/卡估算）。对于想体验国产高端算力的开发者、科研人员来说，这是非常宝贵的机会，可以实际测试其在科学计算或AI训练任务中的表现。

总结：异构加速卡BW是一款在双精度计算上对标H100、在AI训练上接近A100的国产高性能计算卡，特别适合有国产化需求的高精度科学计算场景。

国家超算中心免费算力 海光深算三号BW1000（即异构加速卡BW）性能上对标NVIDIA H100，在AI训练 A100