中国首个十万卡集群落成!国产算力如何撑起"十万卡时代"

7 月 10 日,郑州,中科曙光宣布曙光 8000(登峰)正式落成------这是中国首个十万卡级别的全国产 AI 超算集群。


一、十万卡,不只是加一个零

从万卡到十万卡,不是简单的 10 倍扩列------这是一道完全不同的工程题

网络怎么不堵?存储怎么不崩?散热怎么不烧?调度怎么不乱?规模每上一个量级,系统复杂度都是指数级翻倍。

但在 2026 年 7 月,中国交出了自己的答卷。

7 月 10 日,中科曙光在郑州宣布,曙光 8000(登峰)全国产 AI 超集群正式落成,并依托国家超算互联网同步接入全国一体化算力网。

十万张国产加速卡,跑起来了。

更关键的是,这座集群走的不是"堆卡"的老路。


二、"超智融合"------一条让算力不浪费的路

当前的 AI 算力中心有个普遍的尴尬:

建了一堆集群,能跑大模型的跑不了科学计算,能跑科学计算的训不动大模型。

这种"两头不靠"的结构性错配,让大量算力资源躺在机房里晒太阳。

曙光 8000 的解法是------原生超智融合

同一套系统,既能扛住 FP64 双精度的科学计算任务 (类脑模拟、气候预测、量子化学) ,也能跑满万亿参数大模型的训练需求 (从 FP64 到 INT8 全精度覆盖)

这不是把超算和智算拼在一起,而是从架构设计阶段就把两件事当作一件事来做

打个比方:以前的思路是为卡车修一条路,为轿车修另一条路。现在是一条路同时跑卡车和轿车------看起来都是路,但设计逻辑完全不同。

曙光 8000 是业内首个基于原生超智融合路线、支持全精度计算的十万卡级算力集群案例,为国产算力资源配置优化给出了一条现实路径。


三、工程奇迹:从 3 万卡到 10 万卡,只用了半年

十万卡集群的工程难度,业内心知肚明。但中科曙光依然创下了令人咂舌的进度:

时间 里程碑
2024 年 系统研制启动
2025 年 完成工程建设
2026 年 2 月 3 万卡上线试运行
2026 年 4 月 投用 6 万卡 AI4S 集群
2026 年 7 月 10 万卡部署落地

仅用半年从 3 万卡冲到 10 万卡,这背后是 30 多年的工程能力积累。

据中科曙光高级副总裁李斌介绍,曙光 8000 拥有 芯片、计算、存储、网络、散热、管理、服务等全链路全国产自研能力

  • 芯片:海光等国产芯片提供底层支撑
  • 网络:ScaleFabric 类 IB 原生 RDMA 高速网络,实现十万卡级高可靠连接
  • 存储:ParaStor 分布式存储支撑海量数据读写,在 2026 年全球 IO500 榜单中获生产型全节点和 10 节点性能双榜第一
  • 散热:曙光数创液冷技术,支撑 MW 级高功率密度部署,通过国产冷媒和全年自然冷却提升能效

四、不只是跑分,更是在跑业务

AI 产业有一个被反复验证的规律:发布会上的参数永远跑不赢业务现场的考验。

曙光 8000 已经在真实场景中交出了成绩单:

  • 8 万张卡加速蛋白质折叠全流程模拟,直接服务新药研发
  • 8.8 万张卡完成 328 万亿网格湍流直接模拟,支撑航空、船舶等高端制造
  • 9 万张卡协同完成 3.16 万亿个原子的 DFT 高精度仿真

这些不是 PPT 数字,而是科研团队在国产算力上跑出来的世界级成果。

更值得关注的是,曙光 8000 采用 AI 计算开放架构,支持多品牌 AI 加速卡,兼容主流生态。一线开发者和科研人员不需要重新学习一套封闭工具链,已有的模型和应用可以快速迁移上线。

目前已完成 300 余项应用适配,覆盖材料、电磁、量子、生物医药、天文气象等 20 多个领域,累计完成 70 余次万卡规模算力测试。


五、从示范工程到可复制方案

曙光 8000 的落成,不只是单个项目的成功。

大会期间,中科曙光与北京科学智能研究院达成战略合作,正式启动 第二套全国产十万卡超智融合算力系统 的研制与建设。

这意味着曙光 8000 正在从一个示范工程走向可复制的标准方案。

而落子郑州的战略意义也值得深思------这里的区位、能源条件和网络节点地位,让它天然适合成为连接东西部算力的枢纽。


六、更大的棋局:让算力像电力一样流动

"东数西算"、"全国一体化算力网"、"国家超算互联网"------这些顶层设计的目标都是一件事:让算力像电力一样流动起来。

曙光 8000 就是这条算力网上的一个十万卡级骨干节点。

当一个又一个类似的节点在全国铺开,中国将率先织成全球最大规模的算力调度网络------届时,北京的科研团队可以在毫秒级调度郑州的算力,深圳的 AI 公司可以无缝使用成都的集群。

算力的终极命题不是"跑分",而是"用好"。

曙光 8000 的存在证明了一件事:国产算力不仅能造得出来,还能用得好。从 3 万卡到 10 万卡只用了半年,从单一场景到 20 多个领域只用了几个月。

十万卡时代,不是终点,而是起点。


参考来源:量子位《中国首个十万卡集群落成!全国产算力支撑"十万卡时代"》

相关推荐
Python私教1 小时前
如意智影:如何让同一个人物在多个镜头里保持身份一致
人工智能·python·架构
两万五千个小时2 小时前
DeepSeek Harness 从 0 开始:10 Hooks 模块(钩子协议)
人工智能·程序员·架构
rimydu1974art2 小时前
opencheck解读:拆解 OpenCheck 的歧视性条款识别与澄清问询机制
人工智能·typescript
武子康2 小时前
33B 音画模型塞进 Apple Silicon,h3.c 重写了哪些 Runtime 职责
人工智能·llm·agent
SHIPKING3932 小时前
【WorkBuddy】开发者必备的省积分与Token优化实战指南
人工智能
AI导出鸭2 小时前
Claude的LaTeX生成PDF文件复制后数学公式乱码,怎样修改?专业用户首选“AI导出鸭”
人工智能·pdf·ai导出鸭
染指11102 小时前
95.RAG-RAG应用平台-工作流(Agent)
人工智能·agent
草莓熊Lotso2 小时前
【Linux网络加餐】手动部署:SSH 与 Web 服务实战 + 底层原理全解析
linux·运维·网络·人工智能·python·langchain·ssh
小妖同学学AI2 小时前
60.8k星!开源金融数据神器OpenBB:连接一切数据,让分析师、量化交易员和AI智能体如虎添翼!
人工智能·金融·开源
YOLO数据集集合2 小时前
UAVDT 无人机车辆检测数据集 - 无人机航拍 | 车辆检测 | 目标检测 | YOLO格式 | 智能交通 | 城市管理 | 多类别数据集 | 计算机视觉
人工智能·yolo·目标检测·机器学习·计算机视觉·目标跟踪·无人机