中国首个十万卡集群落成!国产算力如何撑起"十万卡时代"

7 月 10 日,郑州,中科曙光宣布曙光 8000(登峰)正式落成------这是中国首个十万卡级别的全国产 AI 超算集群。


一、十万卡,不只是加一个零

从万卡到十万卡,不是简单的 10 倍扩列------这是一道完全不同的工程题

网络怎么不堵?存储怎么不崩?散热怎么不烧?调度怎么不乱?规模每上一个量级,系统复杂度都是指数级翻倍。

但在 2026 年 7 月,中国交出了自己的答卷。

7 月 10 日,中科曙光在郑州宣布,曙光 8000(登峰)全国产 AI 超集群正式落成,并依托国家超算互联网同步接入全国一体化算力网。

十万张国产加速卡,跑起来了。

更关键的是,这座集群走的不是"堆卡"的老路。


二、"超智融合"------一条让算力不浪费的路

当前的 AI 算力中心有个普遍的尴尬:

建了一堆集群,能跑大模型的跑不了科学计算,能跑科学计算的训不动大模型。

这种"两头不靠"的结构性错配,让大量算力资源躺在机房里晒太阳。

曙光 8000 的解法是------原生超智融合

同一套系统,既能扛住 FP64 双精度的科学计算任务 (类脑模拟、气候预测、量子化学) ,也能跑满万亿参数大模型的训练需求 (从 FP64 到 INT8 全精度覆盖)

这不是把超算和智算拼在一起,而是从架构设计阶段就把两件事当作一件事来做

打个比方:以前的思路是为卡车修一条路,为轿车修另一条路。现在是一条路同时跑卡车和轿车------看起来都是路,但设计逻辑完全不同。

曙光 8000 是业内首个基于原生超智融合路线、支持全精度计算的十万卡级算力集群案例,为国产算力资源配置优化给出了一条现实路径。


三、工程奇迹:从 3 万卡到 10 万卡,只用了半年

十万卡集群的工程难度,业内心知肚明。但中科曙光依然创下了令人咂舌的进度:

时间 里程碑
2024 年 系统研制启动
2025 年 完成工程建设
2026 年 2 月 3 万卡上线试运行
2026 年 4 月 投用 6 万卡 AI4S 集群
2026 年 7 月 10 万卡部署落地

仅用半年从 3 万卡冲到 10 万卡,这背后是 30 多年的工程能力积累。

据中科曙光高级副总裁李斌介绍,曙光 8000 拥有 芯片、计算、存储、网络、散热、管理、服务等全链路全国产自研能力

  • 芯片:海光等国产芯片提供底层支撑
  • 网络:ScaleFabric 类 IB 原生 RDMA 高速网络,实现十万卡级高可靠连接
  • 存储:ParaStor 分布式存储支撑海量数据读写,在 2026 年全球 IO500 榜单中获生产型全节点和 10 节点性能双榜第一
  • 散热:曙光数创液冷技术,支撑 MW 级高功率密度部署,通过国产冷媒和全年自然冷却提升能效

四、不只是跑分,更是在跑业务

AI 产业有一个被反复验证的规律:发布会上的参数永远跑不赢业务现场的考验。

曙光 8000 已经在真实场景中交出了成绩单:

  • 8 万张卡加速蛋白质折叠全流程模拟,直接服务新药研发
  • 8.8 万张卡完成 328 万亿网格湍流直接模拟,支撑航空、船舶等高端制造
  • 9 万张卡协同完成 3.16 万亿个原子的 DFT 高精度仿真

这些不是 PPT 数字,而是科研团队在国产算力上跑出来的世界级成果。

更值得关注的是,曙光 8000 采用 AI 计算开放架构,支持多品牌 AI 加速卡,兼容主流生态。一线开发者和科研人员不需要重新学习一套封闭工具链,已有的模型和应用可以快速迁移上线。

目前已完成 300 余项应用适配,覆盖材料、电磁、量子、生物医药、天文气象等 20 多个领域,累计完成 70 余次万卡规模算力测试。


五、从示范工程到可复制方案

曙光 8000 的落成,不只是单个项目的成功。

大会期间,中科曙光与北京科学智能研究院达成战略合作,正式启动 第二套全国产十万卡超智融合算力系统 的研制与建设。

这意味着曙光 8000 正在从一个示范工程走向可复制的标准方案。

而落子郑州的战略意义也值得深思------这里的区位、能源条件和网络节点地位,让它天然适合成为连接东西部算力的枢纽。


六、更大的棋局:让算力像电力一样流动

"东数西算"、"全国一体化算力网"、"国家超算互联网"------这些顶层设计的目标都是一件事:让算力像电力一样流动起来。

曙光 8000 就是这条算力网上的一个十万卡级骨干节点。

当一个又一个类似的节点在全国铺开,中国将率先织成全球最大规模的算力调度网络------届时,北京的科研团队可以在毫秒级调度郑州的算力,深圳的 AI 公司可以无缝使用成都的集群。

算力的终极命题不是"跑分",而是"用好"。

曙光 8000 的存在证明了一件事:国产算力不仅能造得出来,还能用得好。从 3 万卡到 10 万卡只用了半年,从单一场景到 20 多个领域只用了几个月。

十万卡时代,不是终点,而是起点。


参考来源:量子位《中国首个十万卡集群落成!全国产算力支撑"十万卡时代"》

相关推荐
qq_3164110317 小时前
腹腔镜模拟手术训练数字化管理平台构建
人工智能·python·深度学习·机器学习
阿三081217 小时前
AI 重构跨部门协同:如何利用协同平台打通部门信息壁垒
人工智能·重构
方乐寺村17 小时前
彩笔运维勇闯机器学习--拟合
运维·人工智能·机器学习
程序员cxuan18 小时前
A 社封杀了 1140 万个账号,下午 Claude 崩了。
人工智能·后端·程序员
nvvas18 小时前
ImageMagick:命令行图像处理的瑞士军刀
图像处理·人工智能
星栈18 小时前
MCP 2026 史上最大架构重构:从会话握手到无状态协议
人工智能·后端
CHAM_GJ18 小时前
AI日报-让生活更美好
人工智能·ai编程·ai coding 动态·具身智能动态
甲维斯19 小时前
DeepSeek终于上新,GPT大降价,智谱GLM大涨价!
人工智能
爱研究的小梁19 小时前
多链路聚合通信:时延控制与网络波动对抗逻辑梳理
网络·人工智能·信息与通信
IT_陈寒19 小时前
Vite静态资源路径这个坑差点让我加班到凌晨
前端·人工智能·后端