2026年6月23日,德国汉堡,ISC2026国际超算大会现场,新一期全球超级计算机TOP500榜单正式揭晓。由国家超级计算深圳中心研制的新一代超算系统“灵晟”(LineShine),以2.198Exaflop/s的实测持续性能登顶榜首。这是世界上第一台持续性能突破2Exaflop/s(二百亿亿次)大关的超算系统,也是中国超算自2017年“神威·太湖之光”之后,时隔九年再次回到全球第一的位置。
排名第二的是美国劳伦斯·利弗莫尔国家实验室的El Capitan,成绩为1.809Exaflop/s。“灵晟”的领先幅度超过20%。
技术路线:不依赖GPU的纯CPU架构
在当前全球顶级超算主流路线普遍采用CPU+GPU异构计算的背景下,“灵晟”最引人注目的特征,是它没有使用任何GPU加速卡。
“灵晟”基于“灵鲲”平台,搭载了国产LX2处理器。该处理器技术原型来自华为鲲鹏体系,基于ARMv9指令集架构,每颗集成304个核心,运行频率1.55GHz。每颗LX2处理器包含两个计算芯粒,每个芯粒划分为四个NUMA域,每个NUMA域包含38个ARMv9核心和4GB高带宽内存。全系统共计20480个计算节点,CPU核心总数将近1400万个。节点之间通过国产“灵启”(LingQi)高速互连网络连接,操作系统为麒麟(Kylin)OS。整套系统部署在92个机柜中。

能效方面,“灵晟”采用100%全液冷散热方案,整机功耗约42.2MW,能效比约52.07Gigaflops/W。在HPCG高性能共轭梯度测试中,“灵晟”同样位居第一;在更贴近AI训练场景的HPL-MxP混合精度基准测试中则排名第四。
值得关注的是,LX2处理器不仅是一个纯粹的CPU。每个核心都集成了ARM可伸缩矢量扩展(SVE)与可伸缩矩阵扩展(SME)单元,专门用于加速AI训练和科学计算中的矢量及矩阵运算,支持FP64、FP32、BF16、FP16及INT8等多种数据格式。芯片还集成了32GB的封装HBM内存,提供高达4TB/s的带宽。TOP500发起人、
田纳西大学教授Jack Dongarra在实地考察后评价:“这是一套令人印象深刻的系统……他们超过我们,靠的是不依赖GPU。”
为什么选择纯CPU?——卢宇彤的回应
在CPU+GPU异构路线已成为主流的背景下,“灵晟”为何仍然选择纯CPU架构?“灵晟”超算系统总设计师、国家超算深圳中心主任卢宇彤在接受央视采访时做出了详细解释。

卢宇彤接受TOP500全球第一证书
卢宇彤表示,这条技术路线是项目初期经过广泛调研、深入研判,准确把握国际超算技术以及应用需求的发展趋势后确定的方案。虽然“灵晟”采用的是纯CPU架构,但并不意味着缺少加速能力。其核心思路是将GPU矩阵加速单元引入CPU内部,相当于CPU自带了加速能力。同时,“灵晟”还配备了自研高带宽内存,并结合片上通信优化、软硬件协同设计等技术,构建出一套既能支持超算、也能支持智算的融合高性能计算平台。
卢宇彤进一步指出,近年来外部技术环境的变化进一步强化了自主创新的决心,但选择纯CPU架构的根本原因并不只是外部因素。这一路线更加符合多领域长期应用需求,同时国内已有的技术积累也能够支撑这样的方案落地。从最终结果来看,这种差异化的全CPU在线加速架构已经展现出领先优势,实现了超算性能和能效的新突破。
不止于算得快:已支撑多领域实际应用
据卢宇彤介绍,“灵晟”自部署以来,已支撑了大气海洋模拟、工程仿真、材料科学、药物研发、脑科学、科学AI以及大模型推理等多个方向的应用。在大规模并行环境下,平均扩展效率达到84.4%,已能支撑超过千万核心规模的全系统高效运行。
“灵晟”的意义不再是单纯的算力规模提升,而在于软硬件架构的源头创新,它同时也促进了我国产业链整体能力的全面发展。从芯片、网络、存储到操作系统,把一整套国产体系跑出全球第一的成绩,本身也是对自主可控技术路线最直接的验证。

(全球储能网、新能源网综合)
本文由智算芯能前沿网编辑整理,转载请注明出处。
