


全球最強超算,易主了!
中山大學教授帶隊、深圳制造的靈晟超級計算機,剛剛登頂全球超算TOP500榜單,打破了西方近十年的壟斷地位。
更讓人驚詫的是,這個TOP1超算,含英偉達量為0,甚至一塊GPU也沒用。
在超過2EFlops的超算系統(tǒng)中,獨一無二,驚詫友邦。

具體來說,靈晟采用了自主可控的純CPU架構(gòu),CPU芯片、存儲架構(gòu)和高速互連網(wǎng)絡全部自研。
圖靈獎得主Jack Dongarra評價,靈晟是“AI4S新型架構(gòu)的希望之光”,將重新劃定全球算力競爭格局。
靈晟沒有使用一塊GPU,這在今天的超算領(lǐng)域幾乎是一個異類。
El Capitan、Frontier、Aurora……當前TOP500前列的E級超算,無一例外都依賴GPU提供主要算力。
GPU擅長大規(guī)模并行計算,是過去十年超算性能躍升的核心驅(qū)動力。

但靈晟選擇了一條完全不同的路——Online Acceleration全CPU架構(gòu),而且芯片、互連、存儲、操作系統(tǒng)到上層軟件,全部自研。
靈晟的核心處理器是自研的LX2芯片。
LX2并不是一顆傳統(tǒng)意義上的通用CPU,其內(nèi)部集成了AI矩陣加速單元,原生支持FP64、FP32、BF16、FP16、INT8多種精度格式,將矩陣加速能力直接內(nèi)嵌進了CPU。
官方表示,靈晟在混合精度與稀疏/稠密矩陣計算等關(guān)鍵指標上,已超越傳統(tǒng)CPU+GPU異構(gòu)架構(gòu)。
LX2的內(nèi)存架構(gòu)同樣是靈晟的亮點。
靈晟是首款集成國產(chǎn)HBM的超算系統(tǒng),每顆LX2片上都搭載了32GB國產(chǎn)片上內(nèi)存,內(nèi)存帶寬達4TB/s,同時搭配最高256GB的外部DDR5內(nèi)存,兼顧帶寬與容量。
相比傳統(tǒng)CPU,靈晟的內(nèi)存帶寬提升了10倍。

網(wǎng)絡層面,靈晟采用自主設計的靈啟高速互連網(wǎng)絡,支持200萬個端口、10萬節(jié)點的超大規(guī)模組網(wǎng),節(jié)點間帶寬達1.6Tb/s。
在軟件層面,靈晟運行的是自研全棧軟件,將靈晟的底層硬件能力以可編程、可優(yōu)化的方式開放給上層應用。
散熱方面,靈晟首創(chuàng)100%全液冷散熱機柜,整機功耗42.2MW,能效比達52.07GFlops/W,在Green500能效榜上排名第50位。
靈晟能靠純CPU架構(gòu)在雙精度浮點性能上登頂TOP500,并同步拿下HPCG榜單第一,證明了全CPU路線在傳統(tǒng)科學計算場景下的可行性。

而將AI矩陣加速單元直接內(nèi)嵌進CPU的設計思路,也讓靈晟天然具備承載HPC與AI融合計算的潛力。
在大規(guī)模并行環(huán)境下,靈晟的平均擴展效率達84.4%,全系統(tǒng)可調(diào)度核心數(shù)超過千萬。
靈晟的奪冠意味著,時隔九年,中國超算重回TOP500榜首;上一次登頂,還是2017年的神威·太湖之光。
而且靈晟此次以全國產(chǎn)自主架構(gòu)直接奪冠,給外界帶來的關(guān)注也不止于性能數(shù)字。
靈晟是全球首臺純CPU架構(gòu)突破2EFlops的超算系統(tǒng),打破了E級算力必須依賴GPU的行業(yè)慣例。
超算行業(yè)里,GPU的統(tǒng)治地位由來已久。
過去十年,隨著并行計算需求的爆發(fā)式增長,GPU逐漸取代CPU成為超算系統(tǒng)的核心算力來源。
據(jù)英偉達官方披露,在本屆ISC2026發(fā)布的TOP500榜單中,英偉達技術(shù)支撐的超算系統(tǒng)數(shù)量已超過400臺,占TOP500總數(shù)的81%。
當前TOP500前列的E級超算——El Capitan、Frontier、Aurora——無一例外都以GPU作為核心算力引擎。

GPU在超算領(lǐng)域的滲透,也讓英偉達成為全球算力基礎設施中幾乎不可繞過的一環(huán)。
AI時代的到來,也進一步強化了這一格局。
大模型訓練對GPU的需求,讓英偉達的超算地位與AI產(chǎn)業(yè)深度綁定,形成了更難被撼動的生態(tài)壁壘。
靈晟的出現(xiàn),是這個格局中罕見的異數(shù)。
圖靈獎得主Jack Dongarra在頒獎現(xiàn)場評價,靈晟讓世界看到了超算通向AI4Science新型系統(tǒng)架構(gòu)的希望之光。
在HPCG榜單上,靈晟同步登頂,績達22 PFLOPS,進一步印證了靈晟在傳統(tǒng)科學計算場景下的綜合實力。
靈晟的總設計師、國家超算深圳中心主任、中山大學教授盧宇彤,與這個領(lǐng)域的淵源可以追溯到更早。
2013年至2015年,盧宇彤以天河二號副總設計師的身份,六次站上全球超算最高領(lǐng)獎臺,見證了天河二號創(chuàng)下的六連冠紀錄。
時隔十一年,盧宇彤再度登臺領(lǐng)獎,靈晟接續(xù)了天河二號的歷史。

性能之外,靈晟的實際應用已在多個科學領(lǐng)域展開。
AI for Science(AI4S),正在成為超算領(lǐng)域最受關(guān)注的前沿方向。
從AlphaFold預測蛋白質(zhì)結(jié)構(gòu),到大規(guī)模氣候模型、藥物分子篩選、材料性質(zhì)預測,AI與傳統(tǒng)科學計算的融合正在加速重塑各個基礎學科的研究范式。
這對超算系統(tǒng)提出了新的要求,不僅要跑得快,還要能同時承載高精度科學模擬與大規(guī)模AI訓練兩類截然不同的計算任務。
現(xiàn)有的GPU加速架構(gòu)在AI訓練上表現(xiàn)出色,但在兩種計算模式的深度融合上,仍存在架構(gòu)層面的天然割裂。
靈晟的出現(xiàn),很好地彌補了這個不足。
自靈晟系統(tǒng)部署以來,靈支撐大氣海洋、工程仿真、材料科學、藥物發(fā)現(xiàn)、腦科學、科學AI、大模型推理等方向的計算任務。
面向科學、工程、產(chǎn)業(yè)各領(lǐng)域的大規(guī)模應用需求,靈晟提供了多學科、全流程、多精度融合的科學智能應用平臺,并已形成世界級應用成果。
參考鏈接:
[1]https://mp.weixin.qq.com/s/1wzSE-f3s47abkXGKbrbtw
[2]https://mp.weixin.qq.com/s/NzNYNqaoEizPmVhkKLI0Qw
[3]https://www.tomshardware.com/tech-industry/supercomputers/chinas-lineshine-supercomputer-dethrones-us-el-capitan-secures-first-place-in-top-500-list-f
文章來源:量子位