
2025年,隨著AI大模型應(yīng)用持續(xù)落地,算力需求閘門全面開啟。從單卡突破到集群創(chuàng)新,國產(chǎn)算力基礎(chǔ)設(shè)施正在向高密度、集成式、協(xié)同化快速突圍。其中,以“昇騰384超節(jié)點(diǎn)”、“曙光AI超集群”為代表的國產(chǎn)化計(jì)算集群,分別領(lǐng)跑兩大關(guān)鍵算力賽道:
前者圍繞華為全棧技術(shù)閉環(huán),構(gòu)建出業(yè)界最大規(guī)模高速總線互聯(lián)超節(jié)點(diǎn),打破AI算力互聯(lián)瓶頸;后者率先倡導(dǎo)AI計(jì)算開放架構(gòu),拉通產(chǎn)業(yè)跨層協(xié)作,直指高質(zhì)量、低成本算力普惠。
在全球AI技術(shù)競備日益激烈的今天,國產(chǎn)算力基礎(chǔ)設(shè)施的演進(jìn)方向均有其獨(dú)到的戰(zhàn)略考量。本文將根據(jù)“封閉式”與“開放式”計(jì)算集群核心特征,帶你讀懂兩大國產(chǎn)算力體系異同。

從昇騰384超節(jié)點(diǎn)和曙光AI超集群設(shè)計(jì)理念來看,兩者均定位于多卡協(xié)同模式,通過整合“算”、“網(wǎng)”等資源,讓計(jì)算集群像一臺(tái)計(jì)算機(jī)一樣高效工作。
其中,昇騰384超節(jié)點(diǎn)主要采用“以網(wǎng)聯(lián)算”的技術(shù)路徑,基于高速互聯(lián)總線突破算力協(xié)同瓶頸,實(shí)現(xiàn)“一卡一專家”并行推理,追求“小而精”的極致互聯(lián)性能。
曙光AI超集群則以GPU為核心,進(jìn)行“算、存、網(wǎng)、電、冷”等一體化協(xié)同緊耦合設(shè)計(jì),讓集群系統(tǒng)做到極致高效低耗,追求的是“大而美”的系統(tǒng)綜合性能與好用易用性。
兩者最大的區(qū)別在于資源集成模式的不同。比如在加速卡選擇上,384超節(jié)點(diǎn)僅支持華為昇騰910C加速卡,曙光AI超集群則全方位支持市面上多品牌AI加速卡;在軟件生態(tài)路線選擇上,前者主要基于CANN小眾生態(tài)適配路線,后者選擇兼容CUDA等主流和開源生態(tài)。
封閉式與開放式路線的差異,同樣反應(yīng)在計(jì)算機(jī)群的可擴(kuò)展性上。公開數(shù)據(jù)顯示,昇騰384超節(jié)點(diǎn)可達(dá)到最大16萬卡Scale-out集群;曙光AI超集群可支持百萬卡超大規(guī)模集群擴(kuò)展。
核心技術(shù)指標(biāo)對比
在計(jì)算集群模式差異之外,昇騰384超節(jié)點(diǎn)與曙光AI超集群在各項(xiàng)技術(shù)指標(biāo)上,均表現(xiàn)出業(yè)內(nèi)領(lǐng)先的性能實(shí)力。

首先從算力性能來看,昇騰384超節(jié)點(diǎn)單機(jī)柜32卡算力約達(dá)25PF,以該方案12個(gè)機(jī)柜計(jì)算,總算力可達(dá)300PF;曙光AI超集群則將單機(jī)柜配置做到了96卡,僅單機(jī)柜算力大于100PF。
網(wǎng)絡(luò)性能方面,384超節(jié)點(diǎn)內(nèi)任意兩卡間通信帶寬相較于傳統(tǒng)架構(gòu)提升15倍,單跳通信時(shí)延降低10倍,是業(yè)界唯一突破Decode時(shí)延15ms的方案;曙光AI超集群則采用層次化高速互連網(wǎng)絡(luò),單機(jī)柜訪存總帶寬大于180TB/s,單機(jī)柜片間互連總帶寬大于50TB/s。
效率優(yōu)化方面,384超節(jié)點(diǎn)強(qiáng)調(diào)算力互聯(lián)效率,在通信占比更高的MoE模型上達(dá)到3倍以上性能提升;曙光AI超集群強(qiáng)調(diào)系統(tǒng)多維效率提升,千卡集群性能提升2.3倍,GPU算效提升55%,能源使用效率PUE小于1.12,模型開發(fā)部署效率提高4倍。
總體來看,兩者在幾項(xiàng)關(guān)鍵性能指標(biāo)中各擅勝場。384超節(jié)點(diǎn)由于體系相對封閉,更側(cè)重于單體突破,局部性能數(shù)據(jù)增幅較大;曙光AI超集群在單點(diǎn)提升基礎(chǔ)上,資源協(xié)同范圍更廣,系統(tǒng)優(yōu)化能力和潛力都很顯著,有望在性能、功耗和成本方面取得更大進(jìn)展。
生態(tài)發(fā)展前景展望
隨著算力基礎(chǔ)設(shè)施越發(fā)趨于集成化、一體化,計(jì)算生態(tài)的重要性更加突出。僅從生態(tài)發(fā)展前景來看,封閉式與開放式計(jì)算集群在不同階段的表現(xiàn)各有優(yōu)劣。

國產(chǎn)芯片發(fā)展初期,封閉式計(jì)算路線相對占優(yōu)。因?yàn)閷τ谛酒瑥S商來說,其發(fā)展階段主要分為三步:第一,研發(fā)出自己的算力芯片;第二,開發(fā)出跟自己芯片緊密配合的計(jì)算框架;第三,針對不同的業(yè)務(wù)場景,提供更加完善的行業(yè)場景解決方案,進(jìn)而促進(jìn)應(yīng)用生態(tài)成熟。
當(dāng)各大芯片技術(shù)路線處于同一起跑線時(shí),“自研芯片+自建生態(tài)”的封閉式路線軟硬件協(xié)同程度更高,開發(fā)周期更短,可以快速投向市場,并在特定場景中進(jìn)行極致調(diào)優(yōu)建立獨(dú)到優(yōu)勢。昇騰此前的市場表現(xiàn)也驗(yàn)證了這一點(diǎn)。
國產(chǎn)芯片發(fā)展中后期,開放式計(jì)算路線成為必選項(xiàng)。因?yàn)殡S著算力需求越來越高,同構(gòu)計(jì)算業(yè)務(wù)場景越來越少,基于GPU或DSA處理器的異構(gòu)計(jì)算成為主流。此時(shí),三個(gè)或三個(gè)以上處理器類型(包括CPU)——即異構(gòu)融合計(jì)算,對于生態(tài)兼容程度提出了更高要求。
目前,包括曙光、浪潮、中興、H3C等廠商在內(nèi),都在計(jì)算集群或軟硬件生態(tài)中極力推動(dòng)開放兼容。如曙光超集群全面開放DeepAI基礎(chǔ)軟件棧、AI存儲(chǔ)優(yōu)化、液冷系統(tǒng)設(shè)計(jì)規(guī)范;浪潮推出開放式架構(gòu)的元腦SD200超節(jié)點(diǎn)AI服務(wù)器;H3C發(fā)布了開放多元的UniPoD超節(jié)點(diǎn)。
“開放”這一關(guān)鍵詞,儼然已成為高端計(jì)算服務(wù)大規(guī)模普及的必由之路。并且,即便是華為,此前也宣布了CANN開源,意在為昇騰生態(tài)建設(shè)謀求更多助力。
由此不難看出,無論是封閉式超節(jié)點(diǎn),還是開放式超集群,國產(chǎn)算力產(chǎn)業(yè)終將走向協(xié)同發(fā)展的新時(shí)代。獨(dú)行快,眾行遠(yuǎn)。期待兩大主流計(jì)算體系在更廣闊的產(chǎn)業(yè)未來勝利會(huì)師。
