
國(guó)產(chǎn)超節(jié)點(diǎn)正在沖向?qū)﹃囉ミ_(dá)的一線位置。近日,中科曙光推出世界首個(gè)單機(jī)柜級(jí)640卡超節(jié)點(diǎn)(scaleX640)。據(jù)悉,該產(chǎn)品面向萬(wàn)億參數(shù)大模型,能夠?yàn)?/span>MOE大模型訓(xùn)練、高通量推理、科學(xué)智能(AI for Science)等前沿場(chǎng)景,提供業(yè)內(nèi)最大規(guī)模的超節(jié)點(diǎn)算力支持。

除此之外,scaleX640有兩處看點(diǎn)不容忽略:一是性能指標(biāo)上全面超過(guò)了“昇騰384”,在算力規(guī)模、密度和能效方面實(shí)現(xiàn)倍數(shù)級(jí)增長(zhǎng);二是打破了昇騰單一芯片路線的限制,可支持不同類型的國(guó)產(chǎn)加速卡,并兼容主流AI計(jì)算生態(tài)。
前者代表著國(guó)產(chǎn)超節(jié)點(diǎn)縱向發(fā)展登上新臺(tái)階,尤其算力集成度方面,scaleX640單機(jī)柜集成640卡,相較于昇騰384的32卡大幅提升20倍。后者則代表著開放式計(jì)算架構(gòu)正在切入英偉達(dá)生態(tài)腹地,以兼容性更好、適配度更高國(guó)產(chǎn)智算方案,加速吃下NV卡中國(guó)市場(chǎng)份額。
眾所周知,國(guó)產(chǎn)算力在高端AI芯片領(lǐng)域與英偉達(dá)確實(shí)存在差距,除了不斷提升國(guó)產(chǎn)芯研發(fā)制造水平之外,集群式創(chuàng)新成為另一條更符合中國(guó)國(guó)情的趕超路徑。其核心邏輯就在于以GPU為核心進(jìn)行一體化緊耦合設(shè)計(jì),從而形成更大規(guī)模的計(jì)算集群,進(jìn)行體系化算力輸出。
這種模式下,計(jì)算、存儲(chǔ)、網(wǎng)絡(luò)、供電、冷卻、管理、軟件等子系統(tǒng),都將成為體系化戰(zhàn)力的影響因素。集成規(guī)模越大、集成度越高且跨層協(xié)同能力越好,最終表現(xiàn)出的計(jì)算集群實(shí)力也就越強(qiáng)。曙光scaleX640正是依托開放式集成的路線,實(shí)現(xiàn)了國(guó)產(chǎn)超節(jié)點(diǎn)的突破性進(jìn)展。
此外,對(duì)于AI算力用戶來(lái)說(shuō),在計(jì)算性能達(dá)標(biāo)基礎(chǔ)上,其生態(tài)適配能力也尤為重要。比如對(duì)標(biāo)CUDA主流生態(tài),部分芯片路線(如昇騰NPU)需要轉(zhuǎn)譯與調(diào)優(yōu)等環(huán)節(jié),往往部署周期較長(zhǎng),甚至造成遷移后的性能損失。這也是英偉達(dá)維持其霸主地位的關(guān)鍵一環(huán)。
所以在路線選擇上,scaleX640超節(jié)點(diǎn)直接兼容主流AI計(jì)算軟件生態(tài),并且深度適配了400+主流大模型,進(jìn)而支持AI模型、業(yè)務(wù)應(yīng)用快速無(wú)縫遷移與深度優(yōu)化。這也意味著,該產(chǎn)品從計(jì)算性能和計(jì)算生態(tài)雙重角度,都站在了迎戰(zhàn)英偉達(dá)的最前沿。