NVIDIA前兩天發(fā)布了Rubin CPX,這是一款針對(duì)AI推理而生的GPU,沒(méi)用昂貴的HBM,而是給了128GB GDDR7顯存。
這款CPX顯卡對(duì)游戲玩家而言也不是沒(méi)意義的,因?yàn)樗芸赡苁俏磥?lái)的RTX 6090顯卡基礎(chǔ),網(wǎng)友High Yield稱(chēng)CPX顯卡沒(méi)有像其他AI專(zhuān)用卡那樣閹割了光柵單元,而是保留了下來(lái)。
考慮到NVIDIA在復(fù)用GPU上刀法精妙,這意味著CPX所用的GPU核心未來(lái)也是Rubin家族游戲卡的核心,即便規(guī)格不完全一樣,但也會(huì)非常相似。

具體來(lái)說(shuō)的,RTX 6090顯卡所用的核心可能是GR202,SM單元數(shù)量從當(dāng)前的170組提升到224組,CUDA核心來(lái)到了28672個(gè),將近2.9萬(wàn)核心了,也是史無(wú)前例的。
這將使其FP32性能從RTX 5090的104.77TFLOPS提升到143.36TFLOPS,大約提升30%以上,這還沒(méi)考慮到架構(gòu)上的提升。
顯存規(guī)格方面可能變化不大,畢竟RTX 5090已經(jīng)做到了32GB 512bit,NVIDIA也不太可能良心到一下子給64GB顯存,不過(guò)受益于GDDR7頻率提升,帶寬從1.8TB/s提升到1.92TB/s,聊勝于無(wú)吧。
以上是對(duì)RTX 6090顯卡的推測(cè),個(gè)人覺(jué)得算是挺靠譜的,但是最終如何還得看NVIDIA在哪里下刀,整體性能提升30%也符合這兩年來(lái)的發(fā)展軌跡。
不過(guò)伴隨著RTX 6090規(guī)格的提升,下代顯卡又來(lái)一波漲價(jià)也是可以預(yù)期的,畢竟Rubin會(huì)使用臺(tái)積電3nm工藝,比當(dāng)前RTX 5090的4N(本質(zhì)還是5nm改進(jìn))工藝貴不少,再加上其他改進(jìn),性能與價(jià)格漲幅估計(jì)也是正相關(guān)的。

奇怪的是,RTX 5090/5080 FE公版開(kāi)始消失了。
NVIDIA Founders Edition是很多玩家心目中的信仰所在,但公版卡起的是一個(gè)帶頭作用,理論上不應(yīng)該和AIC廠商搶生意,AMD的公版卡就幾乎不怎么賣(mài),NVIDIA這邊的公版卡壽命已經(jīng)夠長(zhǎng)了。
最近在歐美市場(chǎng),RTX 5090、RTX 5080的公版卡開(kāi)始悄無(wú)聲息地消失,NVIDIA官網(wǎng)紛紛下架了,美國(guó)、法國(guó)、德國(guó)、英國(guó)等主要國(guó)家均是如此。

比如在德國(guó),NVIDIA官網(wǎng)上已經(jīng)看不到RTX 5090 FE,而在英國(guó)和美國(guó),RTX 5090、RTX 5080 FE都被移除了,最高只有RTX 5070。
目前還不清楚這是臨時(shí)調(diào)整,抑或NVIDIA已經(jīng)停產(chǎn)。
NVIDIA德國(guó)的一位發(fā)言人在接受采訪時(shí)只是說(shuō),不清楚。
NVIDIA中國(guó)官網(wǎng)上,RTX 5090 FE自然是沒(méi)有的,RTX 5080 FE倒是依然在列,可以跳轉(zhuǎn)到京東、天貓旗艦店,而價(jià)格一直堅(jiān)持8299元不動(dòng)搖。
英國(guó)
德國(guó)
法國(guó)
美國(guó)
另外,SK海力士官方宣布,全球第一家完成了新一代HBM4內(nèi)存的研發(fā),并且已經(jīng)做好了大規(guī)模量產(chǎn)的準(zhǔn)備。
SK海力士HBM4內(nèi)存的I/O接口位寬為2048-bit,每個(gè)針腳帶寬10Gbps,因此單獨(dú)一顆的帶寬就可高達(dá)驚人的2.5TB/s。
這已經(jīng)超過(guò)了JEDEC標(biāo)準(zhǔn)規(guī)范中規(guī)定的8Gbps,SK海力士宣稱(chēng)在AI設(shè)備中部署后可帶來(lái)最多69%的性能提升。

SK海力士還使用了該公司自研的MR-MUF封裝技術(shù),1bnm工藝也就是第五代10nm級(jí)。
至于satck堆疊層數(shù)、單顆容量,SK海力士暫未披露,預(yù)計(jì)最高12堆棧。
另外,三星也在積極推進(jìn)HBM4,希望能和SK海力士搶一杯羹。
HBM4內(nèi)存對(duì)于下一代AI基礎(chǔ)設(shè)施至關(guān)重要,NVIDIA、AMD、Intel都離不開(kāi)它。
其中,NVIDIA Rubin預(yù)計(jì)搭載288GB HBM4,AMD Instinct MI400系列更是最高做到恐怖的432GB,帶寬19.6TB/s。


除了游戲卡市場(chǎng),AMD還在AI顯卡市場(chǎng)追趕NVIDIA的步伐,這個(gè)領(lǐng)域要比游戲市場(chǎng)更難,甚至很難靠性?xún)r(jià)比優(yōu)勢(shì)賣(mài)出銷(xiāo)量。
AMD近期多位高管的表態(tài)都在強(qiáng)調(diào)2026年的MI450系列AI顯卡將會(huì)給AMD帶來(lái)重磅收入,而且性能等方面全面超越對(duì)手產(chǎn)品。
但是今年的AI市場(chǎng)上,AMD主打的MI350系列可能就沒(méi)那么受歡迎了,HSBC匯豐銀行日前發(fā)布的報(bào)告中,將AMD的目標(biāo)價(jià)從200美元下調(diào)到了185美元。
下調(diào)的原因就是MI355顯卡的均價(jià)從25000美元降至23000美元,約合人民幣16.4萬(wàn)元。
該系列顯卡是今年初才發(fā)布的,3nm工藝,CDNA4架構(gòu),其中MI350X適用于風(fēng)冷,MI355X適用于液冷,兩者的規(guī)格差不多,都是288GB HBM3e顯存,8TB/s帶寬,后者的性能更高一些。
MI355X的FP64性能可達(dá)78.6TFLOPS,F(xiàn)P16、FP8及FP4性能則是5、10.1、20.1PFLOPS。

這樣規(guī)格的顯卡平均售價(jià)只要16萬(wàn)元出頭,這是什么概念呢?NVIDIA基于RTX 4090改進(jìn)的國(guó)內(nèi)特供顯卡H20,也就96GB HBM3內(nèi)存,之前國(guó)內(nèi)售價(jià)都超過(guò)了20萬(wàn)元,被哄搶的時(shí)候甚至更高。
在AMD PPT中性能比B200還要強(qiáng)的MI350系列顯卡,還要得打價(jià)格戰(zhàn),這也能說(shuō)明NVIDIA在AI市場(chǎng)護(hù)城河有多深,不單是AMD硬件性能領(lǐng)先就能比的。
不過(guò)匯豐也在報(bào)告中表示,盡管下調(diào)了目標(biāo)股價(jià),但AMD在AI市場(chǎng)上的前景還是不錯(cuò)的,明年預(yù)期收入也只是從151億調(diào)至139億美元,仍比預(yù)期高20%,華爾街低估了AMD的AI業(yè)務(wù)。
包括微軟、甲骨文、Meta在內(nèi)的云服務(wù)廠商也在加強(qiáng)與AMD的合作,測(cè)試他們的MI400系列機(jī)柜解決方案,這是AMD明年在AI市場(chǎng)翻身的殺手锏級(jí)產(chǎn)品。
