前兩年的英偉達(dá)GTC大會(huì),我們都用較多的筆墨描摹了英偉達(dá)在AI方面的布局。事實(shí)上,雖然數(shù)據(jù)中心業(yè)務(wù)在英偉達(dá)這家公司的營(yíng)收占比不斷提升(達(dá)到將近四成),其最大的業(yè)務(wù)板塊仍然是游戲。英偉達(dá)FY21財(cái)年?duì)I收構(gòu)成中,游戲仍然有著將近一半的營(yíng)收占比。
借著這次英偉達(dá)在Computex 2021大會(huì)上的主題演講和新產(chǎn)品發(fā)布,我們來談?wù)動(dòng)ミ_(dá)當(dāng)前游戲相關(guān)的熱門技術(shù),也算是炒個(gè)冷飯——由RTX 3080 Ti/3070 Ti發(fā)散地聊聊如今英偉達(dá)在游戲GPU方面主推的技術(shù)。
英偉達(dá)今年在Computex之上的主題演講并不意外地分成了游戲和AI兩大部分,時(shí)間各占一半,也表現(xiàn)了游戲和AI(數(shù)據(jù)中心)作為其營(yíng)收支柱的重要性。
新發(fā)布的Geforce RTX 3080 Ti和3070 Ti
主題演講中,有關(guān)Geforce RTX 3080 Ti/3070 Ti發(fā)布所占的篇幅很小,基本上只有5分鐘的時(shí)間。這兩款GPU產(chǎn)品的發(fā)布一早就有傳言,推出是在情理之中的。從已有媒體發(fā)出的測(cè)試來看,3080 Ti的性能與3090接近,兩者的硬件配置也是比較接近的,可簡(jiǎn)單認(rèn)為是3090的顯存縮減版。

英偉達(dá)宣稱RTX 3080 Ti相比2080 Ti提速1.5倍。同樣是Ampere安培架構(gòu)GA102芯片,包括采用第二代RT光追核心、第三代Tensor核心、新的SM實(shí)現(xiàn)更高的FP32吞吐等。
從公版顯卡形態(tài)來看,RTX 3080 Ti和RTX 3080非常相似,僅從配置上能看出規(guī)格上的提升,主要表現(xiàn)在VRAM顯存和CUDA核心、Tensor/RT核心規(guī)模上的變化。所以其整體尺寸與散熱設(shè)計(jì),和RTX 3090仍然不同(但TDP一樣),后者明顯在尺寸上更大——這可能給RTX 3080 Ti造成更大的散熱壓力。
RTX 3070 Ti也屬于Ti家族的常規(guī)更新,安培架構(gòu)GA104,對(duì)比RTX 2070 Super有1.5倍性能提升。這兩款新品對(duì)比已有產(chǎn)品的規(guī)格具體如下表,老黃的刀法看起來還是相當(dāng)精湛:

以英偉達(dá)顯卡兩年一更新的常規(guī)節(jié)奏,今年的30系列的確是相比兩年前10系列相當(dāng)值得更新的GPU了,甚至不只是光追、DLSS等方便新特性的提升。下面這張圖是英偉達(dá)給出的三代產(chǎn)品Ti家族,在一些游戲上的性能變化。

英偉達(dá)國(guó)內(nèi)官網(wǎng)給的參考價(jià)格是RTX 3080 Ti為5499元人民幣起,RTX 3070 Ti則為3899元起。前者6月3日開售,后者6月10日開售。這個(gè)價(jià)格真的是看看就好,現(xiàn)在的GPU能不能按照英偉達(dá)的市場(chǎng)指導(dǎo)價(jià)買到,是個(gè)聽天由命的事情——即便黃仁勛在采訪中已經(jīng)在反復(fù)強(qiáng)調(diào)英偉達(dá)一方面在推CMP礦卡,緩解顯卡供貨問題,另一方面則每季度都有供貨的穩(wěn)步提升。
光追與DLSS生態(tài)的進(jìn)展
當(dāng)然本文不是要談GPU缺芯和礦潮的問題。Ampere架構(gòu)的兩個(gè)重要技術(shù)就是對(duì)實(shí)時(shí)光線追蹤和DLSS的硬件加速。不過這兩項(xiàng)特性早在Turing架構(gòu)時(shí)期就已經(jīng)作為英偉達(dá)主推的技術(shù)存在了。
現(xiàn)在這個(gè)階段屬于英偉達(dá)奮力將這兩個(gè)特性擴(kuò)充到自家游戲生態(tài)中的過程。這兩項(xiàng)特性也是AMD這類競(jìng)爭(zhēng)對(duì)手的絕對(duì)弱項(xiàng),只不過AMD如今把持著游戲主機(jī)生態(tài),在游戲領(lǐng)域具備了相對(duì)特別的話語權(quán)。所以英偉達(dá)要喊游戲開發(fā)商來為這兩項(xiàng)特性站臺(tái)。今年Computex上,英偉達(dá)就游戲相關(guān)的部分,主要發(fā)布的就是擴(kuò)充了光追和DLSS支持的游戲隊(duì)伍。
有關(guān)光線追蹤這項(xiàng)技術(shù),我們已經(jīng)在此前的文章里多有闡述,這里不再多談,畢竟英偉達(dá)的宣傳攻勢(shì)已經(jīng)到了消費(fèi)者即便沒見過,也聽過無數(shù)次的程度。簡(jiǎn)單來說,光線追蹤就是在生成某個(gè)3D場(chǎng)景時(shí)在某個(gè)階段所采用的一種技術(shù),這種技術(shù)能夠模擬現(xiàn)實(shí)世界中光的行為,讓畫面的光影效果變得更逼真。Turing架構(gòu)時(shí)期為消費(fèi)級(jí)GPU新增的RT core,就屬于為光線追蹤加速的專用硬件單元。

Ampere架構(gòu)的所謂二代RT core,主要應(yīng)當(dāng)是硬件資源堆砌更多(或可能有能效提升),在光線/三角形相交性能方面相比前代有2倍提升。
不過實(shí)時(shí)光追對(duì)GPU硬件資源仍有著相當(dāng)貪婪的需求。當(dāng)代GPU開4K+光追,暢玩3A大作在很多時(shí)候還是頗為勉強(qiáng)的。這時(shí)候配套的DLSS就能緩解硬件資源方面的壓力。此前我們一直沒怎么細(xì)致地談過DLSS技術(shù),趁此機(jī)會(huì)可以簡(jiǎn)單介紹一下:
DLSS(Deep Learning Super Sampling),看名字就知道是一種采用深度學(xué)習(xí)的超采樣技術(shù)。DLSS在Turing架構(gòu)GPU中也是引入的一項(xiàng)重要特性。其外顯就是把低分辨率的畫面升格為更高的分辨率。比如說把1080p的游戲畫面升格為2k畫面,而2k畫面則可升格為4k。這么做的價(jià)值在于,GPU不再需要渲染很高分辨率的畫面,渲染低分辨率畫面后通過DLSS實(shí)現(xiàn)分辨率的升格,而且畫質(zhì)與原始高分辨率渲染的畫面相差還不大。

去年英偉達(dá)將DLSS升級(jí)到2.0版本,其工作方式大致上是這樣的:用超級(jí)計(jì)算機(jī),對(duì)游戲超高分辨率的畫面和(輸出的)低分辨率畫面映射做訓(xùn)練(AI training);輸入也包括了運(yùn)動(dòng)向量,應(yīng)用于高分辨率畫面可以預(yù)測(cè)下一幀。此前有報(bào)道說英偉達(dá)是用DGX-1服務(wù)器做訓(xùn)練的。訓(xùn)練得到的AI模型通過Game Ready Drives和OTA升級(jí)推送到用戶端。
在開啟DLSS特性的游戲里,GPU就應(yīng)用訓(xùn)練模型,做inference,實(shí)現(xiàn)低分辨率畫面升格到高分辨率的操作。RTX 20與30系列GPU中的Tensor core,就有加速DLSS的職能,這也是AI在游戲消費(fèi)端廣泛應(yīng)用的技術(shù)了。
從支持DLSS特性的游戲來看,這項(xiàng)技術(shù)的主要價(jià)值在于極大提升游戲幀率(因?yàn)閷?shí)際要渲染的分辨率變低了),使得光追+DLSS成為相當(dāng)好的搭配方案。在開啟光追與DLSS時(shí),可保持流暢的游戲體驗(yàn);雖然DLSS升格的游戲畫面,和原高分辨率渲染的畫面畫質(zhì)相比還是會(huì)有差距,但提升已經(jīng)相當(dāng)顯著。另外,DLSS對(duì)于幀率有更高要求的VR理應(yīng)會(huì)有很大的價(jià)值。

《DYING: 1983》開啟光追效果后的游戲畫面
這次的Computex主題演講中,英偉達(dá)主要提到相關(guān)光線追蹤與DLSS的事件包括:
- 游戲《DYING: 1983》(中國(guó)游戲開發(fā)商N(yùn)EKCOM開發(fā))支持光線追蹤+DLSS;
- 《彩虹六號(hào):圍攻》實(shí)現(xiàn)對(duì)DLSS的支持;
- 《伊卡洛斯(Icarus)》第一章“First Cohort”將支持RTX光線追蹤全局照明和DLSS;
- 《荒野大鏢客:救贖2》將支持DLSS;
- VR游戲《無人深空(No Man’s Sky)》支持DLSS;
- 《Wrench》(Steam介紹中提到這是個(gè)機(jī)械模擬器,以VR的方式維護(hù)賽車)支持光追和DLSS;
- VR游戲《死亡半徑(Into the Radius)》支持DLSS;
射擊游戲低延遲的強(qiáng)化
不像DLSS/光追那么知名,英偉達(dá)有個(gè)Nvidia Reflex技術(shù),主要面向的應(yīng)該是電競(jìng)市場(chǎng)。這項(xiàng)特性也是到RTX 30系列顯卡推出時(shí)才發(fā)布的,需要與G-SYNC顯示器配合,也支持比較老的GPU;是一項(xiàng)在競(jìng)技游戲中,減少系統(tǒng)延遲的技術(shù)(click-to-display延遲),讓PC和顯示器更快地響應(yīng)鼠標(biāo)和鍵盤輸入。
Reflex包含兩部分,一是Reflex SDK——面向開發(fā)者的API,在游戲中加入Reflex,則游戲引擎做到與渲染的實(shí)時(shí)“對(duì)齊”,對(duì)于GPU壓力比較大的游戲場(chǎng)景有延遲表現(xiàn)方面的提升;
Reflex的另外一個(gè)組成部分是Reflex Latency Analyzer延遲分析器,針對(duì)廠商集成到G-SYNC顯示器中的系統(tǒng)延遲檢測(cè)工具,可以檢測(cè)從鼠標(biāo)點(diǎn)擊,到屏幕顯示像素變化,這個(gè)過程里的時(shí)間——這個(gè)工具也是為電競(jìng)選手或愛好者準(zhǔn)備的,以精準(zhǔn)理解鼠標(biāo)、PC和顯示性能。
針對(duì)系統(tǒng)延遲,英偉達(dá)官網(wǎng)有篇文章推薦游戲愛好者閱讀,雖然主體上也是在為Reflex打廣告,但對(duì)延遲的介紹也挺系統(tǒng)。

”英偉達(dá)在Computex上提到,平均而言,Reflex可以將系統(tǒng)延遲縮短20ms,20ms可能是開槍有沒有射中敵人的關(guān)鍵。“讓游戲玩家展現(xiàn)真正的實(shí)力”。“游戲玩家喜歡這一技術(shù),超過90%的游戲玩家使用Reflex進(jìn)行比賽。”
有關(guān)Reflex的發(fā)布,Computex會(huì)上有以下一些組成部分:
- 《戰(zhàn)爭(zhēng)雷霆(War Thunder)》《永劫無間(Naraka Bladepoint)》《穿越火線高清(Crossfire HD)》《逃離塔科夫(Escape from Tarkov)》都對(duì)Reflex實(shí)現(xiàn)了支持,“15大熱門設(shè)計(jì)游戲中,有12款即將采用Nvidia Reflex”;
- 13家合作伙伴5款顯示器和21款鼠標(biāo)實(shí)現(xiàn)對(duì)Reflex Latency Analyzer的支持,包括聯(lián)想、Viewsonic、EVGA;“只需將鼠標(biāo)插入顯示器,就可以精確測(cè)算從點(diǎn)擊到光子(from click to photon)的端到端延遲”;
游戲筆記本上的Max-Q
英偉達(dá)為筆記本設(shè)備推的Max-Q技術(shù)應(yīng)該也算是PC游戲界相對(duì)知名的技術(shù)了。Max-Q是把圖形算力不錯(cuò)的獨(dú)立GPU,塞進(jìn)相對(duì)比較輕薄的筆記本中的技術(shù)和方案;也就是說讓筆記本既有不錯(cuò)的圖形算力,又有比較薄的體態(tài)。
Max-Q設(shè)計(jì)考慮的因素包含芯片、驅(qū)動(dòng)、散熱、電氣、控制系統(tǒng)等。在面向筆記本的Geforce RTX 30系列GPU發(fā)布之時(shí),英偉達(dá)也發(fā)布了第三代Max-Q技術(shù)。Max-Q本身應(yīng)該算了多種技術(shù)的組合,比如說其中有個(gè)Dynamic Boost技術(shù)。
Dynamic Boost的實(shí)質(zhì),就是考慮到偏向輕薄的筆記本設(shè)計(jì)中,GPU和CPU是共享散熱和功耗設(shè)計(jì)的。通常共享散熱設(shè)計(jì)的方案,無法讓CPU和GPU同時(shí)達(dá)到預(yù)設(shè)的TDP,那么OEM廠商就需要對(duì)不同的峰值、持續(xù)負(fù)載做對(duì)應(yīng)的資源分配。Dynamic Boost 2.0就是一種CPU、GPU和顯存做動(dòng)態(tài)功耗分配的技術(shù),在比較輕薄的游戲筆記本上,可能以部分犧牲持續(xù)性能的方式,為峰值性能提供足夠的空間。
Max-Q設(shè)計(jì)還包括名為Whisper Mode的方案,最新版本的Whisper Mode是從系統(tǒng)設(shè)計(jì)層面來控制系統(tǒng)風(fēng)扇及其產(chǎn)生的噪音——這項(xiàng)技術(shù)顧名思義也就是讓玩家在游戲性能/畫質(zhì)與更安靜的系統(tǒng)之間做出選擇,對(duì)于很多原本就能實(shí)現(xiàn)極高幀率的游戲而言,Whisper Mode還是相當(dāng)有價(jià)值的。

新版的Max-Q現(xiàn)在也有DLSS的加持,另外也包括resizable BAR的支持。隨Ampere架構(gòu)而來的第三代Max-Q,也是因?yàn)橛辛薉LSS的加持,算是極大程度實(shí)現(xiàn)了性能和功耗表現(xiàn)的雙豐收。“假設(shè)以47fps的速度玩《控制(Control)》,在1440p分辨率下,GPU渲染的像素接近400萬,功率80W;Nvidia DLSS采用AI驅(qū)動(dòng)的Tensor core來提升幀率,GPU只需要渲染一小部分像素,使用AI來補(bǔ)完幀,得到的圖像和原生1440p一樣精美,相同功率下獲得性能是原生圖像的1.5-2倍。”
因?yàn)楣P記本設(shè)備在PC中占比的提升,Max-Q技術(shù)實(shí)際上也是英偉達(dá)提升收益相當(dāng)重要的組成部分(雖然MX系列的入門GPU可能仍然是個(gè)主力)。

英偉達(dá)這次在Max-Q方面的產(chǎn)品發(fā)布,主要是和外星人合作設(shè)計(jì)的一款RTX 3080筆記本Alienware x15,這款15寸筆記本的厚度為15.9mm。應(yīng)用的技術(shù)包括了前面提到的Dynamic Boost、Whisper Mode和Advanced Optimus(一種獨(dú)顯與核顯都可直連輸出到屏幕的方案,能夠降低功耗)。
當(dāng)圖形計(jì)算應(yīng)用于設(shè)計(jì)和作品
圖形計(jì)算除了應(yīng)用于游戲,在很多領(lǐng)域也有重要的位置,比如說3D設(shè)計(jì)。英偉達(dá)的Nvidia Studio平臺(tái)就是面向3D設(shè)計(jì)師、視頻剪輯師和攝影師的。Studio的實(shí)體包括GPU和“特有驅(qū)動(dòng)技術(shù)”(所謂的Sdudio Drivers)的結(jié)合。
主要的支持領(lǐng)域包括視頻編輯與動(dòng)態(tài)影像,比如Premiere、達(dá)芬奇的創(chuàng)作;3D與渲染,如Autodesk Arnold、Blender;攝影師后期編輯,Photoshop、Lightroom是典型;圖形設(shè)計(jì),如Illustrator;以虛幻引擎、V-Ray實(shí)現(xiàn)光線追蹤支持的世界模擬等。
對(duì)于這個(gè)平臺(tái),英偉達(dá)也向軟件開發(fā)商提供Studio SDK,在其應(yīng)用中增加渲染、AI、視頻處理特性等。通常RTX Studio系統(tǒng)采用高端Geforce/Quadro RTX顯卡,以及高標(biāo)準(zhǔn)要求的顯示器,以筆記本或桌面PC的形態(tài)呈現(xiàn)。

英偉達(dá)在Computex上針對(duì)這一平臺(tái)的發(fā)布,主要是宏碁和惠普所推的Studio筆記本電腦。其中惠普Envy適用于學(xué)生和創(chuàng)作者,是款偏便攜的本子。而宏碁ConceptD除了形態(tài)上的翻蓋設(shè)計(jì)外,還帶Ezel繪圖板。

此外,英偉達(dá)這次還提到了Omniverse Machinima。Machinima一般是指使用實(shí)時(shí)圖形引擎去打造電影、短片作品的方式,80年代就有了。此前Quake、Doom引擎就被用來創(chuàng)作電影。《模擬人生》這款游戲,似乎在網(wǎng)上就有很多人用其素材來做成短片或者故事片的。
英偉達(dá)所推的Omniverse Machinima就是為此加了光線追蹤和AI,制作動(dòng)畫故事。用戶可以導(dǎo)入自己的游戲素材,或者從英偉達(dá)的庫中提取素材。有關(guān)Omniverse,此前我們也介紹過多次了,這是個(gè)用于創(chuàng)建、模擬虛擬世界的平臺(tái),在虛擬世界中的元素是遵循物理定律的(比如對(duì)液體、材料的模擬等)。將其應(yīng)用于Machinima,本身就是相當(dāng)順理成章的需求。英偉達(dá)也在其中加入了不少工具,比如Wrench的AI Pose的網(wǎng)絡(luò)攝像頭就能對(duì)現(xiàn)實(shí)中的動(dòng)作進(jìn)行動(dòng)畫處理。
目前Omniverse Machinima發(fā)布的是測(cè)試版。

其實(shí)有關(guān)Omniverse,未來我們還可以單獨(dú)撰文做更多可能性的探討。今年黃仁勛在線上接受采訪時(shí),所處的位置就在英偉達(dá)的新建筑內(nèi)(似乎叫做Voyager)。黃仁勛特別提到這座建筑在設(shè)計(jì)上是花了比較多的心思的,比如在光照的設(shè)計(jì)上。
據(jù)說這棟建筑在設(shè)計(jì)之初,英偉達(dá)就“在超級(jí)計(jì)算機(jī)DGX上,利用光線追蹤對(duì)整棟建筑做了模擬,這樣的話,我們就能平衡從外界照進(jìn)來的光和熱量了”,所以這棟建筑的房頂在設(shè)計(jì)上就有個(gè)恰到好處的角度,讓早晨和下午的陽光都不會(huì)直射到房子里。在做到某種自然光的“fine balance”之后,就不需要供許多電用于空調(diào)。
黃仁勛說,這是英偉達(dá)為建筑所做的貢獻(xiàn),采用超級(jí)計(jì)算機(jī)模擬未來建筑,“我想,未來所有的建筑都會(huì)是這樣。”另外,在設(shè)計(jì)思路上,這棟樓內(nèi)部未來會(huì)容納很多的機(jī)器人,在樓內(nèi)游走。“你可以把自己上傳進(jìn)機(jī)器人,用VR/AR頭盔做設(shè)定,通過機(jī)器人在園區(qū)內(nèi)行走。”
不知不覺,還是從單純的圖形計(jì)算談到了AI。從英偉達(dá)對(duì)模擬世界的種種設(shè)想來看,GPU應(yīng)用于圖形計(jì)算和AI似乎更像是件共通的事情。Computex上所做的這些都屬于生態(tài)發(fā)布,或者說是生態(tài)構(gòu)建進(jìn)展的匯報(bào)。英偉達(dá)正在締造的圖形與AI生態(tài)帝國(guó)顯得如此令人難以望其項(xiàng)背,當(dāng)前其生態(tài)能力很多時(shí)候已經(jīng)讓人忘了GPU作為硬件的存在性。
從一家單純?yōu)橛螒蜃黾铀倏ǖ墓景l(fā)展至今,應(yīng)該是近30年前老黃在開創(chuàng)英偉達(dá)之初無論如何都沒有想到的……吧。
責(zé)編:Luffy Liu